API för transkribering och professionell undertextning av video på EU-servrar — Inwista API v1
I dag öppnar vi maskineriet bakom Inwista: API v1 är lanserat. Allt vår studio gör med en inspelning — tal-till-text på över 70 språk med automatisk talaridentifiering, undertexter formaterade enligt sändningsstandard, översättning av undertexter på samma fil — är nu tillgängligt som byggstenar för era egna system.
Det är ett litet men komplett transkriberings-API: åtta endpoints fördelade på fyra resurser. Du skapar en transkription från en medie-URL — en fil i din egen lagring, eller helt enkelt en YouTube-, TikTok- eller Vimeo-länk — och hämtar sedan undertexter i fyra format (SRT- och VTT-filer, rena textutskrifter, eller strukturerad JSON med tidsstämplar och talare), kör konfigurerbar undertextförbättring i sändningskvalitet, och översätter samma undertexter till vilket som helst av över 70 språk. Webhooks meddelar era system när jobben är klara, och varje förbättring och översättning är en låst revision som alltid kan hämtas fram igen.
Fakturering är så enkelt det kan bli: API-et använder samma AI-krediter som allt annat i Inwista. Inget separat API-avtal, ingen ny mätare att lära sig — 4 krediter per påbörjad minut media, dragna från prenumerationens månatliga krediter först och engångspaket för allt därutöver, med automatisk återbetalning när ett jobb misslyckas. Allt behandlas med full datalagring i EU, på våra egna servrar inom EU/EES — aldrig delat, aldrig använt för att träna AI-modeller.
curl -X POST https://api.inwista.ai/v1/transcriptions \
-H "Authorization: Bearer inw_live_…" \
-d '{ "source_url": "https://cdn.example.com/episode-04.mp4", "language": "en", "diarization": true }'
Sätt de här byggstenarna mitt i ett verkligt arbetsflöde, och de tar bort steg som hela team i dag gör för hand. Så här ser automatisk transkribering och undertextning ut i fem olika världar.
Automatiserad undertextning i sändningskvalitet för produktionsbolag
Ett postproduktionshus som levererar en serie på tio avsnitt avslutar i dag varje projekt på samma sätt: exporterna skickas till en undertextleverantör, filerna kommer tillbaka dagar senare, någon stickprovar dem, en revision går i retur, och leveransfristen sväljer alltihop.
Med API-et i produktionslinjen utlöser rendern som landar i lagringen en transkription, undertextförbättringen lägger på er husstil, och den färdiga SRT-filen kommer tillbaka via en signerad webhook-URL, rakt in i MAM-systemet. Ett avsnitt på 45 minuter kostar 180 krediter — och är undertextat innan klipprummet har gått vidare.
Och ”husstil” är ingen metafor — `/enhance`-endpointen tar emot samma regler som en undertextmanual för broadcast, som explicita inställningar:
- Radgeometri: `maxCharactersPerLine` (standard `42` — sändningskonventionen) och `maxLinesPerBlock` (1 eller 2)
- Radbalansering: `blockLineBalancing` — `bottom_heavy`, `top_heavy`, `equal` eller `unconstrained`
- Timing: `minBlockDuration` och `maxBlockDuration` i sekunder, så att ingen undertext blinkar förbi eller blir hängande
- Täthet: `textCondensation` — `none`, `smart` eller `aggressive` — när ordagrann text inte ryms i läsfönstret
- Dialog: `speakerDialogueFormat` — bindestreck, hakparenteser eller fullständiga talarnamn
- Kontinuitet: `continuationMarkers` i början/slutet av block, som tankstreck eller ellips
- Leveransmål: `gapBetweenBlocks` med förval för `broadcasting`, `streaming` eller `sdh`
curl -X POST https://api.inwista.ai/v1/transcriptions/{id}/enhance \
-H "Authorization: Bearer inw_live_…" \
-d '{ "settings": { "maxCharactersPerLine": 37, "blockLineBalancing": "bottom_heavy", "textCondensation": "smart" } }'
Samma transkription, anpassad för varje leveransmål — undertexter för broadcast, en egen version för streaming, en SDH-version för tillgänglighet — och var och en är en låst revision: när ett tv-bolag frågar vilken undertextversion som levererades i mars, kan exakt den filen hämtas fram igen på ID. Kvalitetskontroll av undertexter slutar vara en diskussion om bifogade filer i mejl.
Undertexta universitetsföreläsningar i stor skala — WCAG och tillgänglighetsdirektivet
Tillgänglighetsdirektivet (EAA) förvandlade undertexter på video från en artighet till ett lagkrav, och de flesta lärosäten sitter med samma problem: ett decennium av inspelade föreläsningar, och en undertextoffert som läses som ett byggprojekt. Fakturerat på traditionellt vis, per minut manuellt arbete, blir ett arkiv på 800 föreläsningar ett budgetmöte — så det förblir otextat.
Genom API-et är samma arkiv en loop: hämta varje inspelning från lagringen, transkribera, hämta VTT-filen, lägg in den i LMS-et. Med 4 krediter per minut kör det över natten i stället för över en termin, och tillgänglighetseftersläpningen blir till WCAG-kompatibla undertexter på varje föreläsning. Flaggskeppskurserna går ett anrop längre: `/translate` förvandlar samma undertextfiler till flerspråkiga undertexter på de språk era studenter faktiskt talar, med timing ärvd från källan.
Transkribera YouTube-videor och poddarkiv med ett anrop
Medieteam har sällan prydliga källfiler till sin backkatalog. Det de har är länkar. API-et tar emot YouTube- och Vimeo-URL:er direkt, och därmed går ”gör arkivet sökbart” från att vara ett migreringsprojekt till ett eftermiddagsskript: loopa över kanalen, transkribera varje avsnitt med talarnamn, publicera utskriften under varje avsnittssida.
Vad det ger, helt konkret: ett intervjuarkiv på 400 avsnitt blir fulltextsökbart för redaktionen, citerbart för klipp till sociala medier, indexerbart för sökmotorer — och tillgängligt, vilket plattformar och stödansökningar allt oftare frågar efter. Ingen ny uppladdning, ingen lagringsfaktura, ingen praktikant med hörlurar.
Ett GDPR-vänligt tal-till-text-API för produktteam
Många produkter vill ha en ”Generera undertexter”-knapp — videoplattformar, intervjuverktyg, LMS-leverantörer, legal tech, HR-system. Det är sällan utvecklingen som stoppar det; det är leverantörsgranskningen. Någonstans mellan ”skickar kundinspelningar till ett amerikanskt moln” och ”kan använda innehåll för modellträning” säger juridik nej.
Inwistas API är den version av det samtalet som tar slut snabbt: ett GDPR-vänligt transkriberings-API där all behandling sker uteslutande på våra egna servrar inom EU/EES, innehåll aldrig delas med tredje part och aldrig används för träning — meningar du kan skriva rakt in i din egen integritetspolicy. Den tekniska sidan är byggd för produktionsbruk: idempotensnycklar på varje skrivoperation, förutsägbara hastighetsbegränsningar, atomisk fakturering med automatisk återbetalning, och ett `metadata`-fält som bär era egna referens-ID:n genom hela flödet, så att webhooks landar färdigmärkta i ert system.
SDH-undertexter för offentliga möten, samma eftermiddag
Kommuner och myndigheter strömmar timtals med möten varje vecka, och förväntningarna på tillgänglighet går bara åt ett håll. Ett tre timmar långt kommunfullmäktigemöte undertextat för hand är en verklig faktura; genom API-et är det 720 krediter och klart samma eftermiddag — transkriberat med talarnamn, formaterat med SDH-förvalet, publicerat tillsammans med inspelningen. Där invånarna talar flera språk översätts samma undertexter med ett anrop till.
För upphandlingen besvaras frågorna som normalt kräver ett eget möte på en enda rad: behandling inom EU/EES, GDPR, ingen träning på innehåll, radering under er kontroll.
Alla prenumerationer inkluderar API-krediter — även gratisplanen
Eftersom API-et använder dina vanliga AI-krediter behöver du inte köpa något extra för att prova det. Gratisplanen inkluderar 100 krediter varje månad — nog för ungefär 25 minuters API-transkribering, förnyat varje månad, så att du kan bygga din integration och hålla ett litet arbetsflöde igång utan att betala något. (Gratisplanens 45 studiominuter är något annat: använd dem till att granska transkriptioner och undertextstilar med egna ögon i appen innan du skriver en enda rad kod.)
Betalda prenumerationer inkluderar 1000–2500 krediter i månaden, och engångspaket med krediter — som aldrig går ut — täcker allt därutöver. Misslyckade jobb återbetalar sig själva automatiskt, tillbaka dit krediterna kom ifrån.
Hela referensen — autentisering, webhooks, format, felhantering — hittar du i vår API-referens. Bygger du något större, eller behöver volympriser för en verklig eftersläpning: sales@inwista.ai.
Vanliga frågor
Vad kan det här transkriberings-API-et ta emot?
Offentliga medie-URL:er — ljud- eller videofiler, eller YouTube-, TikTok- och Vimeo-länkar direkt. Över 70 språk, med automatisk talaridentifiering.
Vad returnerar det?
SRT, VTT, TXT eller strukturerad JSON — samt sändningsformaterade och översatta versioner av samma undertexter på begäran.
Kan jag styra formateringen av undertexterna?
Ja — tecken per rad, rader per block, radbalansering, tidsgränser, textförtätning, dialogmarkering, kontinuitetsmarkörer och förval för broadcast, streaming eller SDH är alla explicita inställningar på förbättringsendpointen.
Kan jag prova API-et gratis?
Ja. API-et drar från samma AI-krediter som resten av Inwista, och alla prenumerationer inkluderar en månatlig kvot — 100 krediter på gratisplanen, ungefär 25 minuters transkribering varje månad.
Är API-et förenligt med GDPR?
Ja — all behandling sker på Inwistas egna servrar inom EU/EES. Innehåll delas aldrig med tredje part och används aldrig för att träna AI-modeller.
Vad kostar det?
4 krediter per påbörjad minut, dragna från prenumerationens månatliga AI-krediter först och engångspaket — som aldrig går ut — för resten. Misslyckade jobb återbetalas automatiskt.
Hur snabbt går det?
Ungefär tio minuters behandling per timme ljud.