API transkriptioon ja ammattimaiseen videotekstitykseen EU-palvelimilla — Inwista API v1

Tänään avaamme Inwistan konepellin alla olevan koneiston: API v1 on julkaistu. Kaikki, mitä studiomme tekee tallenteelle — puheen muuntaminen tekstiksi yli 70 kielellä automaattisella puhujantunnistuksella, tekstitykset muotoiltuna lähetysstandardien mukaan, tekstitysten kääntäminen samasta tiedostosta — on nyt saatavilla rakennuspalikoina omiin järjestelmiinne.


Se on pieni mutta täydellinen transkriptio-API: kahdeksan endpointia neljässä resurssissa. Luot transkription media-URL-osoitteesta — tiedostosta omassa tallennustilassasi tai yksinkertaisesti YouTube-, TikTok- tai Vimeo-linkistä — ja haet sitten tekstitykset neljässä formaatissa (SRT- ja VTT-tiedostot, pelkkä tekstimuoto tai strukturoitu JSON aikaleimoineen ja puhujineen), ajat konfiguroitavan broadcast-tasoisen tekstitysparannuksen ja käännät samat tekstitykset mille tahansa yli 70 kielestä. Webhookit ilmoittavat järjestelmillenne, kun työt valmistuvat, ja jokainen parannus ja käännös on lukittu revisio, joka on aina haettavissa uudelleen.


Laskutus on niin yksinkertaista kuin olla voi: API käyttää samoja AI-krediittejä kuin kaikki muukin Inwistassa. Ei erillistä API-sopimusta, ei uutta mittaria opeteltavaksi — 4 krediittiä jokaiselta alkavalta mediaminuutilta, ensin tilauksen kuukausittaisista krediiteistä ja sen jälkeen kertaostettavista krediittipaketeista, ja epäonnistuneet työt hyvitetään automaattisesti. Kaikki käsitellään täysin EU:ssa, omilla palvelimillamme EU-/ETA-alueella — ei koskaan jaeta, ei koskaan käytetä AI-mallien kouluttamiseen.


  curl -X POST https://api.inwista.ai/v1/transcriptions \
   -H "Authorization: Bearer inw_live_…" \
   -d '{ "source_url": "https://cdn.example.com/episode-04.mp4", "language": "en", "diarization": true }'


Aseta nämä palikat keskelle todellista työnkulkua, ja ne poistavat vaiheita, joita kokonaiset tiimit tekevät tänään käsin. Tältä automaattinen transkriptio ja tekstitys näyttävät viidessä eri maailmassa.


Automaattinen broadcast-tekstitys tuotantoyhtiöille

Jälkituotantotalo, joka toimittaa kymmenen jakson sarjan, päättää tänään jokaisen projektin samalla tavalla: eksportit lähtevät tekstitystoimittajalle, tiedostot palaavat päivien päästä, joku pistokokeilee ne, revisio lähtee takaisin, ja toimitusaikataulu nielaisee kaiken.


Kun API on osa tuotantolinjaa, tallennustilaan laskeutuva renderi käynnistää transkription, tekstitysparannus lisää talotyylinne, ja valmis SRT-tiedosto palaa allekirjoitetun webhook-URL:n kautta suoraan MAM-järjestelmään. 45 minuutin jakso maksaa 180 krediittiä — ja on tekstitetty ennen kuin leikkaamo on ehtinyt seuraavaan jaksoon.


Eikä ”talotyyli” ole vertauskuva — `/enhance`-endpoint ottaa vastaan samat säännöt kuin broadcast-tekstityksen tyyliopas, eksplisiittisinä asetuksina:


- Rivigeometria: `maxCharactersPerLine` (oletus `42` — broadcast-konventio) ja `maxLinesPerBlock` (1 tai 2)

- Rivien tasapainotus: `blockLineBalancing` — `bottom_heavy`, `top_heavy`, `equal` tai `unconstrained`

- Ajoitus: `minBlockDuration` ja `maxBlockDuration` sekunteina, jottei yksikään tekstitys vilahda ohi tai jää roikkumaan

- Tiiviys: `textCondensation` — `none`, `smart` tai `aggressive` — kun sanatarkka teksti ei mahdu lukuikkunaan

- Dialogi: `speakerDialogueFormat` — ajatusviivat, hakasulkeet tai täydet puhujanimet

- Jatkuvuus: `continuationMarkers` lohkojen alussa/lopussa, ajatusviivana tai ellipsinä

- Toimituskohde: `gapBetweenBlocks` esiasetuksilla `broadcasting`, `streaming` tai `sdh`


  curl -X POST https://api.inwista.ai/v1/transcriptions/{id}/enhance \
   -H "Authorization: Bearer inw_live_…" \
   -d '{ "settings": { "maxCharactersPerLine": 37, "blockLineBalancing": "bottom_heavy", "textCondensation": "smart" } }'


Sama transkriptio, sovitettuna jokaiseen toimituskohteeseen — tekstitykset broadcastiin, oma versionsa suoratoistoon, SDH-versio esteettömyyteen — ja jokainen niistä on lukittu revisio: kun lähettäjä kysyy, mikä tekstitysversio toimitettiin maaliskuussa, juuri se tiedosto on haettavissa uudelleen ID:llä. Tekstityksen laadunvalvonta lakkaa olemasta väittely sähköpostiliitteistä.


Tekstitä yliopistoluennot suuressa mittakaavassa — WCAG ja esteettömyysdirektiivi

Esteettömyysdirektiivi (EAA) muutti videoiden tekstityksen kohteliaisuudesta lakisääteiseksi vaatimukseksi, ja useimmat oppilaitokset istuvat saman ongelman äärellä: vuosikymmen tallennettuja luentoja ja tekstitystarjous, joka lukee kuin rakennusurakka. Perinteisellä tavalla laskutettuna, käsityöminuutti kerrallaan, 800 luennon arkistosta tulee budjettikokous — joten se jää tekstittämättä.


API:n kautta sama arkisto on silmukka: hae jokainen tallenne tallennustilasta, transkriboi, hae VTT-tiedosto, liitä se LMS-järjestelmään. Neljällä krediitillä minuutilta se pyörii yön yli lukukauden sijaan, ja esteettömyysvelka muuttuu WCAG-yhteensopiviksi tekstityksiksi jokaisella luennolla. Lippulaivakurssit menevät yhden kutsun pidemmälle: `/translate` muuttaa samat tekstitystiedostot monikielisiksi tekstityksiksi kielille, joita opiskelijanne oikeasti puhuvat, ajoitus perittynä lähteestä.


Transkriboi YouTube-videot ja podcast-arkistot yhdellä kutsulla

Mediatiimeillä on harvoin siistejä lähdetiedostoja arkistolleen. Se, mitä heillä on, ovat linkit. API ottaa YouTube- ja Vimeo-URL-osoitteet vastaan suoraan, ja näin ”tee arkistosta haettava” muuttuu migraatioprojektista iltapäivän skriptiksi: silmukka kanavan yli, transkriboi jokainen jakso puhujanimineen, julkaise teksti jokaisen jakson sivulla.


Mitä sillä saa, ihan konkreettisesti: 400 jakson haastatteluarkisto muuttuu kokotekstihaettavaksi toimitukselle, siteerattavaksi some-klippeihin, hakukoneiden indeksoitavaksi — ja esteettömäksi, mitä alustat ja tukihakemukset kysyvät yhä useammin. Ei uudelleenlatauksia, ei tallennuslaskua, ei harjoittelijaa kuulokkeet päässä.


GDPR-yhteensopiva puheentunnistus-API tuotetiimeille

Moni tuote haluaa ”Luo tekstitykset” -napin — videoalustat, haastattelutyökalut, LMS-toimittajat, legal tech, HR-järjestelmät. Kehitystyö on harvoin este; toimittaja-arviointi on. Jossain kohdassa välillä ”lähettää asiakastallenteet yhdysvaltalaiseen pilveen” ja ”voi käyttää sisältöä mallien kouluttamiseen” juristit sanovat ei.


Inwistan API on se versio siitä keskustelusta, joka loppuu nopeasti: GDPR-yhteensopiva transkriptio-API, jossa kaikki käsittely tapahtuu yksinomaan omilla palvelimillamme EU-/ETA-alueella, sisältöä ei koskaan jaeta kolmansille osapuolille eikä koskaan käytetä kouluttamiseen — lauseita, jotka voit kirjoittaa suoraan omaan tietosuojaselosteeseesi. Tekninen puoli on rakennettu tuotantokäyttöön: idempotenssiavaimet jokaisessa kirjoitusoperaatiossa, ennakoitavat nopeusrajoitukset, atominen laskutus automaattisine hyvityksineen, ja `metadata`-kenttä, joka kuljettaa omat viite-ID:nne koko virran läpi, jotta webhookit laskeutuvat järjestelmäänne valmiiksi merkittyinä.


SDH-tekstitykset julkisiin kokouksiin, samana iltapäivänä

Kunnat ja julkiset toimijat suoratoistavat tuntikausia kokouksia joka viikko, ja esteettömyysodotukset kulkevat vain yhteen suuntaan. Kolmituntinen valtuuston kokous käsin tekstitettynä on todellinen lasku; API:n kautta se on 720 krediittiä ja valmis samana iltapäivänä — transkriboituna puhujanimineen, muotoiltuna SDH-esiasetuksella, julkaistuna tallenteen rinnalla. Siellä missä asukkaat puhuvat useampaa kieltä, samat tekstitykset käännetään yhdellä kutsulla lisää.


Hankintayksikölle kysymykset, jotka normaalisti vaatisivat oman kokouksensa, vastataan yhdellä rivillä: käsittely EU-/ETA-alueella, GDPR, ei koulutusta sisällöllä, poistaminen teidän hallinnassanne.


Kaikki tilaukset sisältävät API-krediittejä — myös ilmainen

Koska API käyttää tavallisia AI-krediittejäsi, sinun ei tarvitse ostaa mitään ylimääräistä kokeillaksesi sitä. Ilmainen tilaus sisältää 100 krediittiä joka kuukausi — riittävästi noin 25 minuutin API-transkriptioon, kuukausittain uusiutuvana, joten voit rakentaa integraatiosi ja pitää pienen työnkulun käynnissä maksamatta mitään. (Ilmaisen tilauksen 45 studiominuuttia ovat eri asia: käytä ne transkriptioiden ja tekstitystyylien tarkasteluun omin silmin sovelluksessa, ennen kuin kirjoitat riviäkään koodia.)


Maksulliset tilaukset sisältävät 1000–2500 krediittiä kuukaudessa, ja kertaostettavat krediittipaketit — jotka eivät koskaan vanhene — kattavat kaiken sen yli. Epäonnistuneet työt hyvittävät itsensä automaattisesti, takaisin sinne, mistä krediitit tulivat.


Koko referenssi — autentikointi, webhookit, formaatit, virheenkäsittely — löytyy API-referenssistämme. Jos rakennat jotain suurempaa tai tarvitset volyymihinnat todelliselle arkistolle: sales@inwista.ai.


Usein kysytyt kysymykset

Mitä tämä transkriptio-API voi ottaa vastaan?

Julkisia media-URL-osoitteita — ääni- tai videotiedostoja, tai YouTube-, TikTok- ja Vimeo-linkkejä suoraan. Yli 70 kieltä, automaattisella puhujantunnistuksella.


Mitä se palauttaa?

SRT, VTT, TXT tai strukturoitu JSON — sekä pyynnöstä broadcast-muotoillut ja käännetyt versiot samoista tekstityksistä.


Voinko hallita tekstitysten muotoilua?

Kyllä — merkit riviä kohden, rivit lohkoa kohden, rivien tasapainotus, aikarajat, tekstin tiivistys, dialogin merkintä, jatkuvuusmerkit ja esiasetukset broadcastille, suoratoistolle tai SDH:lle ovat kaikki eksplisiittisiä asetuksia parannus-endpointissa.


Voinko kokeilla API:a ilmaiseksi?

Kyllä. API vähentää samoista AI-krediiteistä kuin muukin Inwista, ja kaikki tilaukset sisältävät kuukausittaisen kiintiön — 100 krediittiä ilmaisella tilauksella, noin 25 minuuttia transkriptiota joka kuukausi.


Onko API GDPR-yhteensopiva?

Kyllä — kaikki käsittely tapahtuu Inwistan omilla palvelimilla EU-/ETA-alueella. Sisältöä ei koskaan jaeta kolmansille osapuolille eikä koskaan käytetä AI-mallien kouluttamiseen.


Mitä se maksaa?

4 krediittiä jokaiselta alkavalta minuutilta, ensin tilauksen kuukausittaisista AI-krediiteistä ja loput kertaostettavista krediittipaketeista — jotka eivät koskaan vanhene. Epäonnistuneet työt hyvitetään automaattisesti.


Kuinka nopeaa se on?

Noin kymmenen minuuttia käsittelyä tuntia äänitettä kohden.