API de transcription et de sous-titrage vidéo professionnel sur serveurs UE — Inwista API v1

Aujourd'hui, nous ouvrons la mécanique qui fait tourner Inwista : l'API v1 est en ligne. Tout ce que notre studio fait d'un enregistrement — transcription vocale dans plus de 70 langues avec identification automatique des locuteurs, sous-titres formatés selon les normes de diffusion, traduction des sous-titres sur le même fichier — est désormais disponible sous forme de briques pour vos propres systèmes.


C'est une API de transcription compacte mais complète : huit endpoints répartis sur quatre ressources. Vous créez une transcription à partir d'une URL de média — un fichier sur votre stockage, ou tout simplement un lien YouTube, TikTok ou Vimeo — puis vous récupérez les sous-titres dans quatre formats (fichiers SRT et VTT, texte brut, ou JSON structuré avec horodatages et locuteurs), vous lancez une amélioration de sous-titres configurable en qualité broadcast, et vous traduisez ces mêmes sous-titres dans n'importe laquelle de plus de 70 langues. Des webhooks préviennent vos systèmes quand les traitements se terminent, et chaque amélioration et traduction est une révision figée, récupérable à tout moment.


La facturation ne pourrait pas être plus simple : l'API consomme les mêmes crédits IA que tout le reste d'Inwista. Pas de contrat API séparé, pas de nouveau compteur à apprendre — 4 crédits par minute entamée de média, prélevés d'abord sur les crédits mensuels de votre formule puis sur les packs de crédits à achat unique, avec remboursement automatique quand un traitement échoue. Tout est traité avec une résidence des données intégralement en UE, sur nos propres serveurs au sein de l'UE/EEE — jamais partagé, jamais utilisé pour entraîner des modèles d'IA.


  curl -X POST https://api.inwista.ai/v1/transcriptions \
   -H "Authorization: Bearer inw_live_…" \
   -d '{ "source_url": "https://cdn.example.com/episode-04.mp4", "language": "en", "diarization": true }'


Placez ces briques au cœur d'un vrai flux de production, et elles suppriment des étapes que des équipes entières font aujourd'hui à la main. Voici à quoi ressemblent la transcription et le sous-titrage automatiques dans cinq univers différents.


Sous-titrage broadcast automatisé pour les sociétés de production

Une maison de postproduction qui livre une série de dix épisodes termine aujourd'hui chaque projet de la même façon : les exports partent chez un prestataire de sous-titrage, les fichiers reviennent des jours plus tard, quelqu'un fait des contrôles au hasard, une révision repart, et la date de livraison absorbe tout.


Avec l'API dans le pipeline, le rendu qui atterrit dans le stockage déclenche une transcription, l'amélioration des sous-titres applique votre style maison, et le fichier SRT terminé revient par une URL de webhook signée, directement dans le MAM. Un épisode de 45 minutes, c'est 180 crédits — sous-titré avant que la salle de montage soit passée à la suite.


Et « style maison » n'est pas une métaphore — l'endpoint `/enhance` accepte les mêmes règles qu'une charte de sous-titrage broadcast, sous forme de réglages explicites :


- Géométrie des lignes : `maxCharactersPerLine` (par défaut `42` — la convention broadcast) et `maxLinesPerBlock` (1 ou 2)

- Équilibrage des lignes : `blockLineBalancing` — `bottom_heavy`, `top_heavy`, `equal` ou `unconstrained`

- Timing : `minBlockDuration` et `maxBlockDuration` en secondes, pour qu'aucun sous-titre ne passe en un éclair ni ne s'attarde

- Densité : `textCondensation` — `none`, `smart` ou `aggressive` — quand le mot à mot ne tient pas dans la fenêtre de lecture

- Dialogues : `speakerDialogueFormat` — tirets, étiquettes entre crochets, ou noms complets des locuteurs

- Continuité : `continuationMarkers` en début/fin de bloc, en tiret ou en points de suspension

- Cible de diffusion : `gapBetweenBlocks` avec des préréglages `broadcasting`, `streaming` ou `sdh`


  curl -X POST https://api.inwista.ai/v1/transcriptions/{id}/enhance \
   -H "Authorization: Bearer inw_live_…" \
   -d '{ "settings": { "maxCharactersPerLine": 37, "blockLineBalancing": "bottom_heavy", "textCondensation": "smart" } }'


La même transcription, déclinée pour chaque cible de diffusion — sous-titres pour l'antenne, une version dédiée pour le streaming, une version SME (SDH) pour l'accessibilité — et chacune est une révision figée : quand un diffuseur demande quelle version des sous-titres a été livrée en mars, ce fichier exact est reproductible par son ID. Le contrôle qualité des sous-titres cesse d'être un débat autour de pièces jointes.


Sous-titrez les cours magistraux à grande échelle — WCAG et Acte européen sur l'accessibilité

L'Acte européen sur l'accessibilité (EAA) a transformé le sous-titrage vidéo d'une attention en une obligation légale, et la plupart des établissements sont assis sur le même problème : une décennie de cours enregistrés, et un devis de sous-titrage qui se lit comme un devis de chantier. Facturé à l'ancienne, à la minute de travail humain, un fonds de 800 cours devient une réunion budgétaire — alors il reste sans sous-titres.


Via l'API, ce même catalogue est une boucle : récupérez chaque enregistrement du stockage, transcrivez, récupérez le fichier VTT, rattachez-le au LMS. À 4 crédits la minute, cela tourne en une nuit plutôt qu'en un semestre, et le retard d'accessibilité devient des sous-titres conformes WCAG sur chaque cours. Les formations phares vont un appel plus loin : `/translate` transforme les mêmes fichiers de sous-titres en sous-titres multilingues dans les langues que parlent réellement vos étudiants, avec le timing hérité de la source.


Transcrivez des vidéos YouTube et des archives de podcasts en un seul appel

Les équipes médias ont rarement des fichiers sources bien rangés pour leurs archives. Ce qu'elles ont, ce sont des liens. L'API accepte directement les URL YouTube et Vimeo, et « rendre les archives consultables » passe d'un projet de migration à un script d'après-midi : bouclez sur la chaîne, transcrivez chaque épisode avec les noms des locuteurs, publiez la transcription sous chaque page d'épisode.


Ce que cela apporte, concrètement : un fonds de 400 entretiens devient interrogeable en texte intégral pour la rédaction, citable pour des extraits réseaux sociaux, indexable par les moteurs de recherche — et accessible, ce que les plateformes et les dossiers de subvention demandent de plus en plus. Aucun réenvoi de fichiers, aucune facture de stockage, aucun stagiaire avec un casque.


Une API de transcription conforme au RGPD pour les équipes produit

Beaucoup de produits veulent un bouton « Générer les sous-titres » — plateformes vidéo, outils d'entretien, éditeurs de LMS, legal tech, logiciels RH. Ce n'est que rarement la technique qui bloque ; c'est l'évaluation du prestataire. Quelque part entre « envoie les enregistrements clients vers un cloud américain » et « peut utiliser les contenus pour entraîner des modèles », le juridique dit non.


L'API d'Inwista est la version de cette conversation qui se termine vite : une API de transcription conforme au RGPD dont le traitement s'effectue exclusivement sur nos propres serveurs en UE/EEE, sans que les contenus soient jamais partagés avec des tiers ni jamais utilisés pour l'entraînement — des phrases que vous pouvez inscrire telles quelles dans votre propre politique de confidentialité. La partie technique est elle aussi conçue pour la production : clés d'idempotence sur chaque écriture, limites de débit prévisibles, facturation atomique avec remboursements automatiques, et un champ `metadata` qui transporte vos propres identifiants de référence tout au long du flux, pour que les webhooks arrivent déjà étiquetés dans votre système.


Des sous-titres SME pour les séances publiques, l'après-midi même

Les collectivités et les organismes publics diffusent chaque semaine des heures de séances, et l'exigence d'accessibilité ne va que dans un sens. Un conseil municipal de trois heures sous-titré à la main, c'est une vraie facture ; via l'API, c'est 720 crédits, terminé l'après-midi même — transcrit avec les noms des locuteurs, formaté avec le préréglage SDH, publié à côté de l'enregistrement. Là où les habitants parlent plusieurs langues, les mêmes sous-titres se traduisent en un appel de plus.


Pour les marchés publics, les questions qui exigent d'ordinaire une réunion entière tiennent en une ligne : traitement en UE/EEE, RGPD, aucun entraînement sur les contenus, suppression sous votre contrôle.


Toutes les formules incluent des crédits API — même la gratuite

Comme l'API consomme vos crédits IA habituels, il n'y a rien à acheter en plus pour l'essayer. La formule gratuite inclut 100 crédits chaque mois — de quoi couvrir environ 25 minutes de transcription par API, renouvelés chaque mois, pour construire votre intégration et faire tourner un petit flux de travail sans rien payer. (Les 45 minutes de studio de la formule gratuite sont à part : utilisez-les pour examiner les transcriptions et les styles de sous-titres de vos propres yeux dans l'application, avant d'écrire une seule ligne de code.)


Les formules payantes incluent 1000 à 2500 crédits par mois, et les packs de crédits à achat unique — qui n'expirent jamais — couvrent tout le reste. Les traitements échoués se remboursent automatiquement, exactement là d'où venaient les crédits.


La référence complète — authentification, webhooks, formats, gestion des erreurs — se trouve dans notre Référence de l'API. Si vous construisez quelque chose de plus ambitieux, ou s'il vous faut des tarifs au volume pour un vrai fonds d'archives : sales@inwista.ai.


Questions fréquentes

Que peut accepter cette API de transcription ?

Des URL de médias publiques — fichiers audio ou vidéo, ou liens YouTube, TikTok et Vimeo directement. Plus de 70 langues, avec identification automatique des locuteurs (diarisation).


Que renvoie-t-elle ?

SRT, VTT, TXT ou JSON structuré — plus, sur demande, des versions formatées broadcast et traduites des mêmes sous-titres.


Puis-je contrôler le formatage des sous-titres ?

Oui — caractères par ligne, lignes par bloc, équilibrage des lignes, bornes de durée, condensation du texte, marquage des dialogues, marqueurs de continuité et préréglages broadcast, streaming ou SDH sont autant de réglages explicites de l'endpoint d'amélioration.


Puis-je essayer l'API gratuitement ?

Oui. L'API puise dans les mêmes crédits IA que le reste d'Inwista, et chaque formule inclut un volume mensuel — 100 crédits sur la formule gratuite, soit environ 25 minutes de transcription par mois.


L'API est-elle conforme au RGPD ?

Oui — tout le traitement s'exécute sur les propres serveurs d'Inwista, au sein de l'UE/EEE. Les contenus ne sont jamais partagés avec des tiers et jamais utilisés pour entraîner des modèles d'IA.


Combien ça coûte ?

4 crédits par minute entamée, prélevés d'abord sur les crédits IA mensuels de votre formule puis sur les packs à achat unique — qui n'expirent jamais. Les traitements échoués sont remboursés automatiquement.


Quelle est la vitesse de traitement ?

Environ dix minutes de traitement par heure d'audio.