Transcrire entretiens, réunions et cours — avec étiquettes de locuteurs
L'audio à plusieurs voix, c'est là que la transcription justifie son existence — et là où elle s'effondre le plus souvent. Un podcast, une table ronde, un entretien de recherche, une réunion de deux heures — transcrivez l'un d'eux sans marquer qui parle, et vous obtenez un mur de mots techniquement complet et pratiquement inutilisable. Était-ce l'objection du client ou le résumé qu'en fait le commercial ? Le récit du témoin ou la reformulation de l'avocat ? La transcription le sait ; elle refuse simplement de vous le dire.
L'identification des locuteurs règle cela à la source. Inwista sépare les voix pendant la transcription, et vous y attachez de vrais noms une seule fois dans l'éditeur. Le résultat se lit comme la conversation s'est réellement déroulée : sous forme de dialogue étiqueté.
Voici le flux de travail complet, les situations où il change la donne, et les habitudes pratiques qui rendent les étiquettes exactes.
Comment ça marche, de bout en bout
1. Activez-le au téléversement
Démarrez un + Nouveau projet et, dans les réglages de téléversement, activez la diarisation des locuteurs. Vous pouvez préciser combien de locuteurs contient l'enregistrement — ou, notre recommandation constante, laissez Inwista détecter le nombre automatiquement.
2. La transcription sépare les voix
Inwista transcrit et découpe la conversation en interventions — chaque ligne attribuée à Locuteur 1, Locuteur 2, et ainsi de suite. Et vite : comptez sur un traitement d'environ un cinquième de la durée de l'enregistrement.
3. Nommez-les dans l'éditeur
Ouvrez le fichier dans l'éditeur, là où vivent les outils de locuteurs :
- Le menu des locuteurs — voir, ajouter, renommer ou supprimer des locuteurs. Tapez « Locuteur 1 → Anna Berg » une fois et l'étiquette se met à jour dans toute la transcription.
- Réattribution ligne par ligne — là où deux voix se chevauchent ou où la détection s'est trompée, attribuez le bon locuteur à cette ligne précise.
- Renommage en masse — changez tous les noms de locuteurs en une seule opération quand un ajustement global s'impose.
4. Exportez — avec une case qui compte
Téléchargez en TXT, DOCX ou PDF — et dans la fenêtre de téléchargement, cochez « Inclure les locuteurs ». C'est cette case qui emporte les étiquettes dans le fichier final ; c'est ce qu'on oublie le plus souvent dans ce flux de travail, alors considérez ce paragraphe comme votre ticket de support préventif.
Là où les transcriptions étiquetées changent le travail
Les podcasts. Une transcription avec étiquettes de locuteurs est la version lisible et publiable de l'épisode — et la colonne vertébrale d'une version accessible. Elle s'insère directement dans le format de transcription conforme aux WCAG, où « montre clairement qui dit quoi » est l'exigence numéro deux.
Les entretiens de recherche et les groupes de discussion. L'analyse vit et meurt par l'attribution — coder un groupe de discussion où l'on ne distingue pas les participants n'est pas de l'analyse, c'est de l'archéologie. Des interventions étiquetées rendent les citations citables et les motifs traçables jusqu'aux individus. Associez cela à une température basse pour la fidélité verbatim qu'exige le travail qualitatif.
Les réunions. La transcription est le compte rendu — qui a soulevé le risque, qui s'est engagé sur l'échéance, qui a exprimé un désaccord — sans que personne dans la pièce ne brûle son attention à prendre des notes. Nommez les participants une fois et exportez ; l'e-mail de suivi s'écrit tout seul à partir du relevé.
Les cours et l'enseignement. Les cours magistraux se transcrivent proprement de toute façon, mais dès que les questions commencent, la diarisation gagne sa place : questions des étudiants et réponses de l'enseignant restent distinctes, ce qui est exactement ce dont a besoin quelqu'un qui révise à partir de la transcription. Et une version texte de chaque cours est une victoire d'accessibilité avant d'être quoi que ce soit d'autre.
Les relevés juridiques et formels. Là où la documentation doit montrer précisément qui a dit quoi, l'attribution n'est pas un confort — c'est l'objet même. Bon à savoir au passage : les enregistrements sont traités sur des serveurs européens avec chiffrement AES-256 dans toutes les formules, et un accord de sous-traitance est disponible en Enterprise pour les organisations qui ont besoin de la paperasse.
Obtenir des étiquettes exactes : deux habitudes
Donnez-lui de l'audio séparable. La diarisation distingue les voix ; un fort chevauchement — tout le monde parlant en même temps — est difficile pour les humains comme pour les machines. Un placement de micro raisonnable et une animation qui laisse les gens finir font plus pour l'exactitude des étiquettes que n'importe quel réglage.
Nommez les locuteurs tôt, pas tard. Attachez les vrais noms comme tout premier geste d'édition. Chaque relecture suivante devient plus facile, et les lignes mal attribuées sautent aux yeux d'une manière que les erreurs de « Locuteur 3 » n'atteignent jamais.
De l'enregistrement au relevé, en quelques minutes
Entretiens, réunions, cours — téléversez, activez la diarisation, nommez les locuteurs, exportez avec les étiquettes. La formule gratuite d'Inwista vous permet de dérouler tout le flux de travail sur votre propre matériel — téléverser, transcrire, structurer, monter et exporter. Les limites actuelles et le détail des formules sont sur la page des tarifs.
Transcrivez votre prochaine conversation →
Questions fréquentes
Combien de locuteurs peut-il gérer ? Vous pouvez fixer le nombre attendu au téléversement ou laisser Inwista le détecter automatiquement — l'option que nous recommandons. L'exactitude est meilleure quand les voix alternent ; un chevauchement prolongé dégrade toute diarisation, la nôtre comprise, d'où l'importance des habitudes de micro et d'animation évoquées plus haut.
Inwista connaît-il les noms des locuteurs ? Non — et c'est voulu. La diarisation sépare des voix ; l'identité, c'est à vous de l'attacher. Renommez chaque locuteur détecté une fois dans l'éditeur et l'étiquette s'applique à toute la transcription.
Une ligne a été attribuée à la mauvaise personne — puis-je corriger uniquement cette ligne ? Oui. L'attribution de locuteur ligne par ligne existe exactement pour cela : corrigez la ligne concernée sans toucher au reste.
Ma transcription exportée ne contient aucun nom. Que s'est-il passé ? La case « Inclure les locuteurs » de la fenêtre de téléchargement n'était presque certainement pas cochée. Réexportez en la cochant — les étiquettes sont dans le projet ; c'est la case qui décide si elles voyagent jusqu'au fichier.
Est-ce que cela fonctionne aussi sur des fichiers vidéo ? À l'identique. La diarisation travaille sur la piste audio : une table ronde filmée ou l'enregistrement d'une visioconférence se comporte exactement comme un fichier audio.
Nous enregistrons des conversations sensibles — dossiers RH, rendez-vous clients. Où vont les données ? Traitement et stockage sur des serveurs européens avec chiffrement AES-256, dans toutes les formules y compris la gratuite. Vous contrôlez la suppression, et les clients Enterprise peuvent mettre en place un accord de sous-traitance.