« Traduire l’audio en texte » : qu’est-ce que c’est ?
Auteur : Hushscript Publié le : Dernière révision :
“Traduire l’audio en texte” est une expression de recherche couvrant deux tâches différentes. La plupart des gens qui le tapent ont un son dans une langue qu’ils comprennent et souhaitent que ce discours soit écrit. Un groupe plus petit dispose d’un audio dans une langue qu’il ne parle pas et souhaite obtenir le sens dans une langue différente. Le premier travail est la transcription. La seconde ajoute la traduction en haut. Savoir de quel outil vous avez réellement besoin évite bien des confusions, car les outils et les étapes ne sont pas les mêmes.
Ce guide distingue les deux, montre comment transcrire de l’audio qui se trouve dans une autre langue et explique quoi faire lorsque vous avez réellement besoin d’une traduction. Hushscript peut renvoyer une transcription dans la même langue ou transcrire l’audio source et ajouter des traductions sélectionnées dans la langue cible lorsque vous choisissez ces cibles avant le téléchargement. La traduction fait partie des options de téléchargement, et non un changement post-hoc dans la vue de transcription.
Transcription versus traduction
La transcription convertit la parole en texte dans la même langue. Vous disposez d’un enregistrement d’entretien en anglais et vous obtenez un document texte en anglais. Vous avez un podcast en français et vous obtenez une transcription en français. Les mots sur la page sont les mots qui ont été prononcés. Rien ne change la langue.
La traduction convertit le texte d’une langue à une autre. Le texte français devient le texte anglais. Il fonctionne à partir de texte, pas de son, et doit connaître à la fois la langue source et la langue cible. La Commission européenne distingue la traduction de l’interprétation en langue parlée ; la même distinction permet d’expliquer pourquoi « traduire de l’audio en texte » peut cacher deux tâches distinctes.
Alors pourquoi tant de gens disent « traduire » alors qu’ils veulent dire transcrire. Le mot est utilisé de manière vague, de la même manière que quelqu’un dit qu’il doit « traduire » un PDF en fichier Word alors qu’il entend simplement convertir le format. Passer de l’audio au texte, c’est comme traduire entre deux types de médias, même si aucune langue n’a changé. Cette utilisation informelle est la raison pour laquelle cette expression de recherche est si courante, et c’est pourquoi la plupart des personnes qui la saisissent recherchent un outil de transcription.
Un moyen rapide de savoir de quel travail vous avez besoin : pouvez-vous comprendre l’enregistrement. Si vous le pouvez et que vous voulez seulement que ce soit écrit, c’est une transcription. Si vous ne pouvez pas le comprendre et que vous voulez la signification dans votre propre langue, c’est une transcription suivie d’une traduction.
L’audio dans la même langue est une transcription
Si vous avez un enregistrement en anglais et que vous le souhaitez sous forme de texte, c’est une transcription. Si vous avez un enregistrement en espagnol et que vous souhaitez une transcription en espagnol, c’est aussi une transcription. Vous ne changez pas la langue. Vous modifiez le format, du son en mots sur une page.
C’est l’intention la plus courante derrière la recherche, et c’est exactement pour cela que Hushscript est conçu. Voici comment cela fonctionne, du début à la fin.
- Déposez votre fichier sur /audio-to-text. Un aperçu de 30 secondes, étiqueté par le locuteur, s’affiche directement dans le navigateur, sans avoir besoin de compte, afin que vous puissiez voir la qualité avant de vous engager dans quoi que ce soit.
- Inscrivez-vous avec votre adresse e-mail pour transcrire le reste. Les 30 premières minutes sont gratuites, accordées une fois. L’ajout d’une carte est le moyen le plus rapide : une retenue d’un dollar confirme la carte, puis s’efface immédiatement et n’est jamais facturée. Si vous préférez utiliser un autre mode de paiement disponible dans votre pays, les minutes gratuites arriveront avec votre premier achat. Dans tous les cas, aucune carte n’est requise.
- Téléchargez le fichier complet. S’il s’agit d’une vidéo, l’audio est d’abord extrait dans votre navigateur, de sorte que la vidéo elle-même reste sur votre appareil et que seul l’audio atteint le serveur.
- Choisissez les options de transcription. Laissez la langue source en détection automatique ou choisissez-la vous-même, puis sélectionnez les traductions dans la langue cible avant de les télécharger si vous en avez besoin.
- Lisez, réétiquetez et exportez. Renommez « Locuteur A » en un vrai nom, puis téléchargez la transcription dans l’un des 21 formats d’exportation (TXT, SRT, VTT, DOCX, PDF, etc.) ou sous forme d’archive .husharchive protégée par mot de passe. Les transcriptions traduites apparaissent sous forme d’onglets de langue et peuvent être exportées par langue.
Les étiquettes des locuteurs et les horodatages reviennent automatiquement, quelle que soit la langue. Si vous ne choisissez pas les cibles de traduction avant le téléchargement, la transcription que vous obtenez est dans la même langue que l’audio, car c’est ce que fait la transcription.
Un exemple concret
Disons que vous enregistrez un entretien de 40 minutes avec un collègue qui parle portugais et que vous comprenez tous les deux le portugais. Vous souhaitez qu’un enregistrement écrit soit cité plus tard.
Vous déposez le fichier dans /audio-to-text et l’aperçu montre la première demi-minute, déjà divisée en Locuteur A et Locuteur B. Les accents et le portugais ressortent clairement, vous vous inscrivez donc et téléchargez l’intégralité de l’enregistrement. Une fois le travail terminé, vous disposez d’une transcription en portugais, séparée par locuteur, qui se lit comme ceci :
Locuteur A [00:02] : Então, conta-me como começou o projeto. Locuteur B [00:05] : Começou quase por acaso, no ano passado.
Vous renommez les locuteurs avec leurs noms réels, exportez vers DOCX ou un autre format, et vous avez terminé. Aucune langue n’a été modifiée à aucun moment. Il s’agit d’un pur travail de transcription, et c’est le cas que l’expression « traduire l’audio en texte » décrit la plupart du temps.
Modifiez maintenant un détail. Supposons que vous ne parlez pas portugais et que vous ayez besoin de l’entretien en anglais. Avant de démarrer le téléchargement complet, vous choisissez l’anglais comme cible de traduction. Une fois le travail terminé, la transcription source en portugais et la transcription traduite en anglais apparaissent sous forme d’onglets de langue distincts et vous pouvez exporter l’une ou l’autre.
Lorsque vous avez réellement besoin d’une traduction
Si vous avez un audio dans une langue que vous ne parlez pas, un entretien en français, une conférence en allemand ou un enregistrement en espagnol, et que vous souhaitez que le contenu soit en anglais, la même distinction est toujours importante : l’audio doit d’abord être transcrit, puis le texte peut être traduit.
Dans Hushscript, vous choisissez ceci avant le début du téléchargement complet. Laissez la langue source en détection automatique ou choisissez-la vous-même, puis ajoutez les langues cibles souhaitées. L’application affiche les minutes facturées estimées avant le téléchargement, car les objectifs de traduction ajoutent des minutes facturées. Si vous ignorez les langues cibles, la tâche renvoie uniquement la transcription dans la même langue.
Une fois la tâche terminée, vous obtenez la transcription source ainsi que les transcriptions traduites sous forme d’onglets de langue. Ouvrez l’onglet dont vous avez besoin et exportez cette langue dans l’un des 21 formats dont vous avez besoin, TXT, SRT et DOCX inclus, ou sous forme d’archive .husharchive protégée par mot de passe. Pour tout ce qui a une portée juridique, médicale, journalistique ou de publication, demandez à un traducteur humain de réviser la transcription traduite avant de vous y fier.
Une remarque pratique sur les exportations : choisissez le format qui correspond à l’étape suivante. TXT est propre pour la révision de texte brut, DOCX ou PDF sont plus faciles à partager avec d’autres personnes, SRT ou VTT sont destinés aux sous-titres, CSV et JSON sont utiles pour les flux de travail structurés et Markdown est pratique pour les notes ou la publication de brouillons. Les étiquettes des locuteurs dans la transcription indiquent aux évaluateurs qui parle, ce qui élimine une source courante de conjectures lors des entretiens.
Pour être clair sur la limite : la transcription et la traduction sont toujours des tâches différentes, même lorsqu’un téléchargement peut demander les deux. Hushscript a d’abord besoin d’une transcription source, puis il peut fournir la transcription dans la langue cible que vous avez sélectionnée avant le téléchargement. Cette séparation est utile, car elle vous indique ce qu’il faut vérifier si quelque chose ne va pas : la transcription source, l’onglet traduit, ou les deux.
Si votre langue source ne correspond pas aux 99 environ prises en charge par Hushscript, vous aurez besoin d’un outil de transcription différent pour la première étape, puis traduirez à partir de là.
Pourquoi la distinction est importante
Traiter la transcription et traduction car la même chose provoque quelques erreurs prévisibles.
Téléchargez l’audio espagnol sans sélectionner de langue cible et vous obtiendrez du texte espagnol, car c’est ce que produit la transcription. Sélectionnez l’anglais avant le téléchargement et Hushscript peut ajouter une transcription traduite en anglais à côté de la transcription source en espagnol. Quoi qu’il en soit, la qualité de l’anglais final dépend de deux éléments combinés : la précision avec laquelle l’espagnol a été transcrit et la précision avec laquelle il a été traduit. Une erreur dans la première étape peut toujours devenir une erreur dans la seconde.
C’est pourquoi la distinction est importante. Avec les onglets source et traduits visibles, vous pouvez vérifier si un problème provient de la transcription ou du changement de langue. Un flux de travail qui masque les deux étapes rend les choses plus difficiles.
Pour un résumé rapide, un court e-mail informel ou une idée approximative de ce qui a été dit, la traduction automatique peut suffire. Pour les procédures judiciaires, le journalisme, la documentation formelle ou tout ce qui concerne un mot erroné, examinez la transcription source et demandez à un traducteur humain de vérifier le texte final.
Conseils sur la précision et la qualité
Un enregistrement propre transcrit mieux dans n’importe quelle langue, et cela compte plus que la langue elle-même. Gardez le microphone près de la personne qui parle, enregistrez dans un endroit calme et demandez aux gens de ne pas se parler. La distance du micro et le bruit de fond affectent le résultat bien plus que la langue parmi les quelque 99 langues dans lesquelles vous travaillez.
Les enregistrements dans une seule langue sont les plus faciles. Si un locuteur bascule entre deux langues au milieu d’une phrase, cela est plus difficile à suivre pour n’importe quel moteur, et la transcription peut glisser entre elles. Lorsque vous le pouvez, conservez un enregistrement dans une seule langue. Si une conversation est réellement bilingue, attendez-vous à lire et à corriger quelques passages à la main avant de traduire.
Les noms propres valent la peine d’être examinés à nouveau. Les noms de personnes, de lieux et d’entreprises sont les endroits où les transcriptions se trompent le plus souvent, et une petite erreur peut gâcher une traduction ultérieure. Parcourez la transcription et corrigez-la pendant que l’audio est encore frais dans votre esprit, avant que le texte ne passe à l’étape de traduction.
Si vous choisissez des traductions dans la langue cible avant le téléchargement, l’exactitude de la transcription source fixe le plafond pour tout ce qui se passe en aval. Le temps passé à obtenir un enregistrement propre et à vérifier la transcription est doublement rentable, car toute transcription traduite ne peut être aussi bonne que le texte source qui la sous-tend.
Choisir votre chemin
Utilisez ceci pour décider rapidement. Si vous comprenez l’audio et souhaitez qu’il soit écrit, transcrivez-le et arrêtez-vous là ; vous avez terminé. Si vous ne comprenez pas l’audio et souhaitez en comprendre la signification dans votre langue, choisissez les cibles de traduction avant le téléchargement, puis examinez les onglets source et traduits une fois le travail terminé. Si vous avez besoin d’une synthèse rapide et que la précision n’est pas essentielle, la traduction automatique peut suffire. Si l’exactitude est essentielle, vérifiez la transcription et demandez à un humain d’examiner le texte traduit.
Dans chacun de ces chemins, l’étape de transcription est la base, et c’est la partie par laquelle Hushscript commence : une transcription source avec des locuteurs séparés, dans environ 99 langues, détectée automatiquement ou choisie avant le téléchargement.
Si votre cas est le cas le plus courant, l’audio que vous comprenez que vous voulez simplement écrire, alors /audio-to-text est l’outil. Déposez le fichier, prévisualisez les 30 premières secondes, inscrivez-vous et exportez la transcription. Pour une étape par étape couvrant chaque type de fichier, consultez comment transcrire n’importe quel fichier audio. Et si vous voulez comprendre la technologie qui transforme la parole en texte, parole en texte : comment ça marche l’explique clairement.
Sources et normes indépendantes
Hushscript a consulté ces références indépendantes et non concurrentes. Elles présentent des recherches, des normes ou le fonctionnement de plateformes et ne constituent pas une recommandation de Hushscript.
Sources vérifiées le :