Aller au contenu principal

Comment transcrire un enregistrement long (plus de 2 heures)

Auteur : Publié le : Dernière révision :

Un enregistrement long rend visible chaque limite : durée maximale, préparation du navigateur, fiabilité du téléchargement, solde des minutes et protection de la file d’attente. Si vous avez un entretien de trois heures, un atelier d’une demi-journée ou une réunion du conseil d’administration à transformer en texte, vérifiez ces limites avant le téléchargement plutôt qu’après un échec.

Hushscript prend des téléchargements jusqu’à 10 heures chacun, sans limite de taille de fichier: les fichiers volumineux sont préparés directement dans votre navigateur. Il n’y a pas d’indemnité journalière basée sur un plan ; un plafond de sécurité élevé de 40 heures glissantes et 24 heures sur 24 et des garanties de travail actif protègent le service. Un long fichier n’est pas un cas spécial ici ; c’est le même flux de travail qu’un clip de deux minutes, il suffit de le laisser se terminer tout seul.

Ce dont vous avez besoin avant de commencer

Vous avez besoin de trois choses, et vous avez probablement déjà les trois.

Un petit mot sur les minutes gratuites, car les longs enregistrements les brûlent rapidement : vous obtenez 30 minutes gratuites une fois. Le moyen le plus rapide de les débloquer est d’ajouter une carte (une retenue de 1 $ la valide et est immédiatement libérée, jamais facturée), et les minutes atterrissent immédiatement. Si vous préférez utiliser un autre mode de paiement disponible dans votre pays, les 30 minutes arrivent avec votre premier achat. Une carte n’est pas requise ; c’est juste l’itinéraire le plus rapide. Trente minutes suffisent pour transcrire un court segment et juger de l’exactitude avant de publier un pack complet dans un fichier de trois heures.

Ce qu’il faut vérifier avant un long téléchargement

Quatre vérifications évitent la plupart des surprises :

Confirmez ces limites avant de télécharger. Hushscript les indique ici afin qu’un long travail puisse être planifié à partir de la durée source plutôt que découvert par essais et erreurs.

Transcrivez un long enregistrement, étape par étape

Il n’y a pas de mode d’enregistrement long à activer. Le processus est identique à un court clip ; il s’exécute simplement plus longtemps en arrière-plan.

  1. Ouvrez le convertisseur et déposez votre fichier. Accédez à audio en texte et faites glisser l’enregistrement sur la zone de téléchargement, ou cliquez pour parcourir. Tout format audio ou vidéo courant est accepté. S’il s’agit d’une vidéo, l’audio est extrait dans votre navigateur à ce stade, de sorte que le fichier vidéo volumineux ne quitte jamais votre ordinateur.
  2. Vérifiez l’aperçu de 30 secondes. Avant de vous inscrire, Hushscript prépare un court clip dans votre navigateur, envoie ce clip pour transcription et vous montre la sortie étiquetée par le locuteur. L’enregistrement complet reste local à ce stade. Lisez l’aperçu, confirmez que les intervenants sont répartis judicieusement et que les mots sont corrects, et vous saurez si l’audio est suffisamment propre pour l’intégralité de la diffusion.
  3. Connectez-vous pour transcrire le reste. Si l’aperçu semble correct, inscrivez-vous et le fichier complet est téléchargé. C’est là que votre solde de minutes compte : un fichier de 150 minutes prend 150 minutes. Assurez-vous que le pack dont vous disposez couvre toute la durée.
  4. Laissez le travail se terminer tout seul. Le temps de traitement varie en fonction de la longueur du fichier et de la charge du service, mais le travail s’exécute sans surveillance. Vous n’êtes pas obligé de garder l’onglet au point ; revenez quand c’est fait.
  5. Ré-étiquetez les locuteurs. La transcription arrive avec des étiquettes génériques comme Locuteur A et Locuteur B. Dans l’éditeur, renommez Locuteur A en un vrai nom une fois et il sera mis à jour partout dans le document, ainsi une interview de trois heures se lit avec les bons noms tout au long.
  6. Exportez dans le format dont vous avez besoin. Téléchargez dans l’un des 21 formats (TXT, SRT, DOCX, PDF et formats de sous-titres et de chronologie de l’éditeur parmi eux) plus une archive .husharchive protégée par mot de passe, avec aucun filigrane sur aucun d’entre eux. SRT est celui qu’il faut utiliser pour les fichiers longs, car ses horodatages vous permettent d’accéder directement à n’importe quel moment au lieu de faire défiler.

Le résultat se trouve dans votre tableau de bord avec les étiquettes de locuteur, les horodatages et le menu d’exportation complet, et il reste là pour que vous puissiez y revenir.

Un exemple concret : une interview enregistrée de 2,5 heures

Voici à quoi cela ressemble avec une forme réelle de fichier. Supposons que vous ayez enregistré une interview de 2 heures 30 minutes au format MP3 unique : deux personnes, une silencieuse, une forte, enregistrées lors d’un appel vidéo.

Vous déposez le MP3 dans la zone de téléchargement. L’aperçu de 30 secondes montre deux locuteurs déjà séparés dans l’échantillon d’ouverture. Vous vous connectez ; le fichier de 150 minutes est téléchargé et le travail démarre. Une fois terminé, le résultat est un document continu avec des horodatages ininterrompus de 00:00:00 à 02:30:00.

Le résultat brut se lit comme ceci :

[00:00:04] Locuteur A : Merci d'avoir pris le temps. Pouvons-nous commencer par comment le projet a commencé ?
[00:00:11] Locuteur B : Bien sûr. Cela a donc vraiment commencé début 2023, lorsque...

Vous renommez Locuteur A en intervieweur et Locuteur B en sujet une fois, et chaque ligne est mise à jour. Ensuite, vous exportez deux fois : un TXT à coller dans un résumé pour un premier résumé, et un SRT pour que lorsque vous rédigez une citation directe, vous puissiez cliquer sur l’horodatage et entendre exactement comment cela a été dit. Coût total : 150 minutes de réduction sur votre solde, un téléchargement, pas de fractionnement, pas de troncature, pas de seconde tentative.

Gardez les intervenants étiquetés tout au long d’une longue session

La diarisation sur un enregistrement de 3 heures est véritablement plus difficile que sur un clip de 10 minutes : les voix dérivent, les pauses s’allongent et le bruit de fond va et vient. Hushscript exécute l’étiquetage sur l’intégralité de la transcription en même temps, afin que les étiquettes restent cohérentes de bout en bout, mais l’enregistrement lui-même peut aider ou nuire à cela.

Au moment de l’enregistrement :

Qualité audio :

Une fois la transcription de retour, renommer Locuteur A avec un vrai nom est une modification unique qui se propage à travers tout le document. Pour en savoir plus sur le fonctionnement de l’étiquetage lui-même, consultez identification du locuteur.

Diviser le fichier ou le télécharger en entier ?

La réponse courte pour presque tout le monde : le télécharger en entier. Diviser un long enregistrement en parties est la chose à éviter, pas la chose à faire, et il n’y a que deux situations dans lesquelles c’est nécessaire.

Téléchargez en un seul fichier lorsque l’enregistrement dure 10 heures ou moins, ce qui couvre l’écrasante majorité des entretiens, conférences, réunions et panels - il n’y a pas de plafond de taille de fichier à contourner. Un fichier signifie un ensemble continu d’horodatages et un ensemble cohérent d’étiquettes de locuteur. Le fractionnement brise les deux : chaque partie redémarre son horloge à zéro, et la même personne peut obtenir une étiquette différente dans la deuxième partie que dans la première, vous laissant ainsi assembler et remapper à la main.

Les systèmes vocaux peuvent toujours diviser les longs audios en interne. Une récente recherche IWSLT 2026 sur le traitement de la parole longue a comparé plusieurs stratégies de segmentation et a révélé que le choix affectait la robustesse. Il s’agit d’un problème au niveau du moteur, et non d’une raison pour couper votre source à la main : conserver un téléchargement préserve une transcription continue destinée à l’utilisateur tandis que le pipeline de traitement gère ses propres limites internes.

Diviser uniquement lorsque l’enregistrement dure réellement plus de 10 heures, comme un enregistrement de conférence sur plusieurs jours. Dans ce cas, coupez un silence naturel (une pause de session) plutôt qu’un milieu de phrase et notez le décalage afin de pouvoir renuméroter les horodatages par la suite. Si vous coupez un MP3 avant de le télécharger, préférez le débit binaire constant (CBR) au débit binaire variable (VBR), car VBR peut introduire une dérive de synchronisation dans certains éditeurs.

Un fichier vidéo de plusieurs gigaoctets n’est pas un problème. Étant donné que Hushscript extrait l’audio dans votre navigateur avant de le télécharger, la taille de la vidéo source n’est pas celle du téléchargement, et il n’y a pas de limite à la taille de ce fichier source : seul le flux audio beaucoup plus petit circule, tant que votre navigateur et votre appareil peuvent gérer sa préparation.

Meilleurs paramètres de précision sur les fichiers audio longs

Le principal facteur de précision est la clarté de la parole, et non la fréquence d’échantillonnage ou le format de fichier. Pour les longues sessions en particulier :

Dépannage des problèmes courants liés aux fichiers longs

La précision diminue dans la moitié arrière de l’enregistrement. Il s’agit presque toujours d’une baisse des niveaux audio ou d’une augmentation du bruit de la pièce à la fin d’une longue session, et non d’une limite de durée. Vérifiez l’enregistrement original autour des horodatages où les erreurs se regroupent ; si le niveau baisse, normalisez et réexécutez, et utilisez l’aperçu de 30 secondes sur un segment plus tard pour confirmer avant de passer à nouveau les minutes.

Deux personnes continuent de fusionner en un seul locuteur. Le chevauchement des paroles et la diaphonie en sont la cause habituelle. Il n’y a pas de solution parfaite après coup, mais un enregistrement avec plus de séparation entre les voix (une piste par canal ou des micros plus éloignés) donne une diarisation beaucoup plus propre la prochaine fois. Dans la transcription que vous avez maintenant, vous pouvez corriger manuellement les erreurs d’étiquetage occasionnelles dans l’éditeur.

Un fichier volumineux est lent à télécharger. La vitesse de téléchargement dépend de votre connexion, pas de l’outil. Pour une vidéo de plusieurs Go, n’oubliez pas que l’audio est d’abord extrait localement, de sorte que le téléchargement réel est beaucoup plus petit que le fichier sur le disque. Si vous utilisez une connexion faible, une liaison filaire ou si vous la laissez simplement fonctionner, vous y arriverez.

Bruit de fond tout au long de l’enregistrement. Un bruit constant (climatisation, trafic, bourdonnement de la pièce) diminue la précision sur l’ensemble du fichier. La normalisation du volume léger est généralement plus utile que le débruitage, qui a tendance à endommager la parole. Si un segment est gravement affecté, les horodatages vous permettent toujours de le retrouver et de le réécouter.

La transcription semble s’être terminée plus tôt. Sur Hushscript, une transcription couvre l’intégralité du fichier ; il n’y a pas de troncature silencieuse. Si le texte semble court, vérifiez l’horodatage final par rapport à la durée réelle de l’enregistrement. De longues périodes de silence ou de musique produisent simplement quelques mots, qui peuvent être considérés comme « manquants », mais ne le sont pas.

Exporter une longue transcription : quel format

Pour une session de plusieurs heures, le format que vous choisissez modifie l’utilisabilité de la transcription.

Chaque exportation est incluse dans chaque forfait, sans filigrane ni frais distincts pour débloquer les sous-titres.


Pour les enregistrements longs facturés à la minute, la transcription à l’utilisation évite un forfait mensuel récurrent. Vous payez pour les heures que vous transcrivez, avec un plafond de sécurité mobile élevé et des contrôles de travail actif pour les lots inhabituellement lourds. Les deux tâches d’enregistrement long les plus courantes ont leurs propres procédures pas à pas : comment transcrire un podcast couvre les épisodes multi-invités et les notes d’épisode, et comment transcrire une conférence couvre les bizarreries audio de la classe comme la réverbération et les questions du public à travers une salle. Et si votre matériel est une pile de fichiers séparés plutôt qu’un long enregistrement, la transcription d’un dossier d’enregistrements consiste à les parcourir par lots.

Sources et normes indépendantes

Hushscript a consulté ces références indépendantes et non concurrentes. Elles présentent des recherches, des normes ou le fonctionnement de plateformes et ne constituent pas une recommandation de Hushscript.

Sources vérifiées le :

Questions fréquentes

Y a-t-il une limite de taille de fichier pour les enregistrements longs ?

Non. Les enregistrements peuvent durer jusqu'à 10 heures, sans limite de taille de fichier : les fichiers volumineux sont préparés directement dans votre navigateur. Il n'y a pas d'indemnité quotidienne ou mensuelle basée sur un plan, mais un plafond de sécurité élevé de 40 heures glissantes sur 24 heures et des garanties d'emploi actif s'appliquent.

Dois-je diviser un long enregistrement en plusieurs parties ?

Non. Un fichier de 3 ou 8 heures est envoyé en un seul téléchargement et revient sous la forme d'une seule transcription avec des horodatages continus. Vous n'avez besoin de diviser que si l'enregistrement lui-même dure plus de 10 heures.

Les étiquettes des locuteurs resteront-elles cohérentes tout au long d'un enregistrement de 3 heures ?

Oui. La diarisation des locuteurs s'étend sur l'ensemble de la transcription en même temps, et non morceau par morceau, de sorte que chaque personne conserve la même étiquette de la première minute à la dernière.

Puis-je télécharger un long fichier vidéo au lieu d'un fichier audio ?

Oui. L'audio est extrait de la vidéo dans votre navigateur avant que quoi que ce soit ne soit envoyé, de sorte que seul l'audio atteint le serveur. La vidéo originale n'est jamais téléchargée, ce qui transforme généralement une capture de conférence de plusieurs gigaoctets en un téléchargement audio beaucoup plus petit.

Combien de temps faut-il pour transcrire un fichier long ?

Le temps de traitement varie en fonction de la durée d'enregistrement et de la charge du service. Les tâches longues s'exécutent sans surveillance, vous pouvez donc quitter la page et revenir une fois la transcription terminée.

Quels formats d'exportation fonctionnent le mieux pour une longue transcription ?

TXT pour alimenter d'autres outils, SRT pour accéder à un horodatage, DOCX pour le partage et l'annotation, et JSON pour les données brutes de locuteur et de synchronisation. Tous les formats d'exportation sont inclus sans filigrane.

Mes minutes expirent-elles si je ne transcris qu'occasionnellement ?

Les minutes expirent après 180 jours sans transcription terminée ni achat de minute. Quelle que soit l'activité, la fenêtre est réinitialisée et nous vous envoyons un e-mail avant l'expiration.

Commencer avec 30 minutes gratuites

Commencer – 30 minutes gratuites