Aller au contenu principal

Est-il sûr d’envoyer un fichier audio pour transcription ?

Auteur : Publié le : Dernière révision :

Le téléchargement d’audio pour la transcription peut être raisonnable lorsque l’outil, l’enregistrement et les règles applicables correspondent. La transcription elle-même ne représente qu’une partie du risque. Ce qui compte, c’est ce qui se passe une fois que le fichier quitte votre appareil : où il est stocké, combien de temps il y reste, qui d’autre le traite et s’il peut être utilisé pour la formation de modèles. Les politiques varient considérablement, donc la question de sécurité est en réalité une question sur le service spécifique auquel vous êtes sur le point de faire confiance.

Cet article explique ce qui arrive réellement à un fichier que vous téléchargez, les quatre questions qui méritent d’être posées à tout outil de transcription, comment Hushscript maintient l’exposition faible et les signaux d’alarme qui devraient vous faire fermer l’onglet. C’est un explicatif, pas un argumentaire de vente. Les questions s’appliquent à tous les outils, y compris ceux qui ne sont pas nous.

Qu’arrive-t-il réellement à votre audio

Lorsque vous téléchargez un fichier, il ne va pas à un endroit et revient directement. Il passe par plusieurs systèmes, et la question de la confidentialité est de savoir ce que chacun en fait.

Stockage. Un service de téléchargement peut écrire votre fichier sur le stockage d’objets cloud avant que le moteur vocal ne le voie. Ce stockage a une politique de rétention, que la page marketing l’indique clairement ou non. Les principes RGPD de la Commission européenne stipulent que les données personnelles doivent être stockées le plus rapidement possible et examinées par rapport aux limites d’effacement définies. Demandez la fenêtre de rétention réelle plutôt que de la déduire d’une liste de fonctionnalités.

Traitement. L’audio peut passer par un ou plusieurs systèmes exécutant la reconnaissance vocale, la séparation des locuteurs et le nettoyage. Un service peut utiliser son propre moteur ou son propre processeur. Vérifiez donc les sous-traitants nommés et leurs conditions de conservation au lieu de supposer que l’entreprise indiquée sur la page de téléchargement est la seule partie impliquée.

Données d’entraînement. Les modèles vocaux s’améliorent grâce à l’entraînement sur de l’audio réel, et les enregistrements réels des clients constituent un carburant d’entraînement précieux. Certains services se réservent le droit d’utiliser vos téléchargements pour « l’amélioration du produit » selon leurs conditions. Il s’agit rarement d’une case d’inscription claire au moment du téléchargement. Il est généralement enfoui dans les conditions de service, ou activé par défaut avec une option de désinscription que vous devez rechercher.

Journaux. Même les outils qui suppriment l’audio conservent souvent des métadonnées : lorsque vous avez téléchargé, combien de temps durait le fichier, quelle langue a été détectée, combien de locuteurs. Ces métadonnées présentent bien moins de risques que l’audio lui-même, mais il convient de savoir qu’elles survivent généralement à l’enregistrement.

Ce qu’il faut retenir, ce n’est pas que tout cela soit sinistre. C’est que « télécharger de l’audio, récupérer le texte » cache quatre ou cinq décisions distinctes, et un outil qui prend soin de chacune d’elles semble très différent d’un autre qui ne le fait pas.

Les quatre questions à poser à tout outil de transcription

Vous n’avez pas besoin de lire l’intégralité du blog d’ingénierie d’une entreprise pour juger un outil. Quatre questions couvrent la plupart des risques, et un service qui a réfléchi à ses pratiques en matière de données peut répondre clairement à toutes les quatre.

Quand l’audio est-il supprimé ?

La réponse que vous souhaitez est “immédiatement après que la transcription soit prête”, et non “dans les 30, 60 ou 90 jours” et non “lorsque vous supprimez votre compte”. Une suppression qui nécessite une action de votre part signifie que l’audio persiste par défaut, et les valeurs par défaut sont ce qui se produit réellement. Une fenêtre de conservation fixe de plusieurs semaines ou mois signifie qu’une copie de votre enregistrement reste sur un serveur pendant toute cette période, accessible à toute personne pouvant accéder au compartiment.

Le moteur vocal conserve-t-il une copie ?

Si le service utilise une API vocale tierce, votre audio passe également par ce fournisseur. “Nous ne stockons pas votre audio” de la société auprès de laquelle vous vous êtes inscrit n’est pas la même chose que le moteur sous-jacent qui ne le stocke pas. Demandez si le fournisseur vocal supprime également immédiatement ou s’il conserve l’audio selon sa propre politique distincte. C’est l’étape que la plupart des gens manquent, car elle est invisible de l’extérieur.

L’audio est-il utilisé pour la formation ?

La politique de confidentialité est le document contraignant, pas la page de destination. Recherchez un langage spécifique indiquant si les enregistrements sont utilisés pour la formation, le réglage ou l’évaluation du modèle. Si la politique dit quelque chose de vague comme « améliorer et développer nos services », supposez que cela inclut la formation jusqu’à ce qu’ils disent le contraire. L’ambiguïté dans une politique de confidentialité a tendance à se résoudre en faveur de l’entreprise, pas en votre faveur.

Qu’est-ce qui est stocké et est-il crypté ?

Même avec l’audio supprimé, la transcription reste généralement. C’est pour ça que tu es venu. La transcription d’une conversation confidentielle est sensible en soi. Demandez si les transcriptions stockées sont chiffrées au repos, de sorte qu’une violation de stockage exposerait un texte chiffré illisible au lieu d’une archive consultable de tout ce que quelqu’un a déjà transcrit.

Ce ne sont pas des questions pièges. Un outil qui répond clairement à ces quatre questions mérite d’être examiné de plus près. Un outil qui les évite vous aussi vous a dit quelque chose.

Comment Hushscript maintient l’exposition faible

Le principe de conception derrière Hushscript est un contact minimal : votre audio doit passer le moins de temps possible sur n’importe quel serveur en dehors de votre propre appareil, et ce qui est stocké doit être illisible en cas de fuite. C’est le coin de la vie privée, et cela vaut la peine d’être concret sur son fonctionnement.

Votre vidéo n’est jamais téléchargée. Si vous déposez un fichier vidéo, Hushscript prépare sa piste audio dans votre navigateur avant que quoi que ce soit ne soit envoyé. Une piste compatible est copiée sans réencodage ; la conversion s’exécute localement uniquement lorsque la piste en a besoin. Ce qui parvient au service de transcription est un téléchargement uniquement audio avec les données vidéo laissées. La vidéo elle-même reste sur votre appareil du début à la fin.

L’audio est supprimé dès que la transcription est prête. Il n’y a pas de délai de grâce de 30 jours, pas de compartiment de sauvegarde, pas de niveau de stockage à froid. La suppression est automatique une fois terminée. Ce n’est pas quelque chose que vous demandez, et cela ne dépend pas de votre capacité à vous en souvenir. L’audio est dans un état de traitement transitoire entre le téléchargement et la transcription, puis il disparaît.

Le moteur vocal ne conserve rien. Le moteur qui effectue la transcription ne conserve pas votre audio à des fins de formation, d’évaluation ou de débogage. Il traite le fichier et le supprime. Cela répond directement à la question du sous-processeur pour Hushscript au lieu de la laisser implicite dans une demande de suppression au niveau de l’application.

Vos ​​transcriptions sont chiffrées au repos. La transcription qui arrive dans votre tableau de bord est chiffrée là où elle est stockée. Si jamais notre stockage était divulgué, un attaquant obtiendrait un texte chiffré illisible, et non une archive lisible de vos paroles. Pour être précis sur la limite de cette affirmation : il s’agit d’une protection contre les fuites, pas d’une connaissance nulle. La clé est conservée sur nos serveurs afin que l’application puisse déchiffrer et vous montrer votre propre transcription. Nous ne prétendons donc pas que nous ne pouvons pas la lire. Nous affirmons qu’une base de données volée serait inutile sans la clé, ce qui est la menace que le chiffrement au repos est censé traiter.

À propos des certifications. Hushscript ne détient pas SOC 2 ni aucune autre certification de conformité formelle. L’approche consiste en premier lieu à garder la surface exposée petite (extraire l’audio dans le navigateur, le supprimer une fois terminé, crypter ce qui est stocké) plutôt que de créer un grand stock d’enregistrements puis de certifier les contrôles qui l’entourent. Si un certificat de conformité est une exigence stricte pour votre travail, c’est une bonne raison de choisir plutôt un fournisseur certifié ; il est préférable de le savoir dès le départ plutôt que de le supposer.

L’effet net est une courte empreinte de données. Votre audio existe sur notre infrastructure uniquement pendant la fenêtre de transcription. Avant cela, c’est sur votre appareil. Après cela, nulle part, et la transcription qui reste est un texte chiffré au repos. Vous pouvez voir le flux complet sur la page de fonctionnement, et la page de transcription privée aborde les détails du traitement des données.

Un exemple pratique : une interview confidentielle

Disons que vous êtes un journaliste avec une interview enregistrée de 50 minutes, en MP4 parce que vous je l’ai filmé sur un téléphone. La source a demandé à rester anonyme. Voici ce qui se passe, étape par étape, et là où les garanties de confidentialité s’appliquent réellement.

  1. Vous déposez le MP4 dans l’aperçu. Pas encore de compte. La page lit le fichier dans votre navigateur et prépare l’audio localement. La vidéo de 1,8 Go ne quitte jamais votre ordinateur portable ; seul un téléchargement uniquement audio est préparé pour l’étape suivante.
  2. Un aperçu de 30 secondes étiqueté par locuteur apparaît. Vous voyez l’échange d’ouverture déjà divisé en “Locuteur 1” et “Locuteur 2”, vous pouvez donc confirmer que la diarisation est raisonnable avant de vous engager. Cet aperçu est la seule étape véritablement sans compte.
  3. Vous vous inscrivez pour transcrire le reste. La transcription est fermée, elle nécessite donc un compte. Les nouveaux comptes bénéficient de 30 minutes gratuites pour essayer : instantanément lorsque vous validez une carte avec une retenue de 1 $ autorisée puis immédiatement libérée, jamais débitée, ou lors de votre premier achat si vous utilisez un mode de paiement disponible dans votre pays. Un entretien de 50 minutes dépasse les 30 minutes gratuites, vous devrez donc recharger ; la page de tarification indique le coût par minute.
  4. L’audio complet est transcrit, puis supprimé. Le fichier audio est traité et supprimé dès que votre transcription est prête. Il n’y a aucune copie de la voix de votre source sur un serveur.
  5. Vous réétiquetez et exportez. Vous renommez “Locuteur 1” en l’intervieweur et “Locuteur 2” en pseudonyme de la source, puis exportez vers DOCX pour l’éditeur et conservez un TXT pour vos notes. La transcription reste dans votre tableau de bord, cryptée au repos, jusqu’à ce que vous la supprimiez.

Le point de l’exemple : à aucun moment la vidéo brute sur un serveur, l’audio ne survit à la transcription ou la transcription stockée n’est lisible par toute personne qui viole le stockage sans la clé. C’est la différence entre “nous avons transcrit votre fichier” et “nous avons conservé indéfiniment la voix enregistrée de votre source”.

Réponses aux soucis courants

Quelques situations surviennent assez souvent pour être abordées directement.

“Mon fichier est énorme : cela signifie-t-il un téléchargement long et risqué ?” Une grande vidéo est d’abord préparée localement, car la vidéo reste sur votre appareil et seul son audio est envoyé. Les pistes compatibles sont copiées sans réencodage, tandis que la conversion est réservée aux fichiers qui en ont besoin. Il n’y a pas de limite de taille de fichier : même une très grande vidéo est préparée directement dans votre navigateur, à condition que l’enregistrement dure dans les 10 heures.

“Et si la transcription contient des éléments que je ne veux pas du tout stocker ?” Utilisez le mode privé pour la reconnaissance vocale uniquement et un résultat d’archive protégé par mot de passe sans enregistrer la transcription dans votre compte. Pour les transcriptions normales, exportez ce dont vous avez besoin et supprimez la transcription lorsque vous n’en avez plus besoin.

“Je n’ai qu’un fichier audio, pas de vidéo – l’extraction par le navigateur est-elle toujours importante ?” Pour un fichier audio simple, il n’y a pas de vidéo à retenir, donc aucune protection spécifique ne s’applique. Ceux qui le font encore sont les plus importants pour les travaux sensibles : l’audio est supprimé après la transcription, le moteur ne conserve rien et la transcription est cryptée au repos.

“Un outil gratuit est-il automatiquement moins sûr ?” Pas automatiquement. Mais si un outil est entièrement gratuit et qu’il n’existe aucun moyen évident de gagner de l’argent, il vaut la peine de se demander ce qui est monétisé. Parfois, la réponse réside dans les données que vous fournissez. Un outil payant ou à l’utilisation a au moins un modèle de financement qui ne dépend pas de l’exploitation de vos téléchargements.

Archive stockée ou transcription et suppression

Il existe deux modèles honnêtes pour un outil de transcription, et celui qui convient dépend de ce que vous transcrivez.

A L’outil d’archives stockées conserve vos fichiers audio et vos transcriptions dans une bibliothèque consultable à laquelle vous pourrez revenir des mois plus tard. C’est vraiment utile si vous construisez une base de connaissances personnelle de vos propres enregistrements et que le contenu n’est pas sensible, comme un podcasteur archivant ses propres épisodes. Le coût est qu’une pile croissante de vos enregistrements se trouve sur le serveur de quelqu’un d’autre.

Un outil de transcription et suppression, comme Hushscript, traite la transcription comme le livrable et l’audio comme un moyen de l’obtenir. L’audio est supprimé une fois terminé et la transcription peut être exportée et supprimée. C’est le bon modèle lorsque l’enregistrement est confidentiel et que vous disposez déjà de votre propre copie du fichier source, puisqu’il n’y a aucune raison pour que l’outil en conserve une également.

Aucun des deux n’est faux. Mais pour les enregistrements juridiques, les entretiens, les notes de thérapie ou tout ce qui a une source anonyme, le deuxième modèle supprime une responsabilité que le premier accumule au fil du temps.

Drapeaux rouges à surveiller

Lorsque vous évaluez un outil, quelques signaux valent la peine d’être traités comme des avertissements.

Langage de conservation vague.“Nous stockons vos fichiers pour un délai raisonnable » ou « les fichiers pourront être conservés pour améliorer nos services » ne constituent pas des engagements. « Raisonnable » peut signifier n’importe quoi, et « améliorer nos services » couvre fréquemment la formation.

Clauses de formation cachées dans les conditions. Vérifiez la section « Utilisation acceptable », « Contenu » ou « Licence » des conditions de service, pas seulement la politique de confidentialité. Certains outils s’accordent une large licence pour utiliser le contenu soumis comme bon leur semble, ce qui peut inclure discrètement la formation d’un modèle sur celui-ci.

Pas de réponse claire à une question directe. Si le support ne peut pas dire clairement quand l’audio est supprimé ou si les enregistrements sont utilisés à des fins de formation, ce silence est en soi la réponse.

Gratuit sans modèle de financement visible. Si un outil est entièrement gratuit et que les aspects économiques sont pris en compte. ne sont pas évidents, demandez-vous si le produit vendu correspond aux données que vous transmettez.

Stockage indéfini associé à une exportation payante. Un outil qui stocke votre audio pour toujours mais facture l’exportation de la transcription est conçu pour vous maintenir dépendant de son stockage, et non pour vous donner le contrôle de votre propre contenu.


Pour les interviews, les enregistrements juridiques ou tout autre audio dont le contenu est sensible, la question qui compte n’est pas de savoir si la transcription est exacte, mais plutôt de savoir si l’audio qui l’a produit reste le vôtre. La page de transcription privée explique comment l’approche de Hushscript se compare à celle par défaut.

Et si vous souhaitez spécifiquement connaître les mécanismes de suppression (quand cela se produit, ce qui compte comme “supprimé” et pourquoi nous en avons fait la valeur par défaut), pourquoi nous supprimons votre audio après la transcription le couvre en détail.

Sources et normes indépendantes

Hushscript a consulté ces références indépendantes et non concurrentes. Elles présentent des recherches, des normes ou le fonctionnement de plateformes et ne constituent pas une recommandation de Hushscript.

Sources vérifiées le :

Questions fréquentes

Est-il sécuritaire de télécharger de l'audio pour la transcription ?

Cela dépend de l'enregistrement, du service et des règles qui s'appliquent à vous. La gestion vidéo côté navigateur, la rétention audio courte, le stockage crypté et une politique d'absence de formation réduisent l'exposition ; ils ne rendent pas chaque téléchargement adapté au travail réglementé ou très sensible. Vérifiez d'abord la politique du service et vos propres exigences.

Hushscript conserve-t-il mon audio après la transcription ?

Non. L'audio est supprimé du serveur au moment où votre transcription est prête : pas de délai de grâce, pas de compartiment de sauvegarde, pas de stockage froid, pas de copie de formation. La seule chose qui persiste est le texte de la transcription dans votre tableau de bord, jusqu'à ce que vous le supprimiez également.

Si je télécharge une vidéo, le fichier vidéo quitte-t-il mon appareil ?

Non. Hushscript prépare la piste audio de la vidéo dans votre navigateur et envoie uniquement cet audio pour transcription. Une piste compatible est copiée sans réencodage ; la conversion s'exécute localement uniquement lorsque cela est nécessaire. La vidéo reste sur votre appareil.

Mes transcriptions sont-elles cryptées ?

Oui. Les transcriptions sont cryptées au repos, donc si jamais notre stockage était divulgué, vos mots seraient un texte chiffré illisible plutôt qu'un texte brut. Le cryptage protège contre une violation de stockage ; il ne s'agit pas d'une connaissance nulle, puisque la clé est conservée sur nos serveurs afin que l'application puisse vous montrer votre transcription.

Comment puis-je savoir qu'un service de transcription n'effectue pas de formation sur mes enregistrements ?

Demandez directement et lisez la politique de confidentialité plutôt que la page marketing. Des expressions telles que « peut utiliser votre contenu pour améliorer nos services » sont un signal d'alarme, car cette formulation couvre généralement la formation des modèles. Recherchez une déclaration explicite selon laquelle l'audio n'est pas utilisé pour entraîner ou affiner un modèle.

Quels types d'enregistrements comportent le plus de risques ?

Les consultations juridiques, les séances de thérapie, les visites médicales, les négociations commerciales, les entretiens RH et les enregistrements de sources journalistiques sont les cas évidents. Mais tout enregistrement contenant des voix, des noms ou des informations privées identifiables comporte certains risques s'il est stocké sur un serveur tiers que vous ne contrôlez pas.

La transcription est-elle sûre pour le contenu confidentiel ?

Oui, si vous choisissez l'outil avec soin. Pour tout ce que vous seriez mal à l'aise de laisser indéfiniment sur le serveur de quelqu'un d'autre, utilisez un service qui extrait l'audio dans le navigateur, le supprime après la transcription, crypte ce qu'il conserve et indique clairement qu'il ne s'entraîne pas sur vos données. Confirmez chacune de ces affirmations dans la politique de confidentialité avant de télécharger.

Commencer avec 30 minutes gratuites

Commencer – 30 minutes gratuites