Aller au contenu principal

Blog

Transcription de recherche pour interviews et focus groups

Auteur : Publié le : Dernière révision :

Un enregistrement n’est pas encore une donnée. Il le devient une fois que quelqu’un a décidé ce qui est retranscrit, comment les locuteurs sont marqués, quels détails identifiants en sont retirés, et à quoi ressemble le fichier une fois qu’il arrive dans votre logiciel de codage. Ces quatre décisions constituent la transcription de recherche, et chacune d’elles relève de la méthodologie, pas du travail de bureau.

Les prendre avant le premier entretien coûte bien moins cher que de les prendre au quatorzième. Voici ce que change chaque décision, ce qui doit figurer dans votre section méthodes, et où la transcription automatique aide réellement une étude au lieu de simplement donner l’impression que le dossier est terminé.

Choisissez le type de transcription avant la première séance

Il n’existe pas de transcription neutre. Chaque convention rend certaines choses visibles et en cache d’autres, donc choisissez en fonction de l’analyse que vous comptez réellement mener.

Type de transcription Ce qu’elle conserve Convient à
Verbatim Mots de remplissage, faux départs, pauses, chevauchements Analyse de conversation et de discours
Verbatim intelligent Les mots, sans les mots de remplissage ni les reprises Analyse thématique, théorie ancrée
Nettoyé Corrigé pour la grammaire et la lisibilité Citations pour publications et rapports
Dénaturalisé Grammaire standardisée dans tout le corpus Comparaison entre cas, larges échantillons

L’erreur coûteuse n’est pas de mal choisir, c’est de choisir deux fois. Un corpus moitié verbatim et moitié nettoyé ne peut pas être codé de façon cohérente, et retranscrire vingt entretiens pour réparer cela représente un mois que personne n’a budgeté. Consignez la convention à l’avance, y compris la façon dont vous marquerez les rires, les interruptions et les passages inaudibles.

Ce que les machines réussissent, et ce qu’elles manquent

La transcription automatique est suffisamment bonne pour être le premier brouillon de presque n’importe quelle étude, mais pas assez bonne pour être la version finale. Le Pew Research Center a comparé la transcription humaine et la transcription automatique sur des sermons enregistrés et a constaté que les machines suivaient le rythme sur un discours clair et continu, mais prenaient du retard sur les noms propres, les termes spécialisés et les passages où un locuteur changeait de ton ou de volume. Ce sont précisément les passages que les chercheurs qualitatifs ont tendance à citer.

Le schéma de travail est donc un brouillon que vous n’avez pas tapé, suivi d’une relecture que vous avez faite. Écoutez l’audio une fois en suivant le texte, corrigez les noms et la terminologie, réparez l’attribution des locuteurs sur les passages de diaphonie, et arrêtez-vous là. La relecture est la partie qui coûte du temps réel, et celle qui ne peut pas être sautée.

Les étiquettes de locuteurs sont déjà des pseudonymes

La séparation automatique des locuteurs divise un enregistrement par voix et étiquette les résultats Locuteur 1, Locuteur 2, et ainsi de suite. Elle reconnaît des voix, pas des personnes, ce qui est discrètement utile : l’étiquette est un pseudonyme par défaut et le reste tant que personne n’y saisit un vrai nom.

Gardez-le ainsi. Renommez Locuteur 1 en P07 ou en une étiquette de rôle une seule fois, et le changement se répercute sur toute la transcription et sur chaque export, si bien qu’un système d’identifiants de participants s’applique de façon cohérente au lieu d’être fait à la main à quarante endroits. Les étiquettes de locuteurs sont gratuites sur chaque transcription Hushscript, sans limite sur le nombre de voix, ce dont a besoin un focus group de six personnes.

La limite honnête, c’est la diaphonie. Quand les participants parlent en même temps, la séparation a besoin d’une relecture humaine, et ce sont les horodatages qui vous indiquent quelles minutes réécouter.

Mentionnez la méthode de transcription dans l’article

Les relecteurs demandent de plus en plus comment le texte a été produit, pas seulement ce qu’il dit. Les Journal Article Reporting Standards de l’APA pour la recherche qualitative demandent aux auteurs de décrire comment les données ont été enregistrées et transformées, ce qui fait de la transcription quelque chose à documenter plutôt qu’à supposer acquis.

Un seul paragraphe de méthodes répondant à ces points suffit généralement :

Anonymisez pendant la transcription, pas après coup

Le détail identifiant arrive en plein milieu d’une phrase : un employeur, un service hospitalier, une rue, une date d’audience, le seul collègue qui reconnaîtrait l’histoire. Le retirer plus tard signifie relire tout le corpus une seconde fois, alors intégrez-le plutôt à la passe de transcription.

Le faire directement dans la transcription plutôt que dans les copies exportées signifie aussi que seule la version pseudonymisée circule jamais. Rechercher-remplacer corrige un nom de lieu récurrent dans tout le document en une seule action, et des dictionnaires enregistrés font passer les noms, lieux et le vocabulaire technique de l’étude dans la reconnaissance, si bien que moins d’entre eux reviennent d’emblée erronés.

Ce que vous pouvez dire sur la plateforme compte autant que le caviardage. Hushscript supprime l’audio dès que chaque transcription est prête et ne l’utilise jamais pour entraîner des modèles ; les transcriptions sont chiffrées au repos selon une fenêtre de conservation que vous définissez, de 7 à 365 jours avec des dérogations par transcription ; les suppressions renvoient des reçus. L’audio provenant de l’UE, de l’EEE, de la Suisse et du Royaume-Uni est traité dans l’UE. Pour un enregistrement qui ne doit laisser aucune transcription stockée du tout, la transcription privée renvoie à la place un fichier .husharchive protégé par mot de passe.

Exportez pour le logiciel qui le reçoit

Une transcription reste rarement là où elle a été créée. Elle passe dans NVivo, ATLAS.ti, MAXQDA ou un tableur, puis plus tard dans un manuscrit. Le texte brut est l’endroit où les étiquettes de locuteurs et les horodatages disparaissent, alors choisissez le format en fonction de sa destination.

Hushscript exporte 21 formats sans filigrane et regroupe les plus pertinents dans un pack Recherche. Le fait que les horodatages survivent à l’export est ce qui permet à une citation dans vos résultats de renvoyer précisément à la seconde où elle a été prononcée, ce qui fait toute la différence entre une transcription citable et un simple long document.

Un terrain multilingue sans un prestataire par pays

Une étude comparative ne devrait pas avoir besoin d’un prestataire de transcription différent sur chaque site. La reconnaissance couvre environ 99 langues avec détection automatique, avec la meilleure précision sur un ensemble phare de 18 variantes linguistiques, si bien qu’un seul flux de travail couvre tout l’échantillon.

La traduction est une décision distincte de la transcription, et l’ordre compte : transcrivez dans la langue parlée, puis traduisez. Chaque langue de traduction cible coûte 25 % de la durée de l’enregistrement et place l’original et votre langue de travail dans des onglets d’un même document, chacun exportable séparément, si bien que vous citez les mots du participant et codez dans la langue dans laquelle vous pensez. Indiquez qui a traduit et comment les désaccords ont été résolus, car deux traducteurs ne rendront pas la même phrase de façon identique.

Le chiffrer face à la ligne budgétaire de la subvention

La transcription manuelle se facture en heures de chercheur, et vingt entretiens d’une heure représentent le genre de chiffre qui consomme discrètement un trimestre entier. La transcription automatique fait passer cela dans une ligne budgétaire assez petite pour cesser d’être une contrainte sur la taille de l’échantillon.

Hushscript vend des minutes prépayées plutôt qu’un abonnement, si bien que les mois de terrain coûtent ce qu’ils consomment et les mois de rédaction ne coûtent rien. Sur le plus grand pack, 49,99 $ pour 100 heures, vingt entretiens d’une heure reviennent à environ 10 $ et un focus group de 90 minutes à environ 0,75 $. Les minutes restent valables 365 jours, et toute transcription ou tout achat réinitialise cette fenêtre, ce qui convient à une étude qui met en pause pour une approbation éthique. Les nouveaux comptes reçoivent 30 minutes gratuites, débloquées soit par une vérification de carte de 1 $ qui est autorisée puis immédiatement libérée sans jamais être débitée, soit par votre premier achat si vous payez autrement.

Par où commencer

Utilisez le dernier entretien que vous avez réellement enregistré, pas un fichier de test propre. Passez-le par la transcription de recherche et lisez les 5 premières minutes qui reviennent : cela vous montre comment l’identification des locuteurs se comporte sur vos participants, votre pièce et vos accents, ce qui est le seul chiffre de précision qui compte réellement pour votre étude.

Ensuite, inscrivez la convention dans votre protocole tant qu’il vous reste encore trente entretiens auxquels l’appliquer.

Sources et normes indépendantes

Hushscript a consulté ces références indépendantes et non concurrentes. Elles présentent des recherches, des normes ou le fonctionnement de plateformes et ne constituent pas une recommandation de Hushscript.

Sources vérifiées le :

Questions fréquentes

La transcription automatique est-elle suffisamment précise pour la recherche qualitative ?

Comme premier brouillon, oui. Comme transcription finale, pas à elle seule. La reconnaissance automatique suit bien un discours clair et continu, mais prend du retard sur les noms propres, le vocabulaire spécialisé et les moments où un locuteur change de registre, qui sont exactement les moments que les chercheurs citent. Le schéma qui fonctionne est un brouillon automatique suivi d'une relecture par rapport à l'audio.

Comment les participants restent-ils anonymes dans la transcription ?

Les étiquettes de locuteurs ne portent aucune identité. La séparation automatique reconnaît des voix, pas des personnes, donc les étiquettes arrivent sous la forme Speaker 1 et Speaker 2 et restent des pseudonymes tant que vous n'y saisissez pas un vrai nom. Renommez-les une fois selon votre système d'identifiants de participants, et c'est ce que la transcription et chaque export afficheront.

Que puis-je dire à un comité d'éthique à propos de la plateforme ?

Les faits, qui sont courts. Hushscript supprime l'audio dès que chaque transcription est prête et ne l'utilise jamais pour entraîner des modèles. Les transcriptions sont chiffrées au repos selon une fenêtre de conservation que vous définissez, de 7 à 365 jours avec des dérogations par transcription, et la suppression renvoie un reçu. L'audio provenant de l'UE, de l'EEE, de la Suisse et du Royaume-Uni est traité dans l'UE. Ce sont des capacités à comparer avec votre protocole, pas une certification de conformité.

Quel format d'export fonctionne avec NVivo ou ATLAS.ti ?

Utilisez un format structuré plutôt que du texte brut, car le texte brut fait disparaître les étiquettes de locuteurs et les horodatages. CSV, TSV et XLSX conservent les deux sous forme de colonnes pour un codage sur tableur ou logiciel, et JSON convient aux pipelines scriptés. Hushscript exporte 21 formats sans filigrane et regroupe les plus utiles dans un pack Recherche.

Combien coûte la transcription d'une étude ?

Sur le plus grand pack prépayé, 49,99 $ pour 100 heures, vingt entretiens d'une heure reviennent à environ 10 $ et un focus group de 90 minutes à environ 0,75 $. Il n'y a ni abonnement ni palier académique : les minutes sont prépayées, consommées uniquement quand un fichier est transcrit, et restent valables 365 jours, toute transcription ou tout achat réinitialisant cette fenêtre.

Puis-je le tester sur mes propres enregistrements avant de m'engager sur tout le corpus ?

Oui. Les 5 premières minutes d'un fichier reviennent avec les locuteurs étiquetés, sans compte, ce qui suffit pour juger la séparation des locuteurs sur vos participants, votre pièce et vos accents réels. Transcrire l'ensemble du corpus nécessite un compte.

Comment gérer des entretiens dans plus d'une langue ?

Transcrivez dans la langue parlée, puis traduisez. La reconnaissance couvre environ 99 langues avec détection automatique, et ajouter une langue de traduction cible coûte 25 % de la durée de l'enregistrement et place l'original et votre langue de travail dans des onglets d'un même document. L'alternance codique à l'intérieur d'une seule phrase reste le cas difficile, et un relecteur bilingue est la solution.

Commencer avec 30 minutes gratuites

Un blocage de 1 $ confirme votre carte et est libéré immédiatement — vous n'êtes jamais débité, et vos 30 minutes gratuites sont créditées aussitôt.

Commencer – 30 minutes gratuites