Vai al contenuto principale

È sicuro caricare l'audio per la trascrizione?

Autore: Pubblicato: Ultima revisione:

Caricare l’audio per la trascrizione può essere ragionevole quando lo strumento, la registrazione e le regole applicabili sono allineati. La trascrizione stessa è solo una parte del rischio. Ciò che conta è cosa succede una volta che il file lascia il tuo dispositivo: dove viene archiviato, per quanto tempo rimane lì, chi altro lo elabora e se può essere utilizzato per l’addestramento del modello. Le politiche variano ampiamente, quindi la domanda sulla sicurezza è in realtà una domanda sul servizio specifico di cui ti fidi.

Questo post illustra cosa accade effettivamente a un file che carichi, le quattro domande che vale la pena porre a qualsiasi strumento di trascrizione, come Hushscript mantiene piccola l’esposizione e i segnali di allarme che dovrebbero farti chiudere la scheda. È una spiegazione, non una presentazione di vendita. Le domande si applicano a ogni strumento, compresi quelli che non sono nostri.

Cosa succede realmente al tuo audio

Quando carichi un file, non va in un posto e torna subito indietro. Si muove attraverso diversi sistemi e la questione della privacy è cosa ne fa ciascuno.

Archiviazione. Un servizio di caricamento potrebbe scrivere il tuo file nell’archiviazione di oggetti cloud prima che il motore vocale lo veda. Tale spazio di archiviazione ha una politica di conservazione, indipendentemente dal fatto che la pagina di marketing lo indichi chiaramente o meno. I principi GDPR della Commissione Europea affermano che i dati personali dovrebbero essere archiviati per il minor tempo possibile ed esaminati rispetto ai limiti di cancellazione definiti. Richiedi la finestra di conservazione effettiva anziché dedurla da un elenco di funzionalità.

Elaborazione. L’audio può passare attraverso uno o più sistemi che eseguono il riconoscimento vocale, la separazione dei parlanti e la pulizia. Un servizio può utilizzare il proprio motore o un processore, quindi controlla i subresponsabili nominati e i relativi termini di conservazione invece di dare per scontato che l’azienda nella pagina di caricamento sia l’unica parte coinvolta.

Dati di addestramento. I modelli vocali migliorano con l’addestramento su audio reale e le registrazioni dei clienti reali sono un prezioso carburante per la formazione. Alcuni servizi si riservano il diritto di utilizzare i tuoi caricamenti per il “miglioramento del prodotto” nei loro termini. Raramente si tratta di una casella di attivazione chiara al momento del caricamento. Di solito è nascosto nei termini di servizio o attivato per impostazione predefinita con un dispositivo di disattivazione che devi cercare.

Log. Anche gli strumenti che eliminano l’audio spesso conservano i metadati: quando hai caricato, quanto tempo era il file, quale lingua è stata rilevata, quanti parlanti. Questi metadati presentano un rischio molto inferiore rispetto all’audio stesso, ma vale la pena sapere che di solito sopravvivono alla registrazione.

La conclusione non è che tutto ciò sia sinistro. Il fatto è che “carica l’audio, ricevi il testo” nasconde quattro o cinque decisioni separate e uno strumento che le prende in considerazione tutte sembra molto diverso da uno che non lo è.

Le quattro domande da porre a qualsiasi strumento di trascrizione

Non è necessario leggere l’intero blog tecnico di un’azienda per giudicare uno strumento. Quattro domande coprono la maggior parte del rischio e un servizio che ha analizzato attentamente le proprie pratiche sui dati può rispondere a tutte e quattro in modo chiaro.

Quando viene eliminato l’audio?

La risposta che desideri è “immediatamente dopo che la trascrizione è pronta”, non “entro 30, 60 o 90 giorni” e non “quando elimini il tuo account”. L’eliminazione che richiede un’azione da parte tua significa che l’audio persiste per impostazione predefinita e le impostazioni predefinite sono ciò che effettivamente accade. Una finestra di conservazione fissa di settimane o mesi significa che c’è una copia della tua registrazione su un server per tutto il tempo, a disposizione di chiunque possa raggiungere il bucket.

Il motore vocale conserva una copia?

Se il servizio utilizza un’API vocale di terze parti, anche il tuo audio passa attraverso quel fornitore. “Non memorizziamo il tuo audio” della società con cui ti sei iscritto non equivale a non memorizzarlo nel motore sottostante. Chiedi se anche il fornitore del servizio vocale elimina immediatamente o se conserva l’audio in base a una propria politica separata. Questo è il passaggio che la maggior parte delle persone trascura, perché è invisibile dall’esterno.

L’audio viene utilizzato per la formazione?

L’informativa sulla privacy è il documento vincolante, non la pagina di destinazione. Cerca un linguaggio specifico sull’utilizzo delle registrazioni per l’addestramento, la messa a punto o la valutazione del modello. Se la politica dice qualcosa di vago come “migliorare e sviluppare i nostri servizi”, presumi che includa la formazione finché non dicono diversamente. L’ambiguità in una politica sulla privacy tende a risolversi a favore dell’azienda, non a tuo favore.

Cosa viene archiviato ed è crittografato?

Anche con l’audio eliminato, la trascrizione solitamente rimane. E’ per questo che sei venuto. La trascrizione di una conversazione riservata è di per sé delicata. Chiedi se le trascrizioni archiviate sono crittografate quando sono inattive, in modo che una violazione dello spazio di archiviazione esponga un testo cifrato illeggibile invece di un archivio ricercabile di tutto ciò che qualcuno ha mai trascritto.

Queste non sono domande ingannevoli. Uno strumento che risponde chiaramente a tutte e quattro le domande ha meritato uno sguardo più attento. Uno strumento che li schiva ti ha detto qualcosa anche tu.

Come Hushscript mantiene piccola l’esposizione

Il principio di progettazione alla base di Hushscript è il contatto minimo: il tuo audio dovrebbe trascorrere il minor tempo possibile su qualsiasi server esterno al tuo dispositivo e ciò che viene archiviato dovrebbe essere illeggibile in caso di fuga di notizie. Questa è la privacy wedge e vale la pena essere concreti su come funziona.

Il tuo video non viene mai caricato. Se trascini un file video, Hushscript prepara la traccia audio nel tuo browser prima che venga inviato qualsiasi cosa. Una traccia compatibile viene copiata senza ricodifica; la conversione viene eseguita localmente solo quando la traccia lo richiede. Ciò che arriva al servizio di trascrizione è un caricamento solo audio con i dati video rimasti. Il video rimane sul tuo dispositivo dall’inizio alla fine.

L’audio viene eliminato nel momento in cui la trascrizione è pronta. Non è previsto un periodo di grazia di 30 giorni, né un bucket di backup, né un livello di conservazione a freddo. La cancellazione è automatica al termine. Non è qualcosa che richiedi e non dipende dal fatto che te lo ricordi. L’audio è in uno stato di elaborazione transitoria dal caricamento alla trascrizione, quindi non c’è più.

Il motore vocale non conserva nulla. Il motore che esegue la trascrizione non conserva l’audio per l’addestramento, la valutazione o il debug. Elabora il file e lo scarta. Ciò risponde direttamente alla domanda del sottoprocessore per Hushscript invece di lasciarla implicita in una richiesta di eliminazione a livello di applicazione.

Le tue trascrizioni sono crittografate quando sono inattive. La trascrizione che arriva nella tua dashboard è crittografata dove è archiviata. Se il nostro spazio di archiviazione venisse mai divulgato, ciò che un utente malintenzionato otterrebbe è un testo cifrato illeggibile, non un archivio leggibile delle tue parole. Per essere precisi riguardo al limite di tale affermazione: si tratta di protezione dalle perdite, non di conoscenza zero. La chiave è conservata sui nostri server in modo che l’app possa decrittografare e mostrarti la tua trascrizione, quindi non affermiamo di non poterla leggere. Sosteniamo che un database rubato sarebbe inutile senza la chiave, che è la minaccia che la crittografia a riposo dovrebbe effettivamente affrontare.

Informazioni sulle certificazioni. Hushscript non possiede SOC 2 o altre certificazioni di conformità formale. L’approccio è innanzitutto quello di mantenere piccola la superficie esposta (estrarre l’audio nel browser, cancellarlo una volta completato, crittografare ciò che è archiviato) piuttosto che costruire un grande archivio di registrazioni e quindi certificare i controlli attorno ad esso. Se un certificato di conformità è un requisito fondamentale per il tuo lavoro, questo è un buon motivo per scegliere invece un fornitore certificato; è meglio saperlo in anticipo piuttosto che presumerlo.

L’effetto netto è una breve impronta di dati. Il tuo audio esiste sulla nostra infrastruttura solo durante la finestra di trascrizione. Prima di ciò, è sul tuo dispositivo. Dopodiché, da nessuna parte, e la trascrizione che rimane è testo cifrato a riposo. Puoi vedere il flusso completo nella pagina come funziona, mentre la pagina di trascrizione privata entra nelle specifiche della gestione dei dati.

Un esempio pratico: un’intervista riservata

Supponiamo che tu sia un giornalista con un’intervista registrata di 50 minuti, in MP4 perché l’hai filmato su un telefono. La fonte ha chiesto di rimanere anonima. Ecco cosa succede, passo dopo passo, e dove le garanzie sulla privacy influiscono effettivamente.

  1. Trascina l’MP4 nell’anteprima. Ancora nessun account. La pagina legge il file nel tuo browser e prepara l’audio localmente. Il video da 1,8 GB non lascia mai il tuo laptop; per il passaggio successivo viene preparato solo un caricamento solo audio.
  2. Viene visualizzata un’anteprima di 30 secondi con l’etichetta del relatore. Vedi lo scambio di apertura già diviso in “Parlante 1” e “Parlante 2”, quindi puoi confermare che la diarizzazione è sensata prima di impegnarti. Questa anteprima è l’unico passaggio che richiede veramente l’assenza di account.
  3. Ti registri per trascrivere il resto. La trascrizione è controllata, quindi necessita di un account. I nuovi account ricevono 30 minuti gratuiti per provare: istantaneamente quando convalidi una carta con una trattenuta di $ 1 autorizzata e poi rilasciata immediatamente, senza alcun addebito, o al tuo primo acquisto se utilizzi un metodo di pagamento disponibile nel tuo Paese. Un colloquio di 50 minuti supera i 30 gratuiti, quindi dovresti ricaricarlo; la pagina dei prezzi ha il costo al minuto.
  4. L’audio completo viene trascritto, quindi eliminato. Il file audio viene elaborato e rimosso nel momento in cui la trascrizione è pronta. Non è rimasta alcuna copia della voce della tua fonte su un server.
  5. Rietichetta ed esporti. Rinomini “Parlante 1” con l’intervistatore e “Parlante 2” con lo pseudonimo della fonte, quindi esporti in DOCX per l’editore e mantieni un TXT per i tuoi appunti. La trascrizione rimane nella tua dashboard, crittografata quando non è attiva, finché non la elimini.

Il punto dell’esempio: in nessun momento il video grezzo si trova su un server, l’audio sopravvive alla trascrizione o la trascrizione archiviata è leggibile da chiunque violi l’archivio senza la chiave. Questa è la differenza tra “abbiamo trascritto il tuo file” e “abbiamo conservato la voce registrata della tua fonte a tempo indeterminato.”

Preoccupazioni comuni, risposta

Alcune situazioni si verificano abbastanza spesso da poter essere affrontate direttamente.

“Il mio file è enorme: significa un caricamento lungo e rischioso?” Una grande il video viene prima preparato localmente, perché rimane sul tuo dispositivo e viene inviato solo il suo audio. Le tracce compatibili vengono copiate senza ricodifica, mentre la conversione è riservata ai file che ne hanno bisogno. Non esiste alcun limite alle dimensioni del file: anche un video molto grande viene preparato direttamente nel tuo browser, purché la registrazione avvenga entro 10 ore.

“E se nella trascrizione ci fossero cose che non voglio che vengano archiviate?” Utilizza la modalità privata solo per il riconoscimento vocale e un risultato di archivio protetto da password senza salvare la trascrizione nel tuo account. Per le trascrizioni normali, esporta ciò che ti serve ed elimina la trascrizione quando non ti serve più.

“Ho solo un file audio, nessun video: l’estrazione tramite browser è ancora importante?” Per un semplice file audio non c’è video da trattenere, quindi la protezione specifica non si applica. Quelli che ancora lo fanno sono quelli più importanti per i lavori delicati: l’audio viene eliminato dopo la trascrizione, il motore non conserva nulla e la trascrizione viene crittografata quando non è attiva.

“Uno strumento gratuito è automaticamente meno sicuro?” Non automaticamente. Ma se uno strumento è completamente gratuito e non esiste un modo ovvio per generare profitti, vale la pena chiedersi cosa viene monetizzato. A volte la risposta sono i dati che fornisci. Uno strumento a pagamento o con pagamento in base al consumo ha almeno un modello di finanziamento che non dipende dall’estrazione dei tuoi caricamenti.

Archivio archiviato e trascrizione ed eliminazione

Esistono due modelli onesti per uno strumento di trascrizione e quale si adatta dipende da ciò che stai trascrivendo.

Uno strumento di archivio archiviato conserva l’audio e le trascrizioni in una libreria ricercabile a cui puoi tornare mesi dopo. Ciò è davvero utile se stai costruendo una base di conoscenza personale delle tue registrazioni e il contenuto non è sensibile, come un podcaster che archivia i propri episodi. Il costo è che una quantità crescente di registrazioni risiede sul server di qualcun altro.

Uno strumento di trascrizione ed eliminazione, come Hushscript, tratta la trascrizione come il risultato finale e l’audio come un mezzo per ottenerlo. L’audio viene eliminato al termine e la trascrizione può essere esportata e rimossa. Questo è il modello giusto quando la registrazione è confidenziale e hai già la tua copia del file sorgente, poiché non c’è motivo per cui lo strumento ne tenga anche una.

Nessuno dei due è sbagliato. Ma per registrazioni legali, interviste, appunti terapeutici o qualsiasi cosa con una fonte anonima, il secondo modello rimuove una responsabilità che il primo accumula nel tempo.

Segnali di allarme a cui prestare attenzione

Quando si valuta uno strumento, alcuni segnali meritano di essere trattati come avvertimenti.

Conservazione vaga lingua.“Conserviamo i tuoi file per un periodo ragionevole” o “i file potrebbero essere conservati per migliorare i nostri servizi” non sono impegni. “Ragionevole” può significare qualsiasi cosa e “migliorare i nostri servizi” spesso copre la formazione.

Clausole sulla formazione nascoste nei termini. Controlla la sezione “Uso accettabile”, “Contenuti” o “Licenza” dei termini di servizio, non solo l’informativa sulla privacy. Alcuni strumenti si concedono un’ampia licenza per utilizzare i contenuti inviati come preferiscono, il che può includere tranquillamente l’addestramento di un modello su di esso.

Nessuna risposta chiara a una domanda diretta. Se l’assistenza non può dire chiaramente quando l’audio viene eliminato o se le registrazioni vengono utilizzate per l’addestramento, quel silenzio è di per sé la risposta.

Gratuito senza modello di finanziamento visibile. Se uno strumento è completamente gratuito e gli aspetti economici non sono ovvi, considera se il prodotto venduto sono i dati che stai consegnando.

Archiviazione indefinita abbinata a un’esportazione protetta da paywall. Uno strumento che archivia il tuo audio per sempre ma addebita un costo per esportare la trascrizione è progettato per mantenerti dipendente dalla sua archiviazione, non per darti il controllo dei tuoi contenuti.


Per interviste, registrazioni legali o qualsiasi audio in cui il contenuto è sensibile, la domanda che conta non è se la trascrizione sia accurata, ma se l’audio che l’ha prodotta rimane tuo. La pagina di trascrizione privata illustra il confronto tra l’approccio di Hushscript e quello predefinito.

E se desideri i meccanismi di eliminazione specifici (quando avviene, cosa conta come “eliminato” e perché l’abbiamo impostato come predefinito), perché eliminiamo il tuo audio dopo la trascrizione lo spiega in dettaglio.

Fonti e standard indipendenti

Hushscript ha consultato queste fonti indipendenti e non concorrenti. Illustrano ricerche, standard o il funzionamento delle piattaforme e non implicano un sostegno a Hushscript.

Fonti verificate il:

Domande frequenti

È sicuro caricare l'audio per la trascrizione?

Dipende dalla registrazione, dal servizio e dalle regole che si applicano a te. La gestione dei video lato browser, la breve conservazione dell'audio, l'archiviazione crittografata e una politica di assenza di formazione riducono l'esposizione; non rendono ogni caricamento adatto a lavori regolamentati o altamente sensibili. Verifica prima la politica del servizio e i tuoi requisiti.

Hushscript conserva il mio audio dopo la trascrizione?

No. L'audio viene eliminato dal server nel momento in cui la trascrizione è pronta: nessun periodo di grazia, nessun bucket di backup, nessuna conservazione a freddo, nessuna copia di addestramento. L'unica cosa che persiste è il testo della trascrizione nella dashboard, finché non elimini anche quello.

Se carico un video, il file video lascia il mio dispositivo?

No. Hushscript prepara la traccia audio del video nel tuo browser e invia solo quell'audio per la trascrizione. Una traccia compatibile viene copiata senza ricodifica; la conversione viene eseguita localmente solo quando richiesto. Il video rimane sul tuo dispositivo.

Le mie trascrizioni sono crittografate?

Sì. Le trascrizioni vengono crittografate a riposo, quindi se il nostro archivio dovesse mai trapelare, le tue parole sarebbero testo cifrato illeggibile anziché testo normale. La crittografia protegge da una violazione dello storage; non è a conoscenza zero, poiché la chiave è conservata sui nostri server in modo che l'app possa mostrarti la tua trascrizione.

Come faccio a sapere che un servizio di trascrizione non si sta addestrando sulle mie registrazioni?

Chiedi direttamente e leggi l'informativa sulla privacy anziché la pagina di marketing. Frasi come "potremmo utilizzare i tuoi contenuti per migliorare i nostri servizi" sono un campanello d'allarme, poiché di solito si riferiscono alla formazione dei modelli. Cerca una dichiarazione esplicita che l'audio non viene utilizzato per addestrare o mettere a punto alcun modello.

Quali tipi di registrazioni comportano maggiori rischi?

Consulenze legali, sessioni terapeutiche, visite mediche, trattative commerciali, interviste alle risorse umane e registrazioni di fonti giornalistiche sono i casi ovvi. Tuttavia, qualsiasi registrazione con voci, nomi o dettagli privati ​​identificabili comporta qualche rischio se viene archiviata su un server di terze parti che non controlli.

La trascrizione è sicura per contenuti riservati?

Sì, se scegli lo strumento con attenzione. Per qualsiasi cosa che ti sentiresti a disagio a lasciare sul server di qualcun altro a tempo indeterminato, utilizza un servizio che estrae l'audio nel browser, lo elimina dopo la trascrizione, crittografa ciò che conserva e afferma chiaramente che non si addestra sui tuoi dati. Conferma ciascuna di queste affermazioni nell'informativa sulla privacy prima di caricare.

Inizia con 30 minuti gratuiti

Inizia – 30 minuti gratuiti