Vai al contenuto principale

Come creare sottotitoli SRT da un video

Autore: Pubblicato: Ultima revisione:

Un file SRT è il modo in cui i sottotitoli viaggiano separatamente da un video, come un piccolo file di testo sidecar che il lettore legge accanto all’immagine. Ne crei uno trascrivendo l’audio ed esportando il risultato con timestamp. Il lavoro che prima richiedeva un pomeriggio, cronometrando ogni linea del telaio, ora è finito per te; ciò che rimane è un breve passaggio di modifica per la leggibilità. Questa guida spiega cosa contiene effettivamente il formato, come creare un SRT da un video nell’ordine reale e come ripulirlo in modo che i sottotitoli siano letti bene.

Cosa ti serve prima di iniziare

Ti servono il file video e qualche minuto. Funziona qualsiasi contenitore comune: MP4, MOV, MKV, WebM, AVI e il resto. Non è necessario un software di editing per creare l’SRT e non è necessario prima convertire il video. Un editor di sottotitoli è facoltativo e utile solo in seguito, se desideri una visualizzazione della sequenza temporale mentre ottimizzi i tempi.

Per la trascrizione stessa ti iscrivi, che sblocca 30 minuti gratuiti per provare. L’anteprima di 30 secondi che viene renderizzata per prima non richiede account, quindi puoi vedere la qualità prima di impegnarti in qualsiasi cosa.

Cos’è un file SRT

SRT sta per SubRip Text. Il formato è volutamente semplice: una sequenza di blocchi numerati, ciascuno composto da tre parti impilate su linee separate. Prima un numero di indice, poi un start --> end timestamp, quindi una o due righe di testo dei sottotitoli. Una riga vuota separa un blocco dal successivo.

1
00:00:02,340 --> 00:00:05,810
L'audio viene estratto nel tuo browser.

2
00:00:06,100 --> 00:00:09,440
Solo l'audio raggiunge il server, non il video.

Alcuni dettagli contano quando leggi o modifichi manualmente un file. Il formato del timestamp è HH:MM:SS,mmm, dalle ore ai millisecondi, e il separatore prima dei millisecondi è una virgola, non un punto. La freccia tra i due tempi è esattamente composta da due trattini e un segno di maggiore. I numeri indice dovrebbero essere in ordine da 1 senza spazi vuoti. Se sbagli qualcuno di questi errori, alcuni giocatori lasceranno cadere silenziosamente l’indicazione interessata, che è la ragione più comune per cui un SRT modificato manualmente “smette di funzionare” a metà strada.

Il supporto SRT è ampio tra lettori desktop, editor e piattaforme di hosting, ma non è universale. La descrizione del formato della Library of Congress documenta l’SRT come una semplice sequenza di segnali di testo numerati e temporizzati; ciascuna destinazione decide comunque quali formati di sottotitoli importare. L’elemento HTML nativo <track> utilizza WebVTT per il testo temporizzato, come definito nello standard di vita WHATWG, che è una conversione rapida illustrata più avanti.

Crea un SRT da un video nell’ordine reale

Il flusso ha tre fasi e l’ordine è la parte che le persone tornano indietro. Rilascia prima il file e visualizzane l’anteprima prima che esista qualsiasi account.

  1. Rilascia il tuo video per ottenere un’anteprima gratuita. Vai a /video-to-text o /MP4-to-text se il tuo file è un MP4 e rilascia il video nell’area di caricamento. La traccia audio viene estratta nel tuo browser utilizzando una libreria di elaborazione locale, quindi i primi 30 secondi ritornano come anteprima etichettata dall’oratore. Per questo passaggio non è necessario alcun account e il video non lascia mai il tuo dispositivo.
  2. Registrati per trascrivere il resto. Una volta che l’anteprima sembra corretta, crea un account per eseguire il file completo. La registrazione sblocca 30 minuti gratuiti per provare. Il modo più rapido per ottenerli è convalidare una carta con trattenuta di un dollaro che viene autorizzata e poi rilasciata subito, senza mai addebitare; se preferisci utilizzare un altro metodo di pagamento disponibile nel tuo Paese, i 30 minuti arrivano invece con il tuo primo acquisto. In ogni caso non è necessaria una carta. La trascrizione è a pagamento perché funziona con un’intelligenza artificiale di alto livello, quindi è a pagamento senza abbonamento. Per un video più lungo che supera i minuti gratuiti, consulta la pagina dei prezzi; paghi per minuto di audio, non per file.
  3. Ricevi la trascrizione ed esporta SRT. Quando la trascrizione è pronta, aprila nell’editor, apporta eventuali correzioni, quindi fai clic su Esporta e scegli SRT. Ogni espressione parlata diventa un segnale con il timestamp di inizio e fine già in atto. Il download è un semplice file .srt senza filigrana.

Le etichette dei parlanti vengono visualizzate nell’editor prima dell’esportazione. Se vuoi nomi nelle didascalie, utili per interviste, dibattiti o panel, rinomina prima “Parlante 1” e “Parlante 2” con i nomi reali; l’esportazione quindi scrive quei nomi all’inizio delle battute corrispondenti.

Un esempio funzionante

Supponiamo che tu abbia un’intervista registrata di 12 minuti,founder-chat.mp4, con due persone. Lo rilasci sulla pagina, l’anteprima di 30 secondi conferma che entrambe le voci sono state rilevate in modo pulito e ti iscrivi. Quando la trascrizione completa è pronta, rinomini i due parlanti in “Maya” e “Devin”, correggi il nome di un prodotto frainteso, quindi esporti come SRT. L’apertura del file assomiglia a questa:

1
00:00:01,120 --> 00:00:04,460
Maya: Grazie per aver dedicato del tempo oggi.

2
00:00:04,800 --> 00:00:08,210
Devin: Naturalmente. Non vedevo l'ora.

3
00:00:08,540 --> 00:00:12,900
Maya: Cominciamo dall'inizio. Come è nata l'idea?

Due cose vale la pena notare. Ogni segnale corrisponde a un’espressione naturale, quindi il tempo segue la conversazione anziché un orologio fisso. E gli intervalli tra i segnali, qui poche centinaia di millisecondi, riflettono le pause reali tra gli interlocutori. Di solito è esattamente quello che vuoi, con un avvertimento trattato successivamente.

Modifica tempi e lunghezza della riga

La maggior parte delle esportazioni sono utilizzabili così come sono, ma due rapidi controlli rendono i sottotitoli notevolmente più facili da leggere. Questo passaggio breve è ciò che distingue i sottotitoli generati automaticamente da quelli che sembrano professionali.

Lunghezza e numero di righe. Le guide di stile variano e il formato SRT stesso non impone una lunghezza o un conteggio di righe universali. Una lunga stecca può ancora diventare un muro di testo. Segui la regola attuale della destinazione quando ne ha una; in caso contrario, mantieni ciascun segnale compatto, dividilo in corrispondenza del confine naturale della frase e controlla il risultato sulla dimensione del fotogramma finale.

Velocità di lettura. La lunghezza sullo schermo deve corrispondere alla durata di visualizzazione del segnale. Se un segnale mostra molto testo per un tempo molto breve, dividilo in una pausa naturale o riprogrammalo senza coprire il discorso successivo. Visualizza l’anteprima dei sottotitoli a velocità di riproduzione normale invece di giudicare il tempo solo dal file di testo.

Lacune temporali e sovrapposizioni. Un intervallo inferiore a circa 80 millisecondi tra due battute può far sì che alcuni giocatori mantengano la riga precedente troppo a lungo o saltino quella successiva, quindi lascia un piccolo respiro tra le battute consecutive. Il problema opposto è la sovrapposizione: quando due persone parlano tra loro, il motore assegna a ciascun interlocutore un segnale separato e tali segnali possono scontrarsi nel tempo. Nessuno strumento automatico risolve perfettamente la vera sovrapposizione, quindi per filmati ricchi di dialoghi, cerca i timestamp sovrapposti e sposta manualmente un segnale prima o dopo.

Puoi fare tutto questo in qualsiasi editor di testo semplice, poiché il formato è leggibile dall’uomo. Se preferisci lavorare visivamente, un editor di sottotitoli dedicato come Subtitle Edit su Windows o Aegisub su qualsiasi piattaforma aggiunge una timeline della forma d’onda e può correggere automaticamente e in blocco i problemi comuni di spaziatura e velocità di lettura.

SRT vs VTT: quale esportare

I due formati sono cugini stretti e la scelta giusta dipende da dove verranno riprodotti i sottotitoli. Se desideri un confronto completo prima di impegnarti, SRT vs VTT: quale formato di sottotitoli utilizzare analizza i punti di forza di ciascun formato.

Raggiungi SRT per lettori desktop, editor video e la grande maggioranza delle piattaforme di hosting, che è la maggior parte di ciò di cui le persone hanno bisogno. Raggiungi WebVTT quando i sottotitoli vengono inseriti in una pagina Web personalizzata utilizzando l’elemento HTML5 <video>, perché è l’unico formato letto dai browser in modo nativo per l’elemento <track>. Il contenuto è identico tra loro. VTT aggiunge semplicemente una riga WEBVTT all’inizio del file e utilizza un punto invece di una virgola prima dei millisecondi in ogni timestamp.

Poiché la differenza è così piccola, non è necessario ritrascrivere per cambiare. Esporta SRT e, se in seguito avrai bisogno di VTT, eseguilo tramite il convertitore gratuito su /tools/SRT-to-VTT. Funziona nel tuo browser senza account e non viene caricato nulla.

Aggiungi SRT a un player, editor o piattaforma

Una volta ricevuto il file, allegarlo dipende da dove si trova il video.

Lettore desktop. VLC, mpv e la maggior parte dei lettori desktop caricano automaticamente un SRT sidecar quando condivide il nome di base e la cartella del video. Rinomina il tuo file in modo che interview.mp4 sia accoppiato con interview.srt, trascinali nella stessa directory e i sottotitoli appariranno durante la riproduzione. Se un lettore non lo vede, il menu dei sottotitoli dispone di un’opzione manuale “carica file dei sottotitoli”.

Editor video. In DaVinci Resolve, Premiere Pro o Final Cut, importa l’SRT come traccia di sottotitoli o didascalie. L’editor inserisce ogni segnale sulla timeline nel timecode corretto e da lì puoi modificare lo stile del carattere, modificare la posizione e masterizzare i sottotitoli nell’esportazione finale se li desideri codificati.

Piattaforme di hosting e video social. YouTube accetta SRT direttamente nel suo flusso di lavoro dei sottotitoli. Altre piattaforme potrebbero accettare un file collaterale, richiedere l’editor di sottotitoli integrato o aspettarsi che i sottotitoli vengano incorporati nel video. Mantieni l’SRT recensito come fonte di verità, quindi utilizza il flusso di pubblicazione corrente della destinazione anziché dare per scontato che un metodo di caricamento funzioni ovunque.

Inserisci le didascalie. Se hai bisogno che il testo sia permanentemente parte dell’immagine anziché un sidecar attivabile, si tratta di un passaggio di codifica separato. HandBrake può masterizzare un SRT in un video gratuitamente: carica il video, aggiungi l’SRT nella scheda Sottotitoli, seleziona “Burned In” e codifica. Raggiungi questo obiettivo solo quando la destinazione non può leggere un file sidecar, poiché un SRT separato rimane modificabile mentre una didascalia incorporata no. Per una procedura dettagliata più completa su come allegare e masterizzare i sottotitoli su ciascuna piattaforma, vedi come aggiungere sottotitoli a un video.

Problemi comuni e come risolverli

I sottotitoli non sono sincronizzati fin dall’inizio. Uno scostamento costante, in cui ogni riga è in anticipo o in ritardo nella stessa misura, in genere significa che il giocatore sta leggendo un frame rate leggermente diverso da quello presupposto dai tempi. La maggior parte dei lettori desktop dispone di un controllo del ritardo dei sottotitoli per spostare l’intera traccia contemporaneamente; spostalo finché non si ferma la prima riga e il resto segue.

La sincronizzazione si allontana ulteriormente nel tempo. La deriva che cresce durante la riproduzione del video indica una mancata corrispondenza del frame rate tra la sorgente e la copia renderizzata, comune dopo aver convertito un file da 23,976 fps a 25 fps o indietro. Riesporta l’SRT rispetto alla versione del video che pubblicherai effettivamente, anziché un taglio precedente.

Il nome di un relatore manca dai sottotitoli. Se hai rinominato le etichette ma una piattaforma non mostra nomi, è probabile che quella piattaforma rimuova i prefissi dei parlanti da SRT durante l’importazione. Non esiste alcuna impostazione SRT che li obblighi; la soluzione affidabile è masterizzare i sottotitoli, dove i nomi fanno parte dell’immagine.

Un video non in inglese è tornato nella lingua sbagliata. Hushscript rileva automaticamente la lingua parlata in circa 99 lingue, ma una clip molto breve o rumorosa può occasionalmente essere interpretata erroneamente. Esegui nuovamente una sezione più pulita o controlla la pagina delle lingue per confermare che la lingua sia coperta.

Lunghi tratti vengono letti come un unico segnale gigante. Ciò accade quando qualcuno parla a lungo senza una pausa chiara. Dividi manualmente il segnale al limite della frase in modo che nessun singolo blocco contenga più di due righe di testo leggibile.

Suggerimenti per la precisione che ripagano con meno modifiche

La maggior parte della qualità dei sottotitoli viene impostata prima di aprire l’editor, dall’audio che inserisci. L’audio sorgente pulito significa meno parole mal comprese e timestamp più precisi, il che significa una modifica più breve passare.

Registra o esporta l’audio a un livello di conversazione normale senza compressione eccessiva ed evita, ove possibile, la musica di sottofondo ad alto volume durante i dialoghi. Quando sono coinvolte più persone, una registrazione in cui ogni voce è ragionevolmente distinta aiuta le etichette dei parlanti a rimanere coerenti, il che è importante se prevedi di mantenere i nomi nelle didascalie. Se la fonte è un video che hai già pubblicato, l’audio è quello che è, ma per tutto ciò che registri tu stesso, qualche minuto di attenzione ai livelli e al posizionamento del microfono fa di più per la qualità dei sottotitoli rispetto a qualsiasi quantità di editing successivo.

Dopo l’SRT: il resto della trascrizione

Creando l’SRT ti viene fornita anche la trascrizione completa, quindi non sei limitato ai sottotitoli. Dalla stessa sessione puoi esportare il testo come TXT o DOCX per note dell’episodio, una versione blog del discorso o una trascrizione accessibile pubblicata accanto al video. Esportare una trascrizione pulita equivale a sottotitolare un video in testo; l’SRT è solo uno dei formati che ne derivano.

Per il passaggio successivo, inserire queste didascalie nel video e scegliere tra un file sidecar e una traccia masterizzata, vedere come aggiungere i sottotitoli a un video.

Fonti e standard indipendenti

Hushscript ha consultato queste fonti indipendenti e non concorrenti. Illustrano ricerche, standard o il funzionamento delle piattaforme e non implicano un sostegno a Hushscript.

Fonti verificate il:

Domande frequenti

Cos'è un file SRT?

An Il file SRT (SubRip Text) è un file di testo semplice che abbina segnali numerati con temporizzazione e testo. Ogni blocco ha un indice, un timestamp di inizio e fine scritto come HH:MM:SS,mmm e testo dei sottotitoli. Il supporto è ampio, ma controlla i formati dei sottotitoli accettati dalla destinazione prima della pubblicazione.

Come posso creare un file SRT da un video?

Trascrivere l'audio del video, quindi esportare la trascrizione come SRT. In Hushscript trascini il video per ottenere un'anteprima gratuita di 30 secondi, iscriviti per trascrivere il resto, quindi scegli SRT all'esportazione. Ogni riga parlata diventa un segnale con l'ora di inizio e di fine già compilata, quindi non devi mai digitare un timestamp a mano.

Qual ​​è la lunghezza ideale della riga e la velocità di lettura per i sottotitoli?

Non esiste un numero universale perché le guide alle destinazioni differiscono. Mantieni le battute compatte, interrompi le linee ai confini naturali della frase e testale alla dimensione del fotogramma finale e alla velocità di riproduzione. Segui le specifiche attuali della destinazione quando ne fornisce una.

Il mio file video viene caricato su un server?

No. Hushscript estrae l'audio dal video nel tuo browser prima che venga inviato qualsiasi cosa, quindi il video stesso rimane sul tuo dispositivo e solo il file audio più piccolo raggiunge il server. L'audio viene eliminato una volta che la trascrizione è pronta.

Posso includere i nomi dei relatori nell'SRT?

Sì. Rinomina l'etichetta di ogni relatore nell'editor di trascrizione prima dell'esportazione e tali nomi verranno visualizzati all'inizio dei segnali rilevanti. Tieni presente che alcune piattaforme rimuovono i prefissi dei parlanti da SRT durante l'importazione, quindi se i nomi devono rimanere visibili, considera invece l'idea di masterizzare i sottotitoli nel video.

Qual ​​è la differenza tra SRT e VTT?

Entrambi contengono testo temporizzato. WebVTT aggiunge una riga di intestazione WebVTT, utilizza un punto anziché una virgola nei timestamp e supporta le impostazioni dei web cue. Utilizza VTT per le tracce HTML5 native; utilizzare SRT quando la destinazione lo accetta esplicitamente. Puoi convertire senza ritrascrivere.

Quanto è grande il sottotitolo di un video?

Fino a 10 ore di durata, senza limiti di dimensione del file: anche un video molto grande viene convertito lato client, in base alla capacità del browser e del dispositivo. Poiché l'audio viene estratto prima del caricamento, un video di grandi dimensioni invia molti meno dati rispetto alla dimensione intera del file.

Quanto sono accurati i timestamp?

Ogni segnale viene generato dai tempi del motore vocale, ma non è garantito alcun offset fisso. Rivedi il video finale, in particolare i dialoghi veloci, la musica e i parlanti sovrapposti, e regola eventuali segnali visualizzati in anticipo o in ritardo.

Inizia con 30 minuti gratuiti

Inizia – 30 minuti gratuiti