Identificação de falantes na transcrição – speaker diarization automático
O Hushscript separa automaticamente cada falante – o que a área chama de speaker diarization – e identifica quem disse o quê. Está incluído de graça, não bloqueado atrás de um plano pago.
Solte um arquivo de áudio ou vídeo para visualizar uma transcrição
Primeiros 30 segundos · grátis · sem conta · seu arquivo fica no navegador
Ou cole um link direto de áudio. Links de compartilhamento do Dropbox, Google Drive e OneDrive também funcionam. Como funciona a importação por link
Verifique seu e-mail para fazer login e depois adicione seu arquivo para transcrevê-lo.
Como funciona
- 01
Envie uma gravação com vários falantes
Qualquer formato de áudio ou vídeo – é só soltar e nós convertemos e transcrevemos, até 10 horas, sem limite de tamanho de arquivo. Arquivos grandes são preparados no navegador.
- 02
Separamos e identificamos cada voz
O speaker diarization roda automaticamente. Sem etapa extra, sem custo adicional.
- 03
Renomeie os falantes e exporte
Mude 'Falante 1' para um nome real em toda a transcrição com um clique. Exporte em 21 formatos, além de arquivos protegidos por senha.
O que é speaker diarization?
O speaker diarization identifica quem falou quando. Em vez de um bloco de texto, você recebe uma transcrição dividida por falante – a diferença entre algo que você precisa desembaraçar e algo que você pode simplesmente ler. Sem isso, uma entrevista de 45 minutos é lida como um parágrafo só; com isso, cada linha é atribuída, e você vai direto ao que uma pessoa disse.
Como a identificação automática de falantes funciona
O Hushscript separa as vozes de uma gravação e identifica cada uma automaticamente, sem nenhum botão para procurar e sem etapa extra. Entrevistas voltam atribuídas a entrevistador e entrevistado; reuniões voltam atribuídas a cada participante; podcasts com vários convidados mantêm cada voz distinta. A mesma voz mantém a mesma identificação do primeiro ao último minuto, mesmo em uma gravação longa, então você nunca precisa adivinhar se o “Falante 2” perto do final é a mesma pessoa que o “Falante 2” do início.
Renomeie, marque e corrija falantes
A primeira identificação raramente é a definitiva. Renomeie “Falante 1” para um nome real e a mudança se aplica a toda a transcrição em uma única edição, sem precisar caçar cada ocorrência manualmente. Marque trechos que você vai querer encontrar depois e, se o speaker diarization dividir ou combinar dois falantes por engano, use buscar e substituir para corrigir as linhas erradas em toda a transcrição de uma vez, em vez de ajustar uma por uma. Uma entrevista de 40 minutos com um falante mal identificado por dois minutos no meio é um buscar/substituir e uma renomeação, não um novo envio – o editor foi feito para esse tipo de correção rápida, não para uma nova transcrição completa.
Multicanal: quando os falantes já vêm separados
Algumas gravações chegam pré-separadas, como um gravador de chamadas que coloca cada lado da linha em seu próprio canal de áudio. Ative o multicanal e o Hushscript usa esses canais diretamente para separar os falantes, em vez de inferir quem está falando só pelo áudio – o que funciona melhor quando os canais já estão isolados. Isso é mais comum em gravações de chamadas, algumas plataformas de webinar e gravadores de entrevista dedicados que já dão uma linha própria a cada participante. É uma opção, não uma obrigação: deixe desativado para uma gravação normal de faixa única, e o speaker diarization automático assume como de costume.
Os nomes dos falantes seguem para o resto do fluxo de trabalho
As identificações de falantes, renomeadas ou não, passam por gravações mescladas, pelo editor, pelas legendas, pelos documentos e por todos os formatos de exportação, então o resultado continua legível muito além da primeira passada. Renomeie uma vez, no nível da transcrição, e uma divisão em capítulos, uma citação retirada ou um arquivo de legenda concordam sobre quem é quem, sem trabalho extra. Ao escolher Gerar Insights, uma execução opcional e gratuita cria o resultado completo vinculado à revisão atual da transcrição: resumos, ações, decisões, perguntas em aberto, citações, capítulos, tópicos por participante, grupos de assuntos, sugestões de exportação, achados de terminologia e linguagem imprópria, e sugestões de limpeza. Revise a limpeza em Editar e aplique somente as mudanças que aprovar.
Por que não cobramos por isso
Muitas ferramentas colocam a separação de falantes atrás de um plano pago ou limitam o número de falantes. Nós não fazemos isso – está de graça em toda transcrição, porque uma transcrição sem isso é apenas metade do útil. Você paga pela transcrição em si; a identificação de falantes vem junto, sem custo extra.
Ótimo para entrevistas, reuniões e podcasts
Em qualquer lugar onde mais de uma pessoa fala, a identificação de falantes faz o trabalho pesado. Uma entrevista individual volta como um diálogo limpo entre entrevistador e entrevistado, em vez de um bloco de texto que você mesmo teria que atribuir. Uma reunião com cinco participantes é lida como cinco vozes distintas, então você sabe quem se comprometeu com o quê. Um episódio de podcast com vários convidados mantém cada um separado mesmo em uma hora de falas sobrepostas, o que importa quando você for tirar uma citação para as notas do programa depois. → Podcasts · Áudio para texto
Privado por design
Seu áudio é excluído assim que a transcrição fica pronta. As transcrições são criptografadas em repouso – um vazamento de dados exporia apenas texto cifrado, não suas palavras.
Por que Hushscript
Incluído de graça
Identificação de falantes em toda transcrição – não é um plano pago.
Renomeie com um clique
Renomeie qualquer falante em toda a transcrição instantaneamente.
Sem limite de falantes
Vários falantes são separados sem custo adicional pelo número.
Perguntas frequentes
O que é speaker diarization?
É o processo que identifica quem falou quando, e divide uma gravação em falantes separados – para que uma transcrição seja lida como uma conversa identificada, não um bloco de texto.
Quantos falantes ele consegue separar?
Vários falantes em uma gravação são separados automaticamente; não há limite pago de falantes.
Posso renomear, marcar ou corrigir um rótulo de falante?
Sim. Renomeie 'Falante 1' para um nome real em toda a transcrição com um clique, marque trechos para encontrar depois e use buscar/substituir se o speaker diarization identificar uma linha errada – tudo no editor.
O que é o modo multicanal?
É para gravações que já separam cada falante em seu próprio canal de áudio, como alguns gravadores de chamada. Ative e o speaker diarization usa os canais diretamente, em vez de inferir os falantes a partir do áudio.
Tem custo extra?
Não – a identificação de falantes é gratuita em toda transcrição. Você paga pela transcrição em si, não pela identificação: 30 minutos grátis ao verificar um cartão (reserva de $1, liberada imediatamente, nunca cobrada), depois pague conforme usa.
Meu áudio é guardado após a transcrição?
Não – é excluído no momento em que sua transcrição fica pronta. As transcrições são criptografadas em repouso, então um vazamento de dados exporia apenas texto cifrado ilegível.
Comece com 30 minutos grátis
Começar – 30 minutos grátis