Hear2Text
Identificação de falantes

Transcrição de áudio com identificação de falantes

Envie uma reunião, entrevista ou podcast e o Hear2Text marca cada linha com o falante: Falante 1, Falante 2 e assim por diante, sem limite de pessoas, em todos os planos. Renomear e juntar falantes, e levar os nomes para as suas exportações, fazem parte dos planos pagos Mensal e Anual.

Um rótulo por voz, do começo ao fim

A gravação inteira é transcrita de uma vez, então a voz que é Falante 2 no primeiro minuto continua sendo Falante 2 uma hora depois. Cada linha da transcrição traz o falante e a marca de tempo; clique nela e o player pula para aquele momento, para você conferir quem realmente falou. Nos planos pagos você pode renomear um rótulo com um nome real e juntar dois rótulos que eram a mesma pessoa; mover uma linha para outro falante, quando o modelo errar, funciona em todos os planos.

Começar

Veja como a conversa foi dividida

Um painel de falantes mostra a participação de cada pessoa na gravação, para você ver de relance se o entrevistador falou mais que o convidado ou se uma voz dominou a reunião. O Hear2Text separa vozes apenas dentro de uma mesma gravação; ele não lembra vozes entre gravações nem reconhece quem é a pessoa, então os nomes sempre ficam por sua conta.

Começar

Áudio com várias pessoas, com e sem identificação de falantes

FuncionamentoSemCom Hear2Text
Reuniões com várias pessoasUm bloco enorme de texto sem pista de quem disse o quêCada linha marcada como Falante 1, Falante 2 e assim por diante
Transcrição de entrevistasPerguntas e respostas misturadasEntrevistador e convidado em rótulos separados, que você pode renomear
Notas de episódio de podcastOuvir o episódio de novo para separar apresentador e convidadoUm painel com a participação de cada falante no episódio
Encontrar uma citaçãoProcurar no áudio de ouvidoBusque na transcrição, clique na linha e ouça o trecho

Casos de uso

  • Reuniões de equipe

    Veja quem levantou cada ponto e quem concordou com o quê. Renomeie os falantes com os nomes dos colegas e clique em uma linha para ouvi-la de novo antes de escrever a ata.

  • Entrevistas e podcasts

    Mantenha apresentador e convidado separados para tirar citações e escrever as notas do episódio sem ouvir tudo de novo. O painel de falantes mostra quanto cada pessoa falou.

  • Entrevistas de pesquisa e grupos focais

    Separe os participantes de uma sessão em grupo e revise o que cada um disse. Com muitas vozes parecidas em um só microfone, conte em corrigir algumas linhas à mão.

Como funciona a identificação de falantes

Você envia um arquivo ou cola um link público. A gravação é transcrita e separada por voz de uma só vez, e depois você ajusta os rótulos no navegador. Sem configuração, sem amostras de voz, sem escolher idioma.

  1. Passo 01

    Envie a gravação

    Envie áudio ou vídeo de até 500 MB e 6 horas, ou cole um link público do YouTube, Vimeo ou de uma gravação na nuvem do Zoom. O idioma é detectado automaticamente.

  2. Passo 02

    As vozes são separadas

    A gravação inteira é analisada de uma vez, então as trocas entre falantes são encontradas e cada voz mantém o mesmo rótulo do começo ao fim.

  3. Passo 03

    As linhas recebem rótulos de falante

    Cada linha é marcada como Falante 1, Falante 2 e assim por diante, com sua marca de tempo. Com uma só voz, o rótulo fica oculto.

  4. Passo 04

    Renomeie e corrija

    Nos planos pagos, renomeie os falantes com nomes reais e junte rótulos duplicados. Mover uma linha para a pessoa certa funciona em todos os planos.

Funcionalidades principais

  • Detecção automática de falantes

    Os falantes são detectados a partir do próprio áudio. Nada para marcar, sem amostras de voz, sem informar antes quantas pessoas falam.

  • Renomeie e junte falantes

    Nos planos pagos, transforme Falante 1 em "Ana" em um passo e junte dois rótulos que são da mesma pessoa.

  • Consistente em toda a gravação

    Uma única análise do arquivo inteiro mantém cada voz no mesmo rótulo do primeiro ao último minuto.

  • Qualquer número de falantes

    Sem limite de falantes: entrevistas a dois, reuniões de equipe e painéis funcionam. Áudio limpo separa melhor.

  • Corrija linhas à mão

    Falas sobrepostas e vozes parecidas causam erros. Mova qualquer linha para outro falante e edite o texto no navegador.

  • Falantes nos seus downloads

    Nos planos pagos, escolha incluir os falantes na hora de baixar: o TXT, o Word e o PDF abrem cada fala com o nome do falante, e o SRT e o VTT trazem o nome antes de cada legenda.

Perguntas frequentes

Quantos falantes ele consegue identificar?
Não há limite fixo. O Hear2Text rotula quantas vozes diferentes encontrar, Falante 1, Falante 2, Falante 3 e assim por diante, seja uma ligação entre duas pessoas ou um painel com oito. Mais falantes com vozes parecidas dificultam a separação, então um grupo grande gravado em um único microfone pode exigir mover algumas linhas à mão. Quando só uma pessoa fala, o rótulo fica oculto.
Preciso cadastrar os falantes ou enviar amostras de voz antes?
Não. Não há cadastro prévio nem amostras de voz para gravar. Os falantes são separados a partir da própria gravação, então basta enviar o arquivo ou colar um link público, e a transcrição chega com os rótulos. O Hear2Text não sabe quem é cada pessoa, por isso usa Falante 1, Falante 2 e assim por diante; nos planos pagos você pode renomear depois.
A identificação de falantes é precisa?
É confiável em gravações claras, em que as pessoas falam uma de cada vez e cada uma tem seu microfone. A precisão cai quando as pessoas falam ao mesmo tempo, quando todos dividem um microfone distante ou quando duas vozes são parecidas. Os erros costumam aparecer como uma linha curta atribuída à pessoa errada, e você pode mover qualquer linha para o falante certo ou juntar dois rótulos no navegador.
Posso renomear os falantes com nomes reais?
Sim, nos planos pagos. Renomeie Falante 1 para "Ana" e todas as linhas dela mudam de uma vez. Se uma pessoa foi dividida em dois rótulos, junte os dois. Os nomes também vão para os seus downloads: escolha incluir os falantes na hora de exportar, e TXT, Word, PDF, SRT e VTT mostram os nomes.
O que acontece quando as pessoas falam ao mesmo tempo?
Falas sobrepostas são o caso mais difícil. Cada segmento recebe um único falante, então quando duas pessoas falam juntas a linha vai para quem predomina, e uma interrupção rápida pode passar batido ou ir para a pessoa errada. Muita sobreposição também reduz a precisão da transcrição. Você pode corrigir depois, editando o texto e movendo as linhas para o falante certo no navegador.
Funciona com gravação de ligação telefônica?
Sim, se você tiver a gravação em arquivo. Envie (até 500 MB e 6 horas, em MP3, M4A, WAV ou na maioria dos outros formatos) e os dois lados são identificados. O áudio de telefone é estreito e comprimido, então a separação é mais fraca do que com áudio de estúdio, principalmente se as vozes forem parecidas. O Hear2Text não grava ligações e nenhum bot entra no Zoom, Teams ou Meet.

Identifique os falantes da sua próxima gravação

Envie uma reunião, entrevista ou podcast e receba a transcrição com cada linha marcada pelo falante, em todos os planos. Nomear os falantes e levar os nomes para as suas exportações fazem parte dos planos Mensal (9,99 US$) e Anual (89,99 US$), que também incluem minutos de transcrição ilimitados.