Hear2Text
Identificación de hablantes

Transcribir audio a texto identificando hablantes

Sube una reunión, una entrevista o un podcast y Hear2Text etiqueta cada línea con su hablante: Hablante 1, Hablante 2, etc., sin límite de voces, en todos los planes. Renombrar y unir hablantes, y añadirlos a tus exportaciones, forma parte de los planes de pago Mensual y Anual.

Una etiqueta por voz, de principio a fin

La grabación completa se transcribe de una sola pasada, así que la voz etiquetada como Hablante 2 en el primer minuto sigue siendo Hablante 2 una hora después. Cada línea de la transcripción lleva su hablante y su marca de tiempo; haz clic en una línea y el reproductor salta a ese momento para comprobar quién lo dijo en realidad. En los planes de pago puedes cambiar una etiqueta por un nombre real y unir dos etiquetas que resultaron ser la misma persona; pasar una línea a otro hablante cuando el modelo se equivocó funciona en todos los planes.

Comenzar

Mira cómo se repartió la conversación

Un panel de hablantes muestra la participación de cada persona en la grabación, para que veas de un vistazo si el entrevistador habló más que el invitado o si una voz dominó la reunión. Hear2Text distingue voces solo dentro de una misma grabación; no recuerda voces entre grabaciones ni reconoce quién es alguien, así que los nombres siempre los pones tú.

Comenzar

Audio con varias voces, con y sin etiquetas de hablante

FunciónSinCon Hear2Text
Reuniones con varias personasUn bloque largo de texto sin pista de quién dijo quéCada línea marcada como Hablante 1, Hablante 2, etc.
Transcripciones de entrevistasPreguntas y respuestas mezcladasEntrevistador e invitado en etiquetas separadas que puedes renombrar
Notas de un episodio de podcastVolver a escuchar el episodio para distinguir al conductor del invitadoUn panel con la participación de cada hablante en el episodio
Encontrar una citaRecorrer el audio de oídoBuscas en la transcripción, haces clic en la línea y la escuchas

Casos de uso

  • Reuniones de equipo

    Mira quién planteó cada punto y quién se comprometió a qué. Cambia los hablantes por los nombres de tus colegas y haz clic en una línea para volver a escucharla antes de redactar la minuta.

  • Entrevistas y podcasts

    Mantén separados al conductor y al invitado para sacar citas y escribir las notas del episodio sin volver a escucharlo. El panel de hablantes muestra cuánto habló cada persona.

  • Entrevistas de investigación y grupos focales

    Separa a los participantes de una sesión grupal y revisa lo que dijo cada uno. Con muchas voces parecidas en un solo micrófono, cuenta con corregir algunas líneas a mano.

Cómo funciona la identificación de hablantes

Subes un archivo o pegas un enlace público. La grabación se transcribe y se separa por voces de una sola pasada, y luego ordenas las etiquetas en el navegador. Sin configuración, sin muestras de voz, sin elegir idioma.

  1. Paso 01

    Sube la grabación

    Sube audio o video de hasta 500 MB y 6 horas, o pega un enlace público de YouTube, Vimeo o de una grabación en la nube de Zoom. El idioma se detecta solo.

  2. Paso 02

    Se separan las voces

    Toda la grabación se analiza de una vez, así que se detectan los cambios de turno y cada voz conserva la misma etiqueta de principio a fin.

  3. Paso 03

    Las líneas reciben etiquetas de hablante

    Cada línea queda marcada como Hablante 1, Hablante 2, etc., con su marca de tiempo. Si hay una sola voz, la etiqueta se oculta.

  4. Paso 04

    Renombra y corrige

    En los planes de pago, cambia los hablantes por nombres reales y une etiquetas duplicadas. Pasar una línea a la persona correcta funciona en todos los planes.

Funciones clave

  • Detección automática de hablantes

    Los hablantes se detectan a partir del propio audio. Nada que marcar, sin muestras de voz, sin indicar antes cuántos hablantes hay.

  • Renombra y une hablantes

    En los planes de pago, convierte Hablante 1 en "Ana" en un paso y une dos etiquetas que pertenecen a la misma persona.

  • Coherente en toda la grabación

    Una sola pasada por todo el archivo mantiene cada voz con la misma etiqueta del primer minuto al último.

  • Cualquier número de hablantes

    Sin límite de hablantes: entrevistas de dos personas, reuniones de equipo y paneles. El audio claro es el que mejor se separa.

  • Corrige líneas a mano

    Las voces encimadas y parecidas causan errores. Pasa cualquier línea a otro hablante y edita el texto en el navegador.

  • Hablantes en tus descargas

    En los planes de pago, elige añadir los hablantes al descargar: TXT, Word y PDF abren cada turno con el nombre del hablante, y SRT y VTT lo ponen delante de cada subtítulo.

Preguntas frecuentes

¿Cuántos hablantes puede identificar?
No hay un límite fijo. Hear2Text etiqueta todas las voces distintas que encuentra, Hablante 1, Hablante 2, Hablante 3 y así en adelante, ya sea una llamada entre dos personas o un panel de ocho. Muchos hablantes con voces parecidas complican la separación, así que un grupo grande grabado con un solo micrófono puede requerir mover algunas líneas a mano. Si solo habla una persona, la etiqueta se oculta.
¿Tengo que registrar a los hablantes o subir muestras de voz antes?
No. No hay registro previo ni muestras de voz que grabar. Los hablantes se distinguen a partir de la propia grabación, así que solo subes el archivo o pegas un enlace público y la transcripción llega con etiquetas. Hear2Text no sabe quién es cada persona, así que las llama Hablante 1, Hablante 2, etc.; en los planes de pago puedes renombrarlas después.
¿Qué tan precisa es la identificación de hablantes?
Es fiable en grabaciones claras donde la gente habla por turnos y cada quien tiene su propio micrófono. La precisión baja cuando las personas hablan a la vez, cuando todos comparten un micrófono lejano o cuando dos voces se parecen. Los errores suelen ser una línea corta asignada a la persona equivocada, y en el navegador puedes pasar cualquier línea al hablante correcto o unir dos etiquetas.
¿Puedo cambiar los hablantes por nombres reales?
Sí, en los planes de pago. Cambia Hablante 1 por "Ana" y todas sus líneas se actualizan a la vez. Si una misma persona quedó repartida en dos etiquetas, únelas. Los nombres también pasan a tus descargas: elige añadir los hablantes al exportar, y TXT, Word, PDF, SRT y VTT los mostrarán todos.
¿Qué pasa cuando varias personas hablan a la vez?
Las voces encimadas son el caso más difícil. Cada segmento tiene un solo hablante, así que cuando dos personas hablan a la vez la línea va para quien domina, y una interrupción breve puede perderse o asignarse a la persona equivocada. Hablar encima también baja la precisión de la transcripción. Puedes arreglarlo después editando el texto y moviendo líneas al hablante correcto en el navegador.
¿Funciona con grabaciones de llamadas telefónicas?
Sí, si tienes la grabación como archivo. Súbela (hasta 500 MB y 6 horas, en MP3, M4A, WAV o casi cualquier otro formato) y se etiquetan los dos lados. El audio telefónico es estrecho y comprimido, así que la separación es más débil que con audio de estudio, sobre todo si las dos voces se parecen. Hear2Text no graba llamadas y ningún bot entra a Zoom, Teams o Meet.

Identifica a los hablantes de tu próxima grabación

Sube una reunión, una entrevista o un podcast y recibe una transcripción con cada línea etiquetada por hablante, en todos los planes. Ponerles nombre a los hablantes y añadirlos a tus exportaciones forma parte de los planes Mensual (9,99 US$) y Anual (89,99 US$), que también incluyen minutos de transcripción ilimitados.