Hear2Text
Identification des locuteurs

Transcription audio en texte avec identification des locuteurs

Importez une réunion, une interview ou un podcast : Hear2Text transcrit l'audio en texte et indique le locuteur de chaque ligne, Locuteur 1, Locuteur 2 et ainsi de suite, sans limite de nombre, sur tous les plans. Le renommage et la fusion des locuteurs, ainsi que leur ajout à vos exports, sont inclus dans les plans payants Mensuel et Annuel.

Une étiquette par voix, du début à la fin

Tout l'enregistrement est transcrit en une seule passe : la voix qui est Locuteur 2 à la première minute est toujours Locuteur 2 une heure plus tard. Chaque ligne de la transcription porte son locuteur et un horodatage ; cliquez sur une ligne et le lecteur saute à ce moment pour vérifier qui l'a vraiment dite. Sur les plans payants, vous pouvez donner un vrai nom à une étiquette et fusionner deux étiquettes qui désignent la même personne ; déplacer n'importe quelle ligne vers un autre locuteur quand le modèle s'est trompé fonctionne sur tous les plans.

Commencer

Voyez comment la parole a été partagée

Un panneau des locuteurs montre la part de chacun dans l'enregistrement : vous voyez d'un coup d'œil si l'intervieweur a plus parlé que l'invité ou si une voix a dominé la réunion. Hear2Text distingue les voix au sein d'un seul enregistrement ; il ne mémorise pas les voix d'un enregistrement à l'autre et ne reconnaît pas qui parle, les noms sont donc toujours à ajouter par vous.

Commencer

Un audio à plusieurs voix, avec et sans identification des locuteurs

FonctionSansAvec Hear2Text
Réunions à plusieursUn long bloc de texte sans savoir qui a dit quoiChaque ligne marquée Locuteur 1, Locuteur 2, etc.
Transcription d'interviewsQuestions et réponses mélangéesIntervieweur et invité sur des étiquettes séparées et renommables
Préparer un épisode de podcastRéécouter l'épisode pour distinguer l'animateur de l'invitéUn panneau qui montre le temps de parole de chacun
Retrouver une citationParcourir l'audio à l'oreilleCherchez dans la transcription, cliquez sur la ligne, écoutez-la

Cas d'usage

  • Réunions d'équipe

    Voyez qui a soulevé chaque point et qui s'est engagé à quoi. Donnez à chaque locuteur le nom d'un collègue et cliquez sur une ligne pour la réécouter avant de rédiger le compte rendu.

  • Interviews et podcasts

    Séparez animateur et invité pour extraire des citations et préparer la description de l'épisode sans le réécouter. Le panneau des locuteurs montre le temps de parole de chacun.

  • Entretiens de recherche et focus groups

    Séparez les participants d'une séance de groupe et revoyez ce que chacun a dit. Avec beaucoup de voix proches sur un seul micro, prévoyez de corriger quelques lignes à la main.

Comment fonctionne l'identification des locuteurs

Vous importez un fichier ou collez un lien public. L'enregistrement est transcrit et séparé par voix en une seule passe, puis vous ajustez les étiquettes dans le navigateur. Aucun réglage, aucun échantillon de voix, aucune langue à choisir.

  1. Étape 01

    Importez l'enregistrement

    Importez un audio ou une vidéo jusqu'à 500 Mo et 6 heures, ou collez un lien public YouTube, Vimeo ou de partage d'enregistrement cloud Zoom. La langue est détectée automatiquement.

  2. Étape 02

    Les voix sont séparées

    Tout l'enregistrement est analysé d'un coup : les changements de locuteur sont repérés et chaque voix garde la même étiquette jusqu'au bout.

  3. Étape 03

    Les lignes reçoivent une étiquette

    Chaque ligne est marquée Locuteur 1, Locuteur 2, etc., avec son horodatage. S'il n'y a qu'une voix, l'étiquette est masquée.

  4. Étape 04

    Renommez et corrigez

    Sur les plans payants, donnez leurs vrais noms aux locuteurs et fusionnez les étiquettes en double. Déplacer n'importe quelle ligne vers la bonne personne fonctionne sur tous les plans.

Fonctionnalités clés

  • Détection automatique des locuteurs

    Les locuteurs sont détectés à partir de l'audio lui-même. Rien à baliser, pas d'échantillon de voix, pas de nombre de locuteurs à saisir.

  • Renommer et fusionner les locuteurs

    Sur les plans payants, transformez Locuteur 1 en « Anna » en une étape, et fusionnez deux étiquettes qui désignent la même personne.

  • Cohérent sur tout l'enregistrement

    Une seule passe sur tout le fichier garde chaque voix sur la même étiquette, de la première à la dernière minute.

  • Autant de locuteurs que nécessaire

    Pas de limite de locuteurs : interviews à deux, réunions d'équipe et tables rondes fonctionnent. Un son clair donne la meilleure séparation.

  • Corrigez les lignes à la main

    Les chevauchements et les voix proches causent des erreurs. Déplacez n'importe quelle ligne vers un autre locuteur et corrigez le texte dans le navigateur.

  • Les locuteurs dans vos téléchargements

    Sur les plans payants, choisissez d'ajouter les locuteurs au moment du téléchargement : TXT, Word et PDF font apparaître le nom du locuteur au début de chaque prise de parole, et SRT et VTT l'ajoutent avant chaque sous-titre.

Questions fréquentes

Combien de locuteurs peut-il identifier ?
Il n'y a pas de limite fixe. Hear2Text étiquette autant de voix distinctes qu'il en trouve, Locuteur 1, Locuteur 2, Locuteur 3 et ainsi de suite, qu'il s'agisse d'un appel à deux ou d'une table ronde de huit personnes. Plus il y a de voix proches, plus la séparation est difficile : un grand groupe enregistré sur un seul micro peut demander de déplacer quelques lignes à la main. Quand une seule personne parle, l'étiquette est masquée.
Faut-il enregistrer les locuteurs ou fournir des échantillons de voix avant ?
Non. Pas d'inscription préalable ni d'échantillon de voix à enregistrer. Les locuteurs sont distingués à partir de l'enregistrement lui-même : importez le fichier ou collez un lien public, et la transcription arrive avec ses étiquettes. Hear2Text ne sait pas qui est qui, il les nomme donc Locuteur 1, Locuteur 2, etc. ; sur les plans payants, vous pouvez les renommer ensuite.
L'identification des locuteurs est-elle fiable ?
C'est fiable sur des enregistrements clairs où chacun parle à son tour avec son propre micro. La précision baisse quand les personnes parlent en même temps, quand tout le monde partage un micro éloigné, ou quand deux voix se ressemblent. Les erreurs prennent souvent la forme d'une courte ligne attribuée à la mauvaise personne ; vous pouvez déplacer toute ligne vers le bon locuteur ou fusionner deux étiquettes dans le navigateur.
Peut-on renommer les locuteurs avec leurs vrais noms ?
Oui, sur les plans payants. Renommez Locuteur 1 en « Anna » et toutes ses lignes changent d'un coup. Si une même personne a été répartie sur deux étiquettes, fusionnez-les. Les noms se retrouvent aussi dans vos téléchargements : choisissez d'ajouter les locuteurs au moment de l'export, et TXT, Word, PDF, SRT et VTT les afficheront tous.
Que se passe-t-il quand plusieurs personnes parlent en même temps ?
Les paroles qui se chevauchent sont le cas le plus difficile. Chaque segment reçoit un seul locuteur : quand deux personnes parlent en même temps, la ligne va à celle qui domine, et une brève intervention peut être manquée ou attribuée à la mauvaise personne. Ces chevauchements baissent aussi la précision de la transcription. Vous pouvez corriger ensuite en modifiant le texte et en déplaçant les lignes vers le bon locuteur dans le navigateur.
Est-ce que ça marche avec un enregistrement d'appel téléphonique ?
Oui, si vous avez l'enregistrement sous forme de fichier. Importez-le (jusqu'à 500 Mo et 6 heures, en MP3, M4A, WAV ou la plupart des autres formats) et les deux interlocuteurs sont étiquetés. Le son téléphonique est étroit et compressé, la séparation est donc moins bonne qu'avec un son de studio, surtout si les deux voix se ressemblent. Hear2Text n'enregistre pas les appels lui-même et aucun robot ne rejoint Zoom, Teams ou Meet.

Identifiez les locuteurs de votre prochain enregistrement

Importez une réunion, une interview ou un podcast et obtenez une transcription où chaque ligne indique qui parle, sur tous les plans. Nommer les locuteurs et les ajouter à vos exports fait partie des plans Mensuel (9,99 $US) et Annuel (89,99 $US), qui incluent aussi des minutes de transcription illimitées.