Hear2Text
Identyfikacja mówców

Transkrypcja nagrania z podziałem na mówców

Prześlij spotkanie, wywiad lub podcast, a Hear2Text oznaczy każdą linijkę mówcą: Mówca 1, Mówca 2 i tak dalej, bez limitu osób, w każdym planie. Zmiana nazw i łączenie mówców, a także dodawanie ich do eksportu, jest w płatnym planie miesięcznym i rocznym.

Jedno oznaczenie na głos, od początku do końca

Całe nagranie jest transkrybowane za jednym razem, więc głos, który w pierwszej minucie jest Mówcą 2, godzinę później nadal jest Mówcą 2. Każda linijka transkrypcji ma mówcę i znacznik czasu; kliknij ją, a odtwarzacz przeskoczy do tego momentu, żebyś sprawdził, kto naprawdę to powiedział. W płatnych planach zmienisz oznaczenie na prawdziwe imię i połączysz dwa oznaczenia tej samej osoby; przeniesienie dowolnej linijki do innego mówcy, gdy model się pomylił, działa w każdym planie.

Rozpocznij

Zobacz, jak rozłożyła się rozmowa

Panel mówców pokazuje udział każdej osoby w nagraniu, więc od razu widzisz, czy prowadzący mówił więcej niż gość albo czy jeden głos zdominował spotkanie. Hear2Text rozróżnia głosy tylko w obrębie jednego nagrania; nie pamięta głosów między nagraniami i nie rozpoznaje, kim ktoś jest, więc imiona zawsze dodajesz ty.

Rozpocznij

Nagranie kilku osób z oznaczeniami mówców i bez nich

FunkcjaBezZ Hear2Text
Spotkania kilku osóbJeden długi blok tekstu bez wskazówki, kto co powiedziałKażda linijka oznaczona jako Mówca 1, Mówca 2 i tak dalej
Transkrypcja wywiaduPytania i odpowiedzi zlewają się w jednoProwadzący i gość pod osobnymi oznaczeniami, które możesz nazwać
Opis odcinka podcastuOdsłuchujesz odcinek, by odróżnić prowadzącego od gościaPanel pokazujący udział każdego mówcy w odcinku
Szukanie cytatuPrzewijasz nagranie na słuchSzukasz w transkrypcji, klikasz linijkę i słyszysz ją

Przypadki użycia

  • Spotkania zespołu

    Zobacz, kto poruszył każdy punkt i kto na co się zgodził. Nadaj mówcom imiona kolegów i kliknij linijkę, by odsłuchać ją przed napisaniem protokołu.

  • Wywiady i podcasty

    Oddziel prowadzącego od gościa, aby wyciągać cytaty i pisać opisy odcinków bez ponownego odsłuchu. Panel mówców pokazuje, ile mówiła każda osoba.

  • Wywiady badawcze i grupy fokusowe

    Rozdziel uczestników sesji grupowej i przejrzyj, co powiedział każdy z nich. Przy wielu podobnych głosach na jednym mikrofonie część linijek poprawisz ręcznie.

Jak działa rozpoznawanie mówców

Przesyłasz plik lub wklejasz publiczny link. Nagranie jest transkrybowane i dzielone według głosów za jednym razem, a potem porządkujesz oznaczenia w przeglądarce. Bez konfiguracji, próbek głosu i wybierania języka.

  1. Krok 01

    Prześlij nagranie

    Prześlij audio lub wideo do 500 MB i 6 godzin albo wklej publiczny link z YouTube, Vimeo lub udostępnione nagranie z chmury Zoom. Język wykrywamy automatycznie.

  2. Krok 02

    Głosy zostają rozdzielone

    Całe nagranie jest analizowane naraz, więc zmiany mówców zostają wykryte, a każdy głos ma to samo oznaczenie od początku do końca.

  3. Krok 03

    Linijki dostają oznaczenia mówców

    Każda linijka jest oznaczona jako Mówca 1, Mówca 2 i tak dalej, ze znacznikiem czasu. Przy jednym głosie oznaczenie jest ukryte.

  4. Krok 04

    Nazwij i popraw

    W płatnych planach zmień nazwy mówców na prawdziwe imiona i połącz zdublowane oznaczenia. Przeniesienie dowolnej linijki do właściwej osoby działa w każdym planie.

Kluczowe funkcje

  • Automatyczne wykrywanie mówców

    Mówców wykrywamy z samego dźwięku. Nic do oznaczania, żadnych próbek głosu, nie trzeba z góry podawać liczby osób.

  • Zmiana nazw i łączenie mówców

    W płatnych planach zmienisz Mówcę 1 na „Anna” jednym ruchem i połączysz dwa oznaczenia tej samej osoby.

  • Spójne w całym nagraniu

    Jedno przejście przez cały plik utrzymuje każdy głos pod tym samym oznaczeniem od pierwszej do ostatniej minuty.

  • Dowolna liczba mówców

    Bez limitu mówców: wywiady we dwoje, spotkania zespołu i panele. Najlepiej rozdziela się czysty dźwięk.

  • Ręczne poprawki linijek

    Przekrzykiwanie i podobne głosy powodują błędy. Przenieś dowolną linijkę do innego mówcy i popraw tekst w przeglądarce.

  • Mówcy w Twoich plikach

    W płatnych planach wybierz dodanie mówców przy pobieraniu: TXT, Word i PDF otworzą każdą wypowiedź imieniem mówcy, a SRT i VTT umieszczą je przed każdym napisem.

Często zadawane pytania

Ilu mówców można rozpoznać?
Nie ma stałego limitu. Hear2Text oznacza tyle różnych głosów, ile znajdzie – Mówca 1, Mówca 2, Mówca 3 i dalej – czy to rozmowa telefoniczna dwóch osób, czy panel ośmiu. Więcej osób o podobnych głosach utrudnia rozdzielenie, więc przy dużej grupie nagranej jednym mikrofonem kilka linijek trzeba będzie przenieść ręcznie. Gdy mówi tylko jedna osoba, oznaczenie jest ukryte.
Czy trzeba najpierw zarejestrować mówców lub wgrać próbki głosu?
Nie. Nie ma rejestracji ani próbek głosu do nagrania. Mówców rozróżniamy na podstawie samego nagrania, więc po prostu przesyłasz plik lub wklejasz publiczny link, a transkrypcja przychodzi z oznaczeniami. Hear2Text nie wie, kim ktoś jest, więc nazywa ich Mówca 1, Mówca 2 i tak dalej; w płatnych planach zmienisz nazwy później.
Jak dokładne jest rozpoznawanie mówców?
Jest niezawodne przy czystych nagraniach, gdzie ludzie mówią po kolei i każdy ma własny mikrofon. Dokładność spada, gdy ludzie się przekrzykują, gdy wszyscy mówią do jednego dalekiego mikrofonu albo gdy dwa głosy brzmią podobnie. Błędy to zwykle krótka linijka przypisana złej osobie; w przeglądarce przeniesiesz ją do właściwego mówcy lub połączysz dwa oznaczenia.
Czy mogę nadać mówcom prawdziwe imiona?
Tak, w płatnych planach. Zmień Mówcę 1 na „Anna”, a wszystkie jej linijki zaktualizują się naraz. Jeśli jedną osobę podzielono na dwa oznaczenia, połącz je. Imiona trafiają też do pobieranych plików: przy eksporcie wybierz dodanie mówców, a pokażą ich TXT, Word, PDF, SRT i VTT.
Co się dzieje, gdy ludzie mówią jednocześnie?
Nakładająca się mowa to najtrudniejszy przypadek. Każdy fragment dostaje jednego mówcę, więc gdy dwie osoby mówią naraz, linijka trafia do tej, która dominuje, a krótkie wtrącenie może zostać pominięte lub przypisane komuś innemu. Mocne przekrzykiwanie obniża też dokładność transkrypcji. Poprawisz to potem, edytując tekst i przenosząc linijki do właściwego mówcy w przeglądarce.
Czy działa z nagraniami rozmów telefonicznych?
Tak, jeśli masz nagranie jako plik. Prześlij je (do 500 MB i 6 godzin, w MP3, M4A, WAV lub większości innych formatów), a obie strony zostaną oznaczone. Dźwięk telefoniczny jest wąski i skompresowany, więc rozdzielenie jest słabsze niż przy nagraniu studyjnym, zwłaszcza gdy głosy są podobne. Hear2Text sam nie nagrywa rozmów i żaden bot nie dołącza do Zoom, Teams ani Meet.

Rozpoznaj mówców w swoim następnym nagraniu

Prześlij spotkanie, wywiad lub podcast i odbierz transkrypcję z mówcą przy każdej linijce — to jest w każdym planie. Nadawanie mówcom imion i dodawanie ich do eksportu jest w planie miesięcznym (9,99 USD) i rocznym (89,99 USD), które dają też nielimitowane minuty transkrypcji.