Hear2Text
Nhận dạng người nói

Chuyển ghi âm thành văn bản, tự nhận dạng người nói

Tải lên cuộc họp, phỏng vấn hoặc podcast, Hear2Text sẽ gắn nhãn người nói cho từng dòng: Người nói 1, Người nói 2, v.v., không giới hạn số người, trên mọi gói. Đổi tên và gộp người nói, cùng với thêm họ vào file xuất của bạn, có trong gói trả phí Tháng và Năm.

Mỗi giọng một nhãn, từ đầu đến cuối

Toàn bộ bản ghi được xử lý trong một lượt, nên giọng là Người nói 2 ở phút đầu vẫn là Người nói 2 sau một giờ. Mỗi dòng chép lời mang nhãn người nói và dấu thời gian; bấm vào dòng là trình phát nhảy tới đúng lúc đó để bạn kiểm tra ai thực sự đã nói. Trên các gói trả phí, bạn có thể đổi nhãn thành tên thật và gộp hai nhãn hóa ra là cùng một người; việc chuyển từng dòng sang người nói khác khi mô hình gán sai thì dùng được ở mọi gói.

Bắt đầu

Xem cuộc trò chuyện được chia thế nào

Bảng người nói cho thấy phần thời lượng của từng người trong bản ghi, để bạn thấy ngay người phỏng vấn nói nhiều hơn khách mời hay một giọng lấn át cuộc họp. Hear2Text chỉ phân biệt giọng trong cùng một bản ghi; nó không nhớ giọng giữa các bản ghi và không nhận ra ai là ai, nên tên luôn do bạn tự thêm.

Bắt đầu

Âm thanh nhiều người nói, có và không có nhãn người nói

Tính năngKhông cóVới Hear2Text
Cuộc họp nhiều ngườiMột khối văn bản dài, không biết ai nói gìMỗi dòng được đánh dấu Người nói 1, Người nói 2, v.v.
Bản gỡ băng phỏng vấnCâu hỏi và câu trả lời lẫn vào nhauNgười phỏng vấn và khách mời ở hai nhãn riêng, đổi tên được
Ghi chú cho tập podcastNghe lại cả tập để phân biệt người dẫn và khách mờiBảng cho thấy phần thời lượng của từng người nói trong tập
Tìm một câu trích dẫnTua âm thanh và dò bằng taiTìm trong bản chép lời, bấm vào dòng và nghe lại

Trường hợp sử dụng

  • Họp nhóm

    Xem ai đưa ra từng ý và ai đã nhận việc gì. Đổi tên người nói thành tên đồng nghiệp và bấm vào dòng để nghe lại trước khi viết biên bản.

  • Phỏng vấn và podcast

    Tách riêng người dẫn và khách mời để trích dẫn và viết ghi chú chương trình mà không phải nghe lại cả tập. Bảng người nói cho biết mỗi người nói bao nhiêu.

  • Phỏng vấn sâu và thảo luận nhóm

    Tách từng người tham gia trong buổi thảo luận nhóm và xem lại mỗi người đã nói gì. Với nhiều giọng giống nhau trên một micro, hãy dự trù sửa tay một số dòng.

Nhận dạng người nói hoạt động thế nào

Bạn tải file lên hoặc dán liên kết công khai. Bản ghi được chuyển thành văn bản và tách theo giọng trong một lượt, sau đó bạn chỉnh nhãn trên trình duyệt. Không cần cài đặt, không cần mẫu giọng, không phải chọn ngôn ngữ.

  1. Bước 01

    Tải bản ghi lên

    Tải lên âm thanh hoặc video tối đa 500 MB và 6 giờ, hoặc dán liên kết công khai YouTube, Vimeo hay liên kết chia sẻ bản ghi đám mây Zoom. Ngôn ngữ được nhận diện tự động.

  2. Bước 02

    Các giọng được tách riêng

    Toàn bộ bản ghi được phân tích cùng lúc, nên các lượt chuyển người nói được tìm ra và mỗi giọng giữ nguyên một nhãn suốt bản ghi.

  3. Bước 03

    Các dòng được gắn nhãn người nói

    Mỗi dòng được đánh dấu Người nói 1, Người nói 2, v.v., kèm dấu thời gian. Khi chỉ có một giọng, nhãn được ẩn.

  4. Bước 04

    Đổi tên và sửa

    Trên các gói trả phí, đổi tên người nói thành tên thật và gộp nhãn trùng. Chuyển bất kỳ dòng nào sang đúng người thì dùng được ở mọi gói.

Tính năng chính

  • Tự động phát hiện người nói

    Người nói được phát hiện từ chính âm thanh. Không cần gắn thẻ, không cần mẫu giọng, không phải nhập trước số người nói.

  • Đổi tên và gộp người nói

    Trên các gói trả phí, đổi Người nói 1 thành "Lan" trong một bước và gộp hai nhãn thuộc cùng một người.

  • Nhất quán suốt bản ghi

    Một lượt xử lý cho cả file giúp mỗi giọng giữ cùng một nhãn từ phút đầu đến phút cuối.

  • Bao nhiêu người nói cũng được

    Không giới hạn người nói: phỏng vấn hai người, họp nhóm hay tọa đàm đều được. Âm thanh rõ thì tách tốt nhất.

  • Sửa dòng bằng tay

    Nói chồng và giọng giống nhau gây ra lỗi. Chuyển bất kỳ dòng nào sang người nói khác và sửa văn bản trên trình duyệt.

  • Người nói có trong file tải về

    Ở các gói trả phí, chọn thêm người nói khi bạn tải xuống: TXT, Word và PDF mở đầu mỗi lượt nói bằng tên người nói, còn SRT và VTT đặt tên người nói trước mỗi phụ đề.

Câu hỏi thường gặp

Nhận dạng được bao nhiêu người nói?
Không có giới hạn cố định. Hear2Text gắn nhãn cho mọi giọng khác nhau mà nó tìm thấy, Người nói 1, Người nói 2, Người nói 3 trở đi, dù là cuộc gọi hai người hay buổi tọa đàm tám người. Càng nhiều người có giọng giống nhau thì càng khó tách, nên một nhóm đông ghi bằng một micro có thể cần sửa tay vài dòng. Khi chỉ có một người nói, nhãn sẽ được ẩn.
Có cần đăng ký người nói hay tải mẫu giọng trước không?
Không. Không có bước đăng ký và không cần thu mẫu giọng. Người nói được phân biệt từ chính bản ghi, nên bạn chỉ cần tải file lên hoặc dán liên kết công khai và bản chép lời sẽ có nhãn sẵn. Hear2Text không biết ai là ai, nên đặt tên Người nói 1, Người nói 2, v.v.; trên các gói trả phí bạn có thể đổi tên sau đó.
Nhận dạng người nói chính xác đến đâu?
Khá đáng tin với bản ghi rõ, khi mọi người nói lần lượt và mỗi người có micro riêng. Độ chính xác giảm khi mọi người nói chồng lên nhau, khi cả nhóm dùng chung một micro đặt xa, hoặc khi hai giọng nghe giống nhau. Lỗi thường là một dòng ngắn bị gán nhầm người, và bạn có thể chuyển bất kỳ dòng nào sang đúng người nói hoặc gộp hai nhãn ngay trên trình duyệt.
Có đổi nhãn người nói thành tên thật được không?
Có, trên các gói trả phí. Đổi Người nói 1 thành "Lan" là mọi dòng của người đó cập nhật cùng lúc. Nếu một người bị tách thành hai nhãn, hãy gộp lại. Tên cũng theo vào file tải xuống của bạn: chọn thêm người nói khi xuất file, và TXT, Word, PDF, SRT hay VTT đều sẽ hiển thị tên đó.
Chuyện gì xảy ra khi mọi người nói chồng lên nhau?
Nói chồng lên nhau là trường hợp khó nhất. Mỗi đoạn chỉ có một người nói, nên khi hai người nói cùng lúc, dòng đó thuộc về người nói át hơn, và một câu chen ngang ngắn có thể bị bỏ sót hoặc gán nhầm. Nói chồng nhiều cũng làm giảm độ chính xác chép lời. Bạn có thể sửa sau bằng cách chỉnh văn bản và chuyển dòng sang đúng người nói trên trình duyệt.
Có dùng được với file ghi âm cuộc gọi điện thoại không?
Có, nếu bạn có file ghi âm cuộc gọi. Tải lên (tối đa 500 MB và 6 giờ, định dạng MP3, M4A, WAV hoặc hầu hết định dạng khác) và cả hai bên sẽ được gắn nhãn. Âm thanh điện thoại bị nén và hẹp nên việc tách giọng kém hơn âm thanh phòng thu, nhất là khi hai giọng giống nhau. Hear2Text không tự ghi âm cuộc gọi và không có bot tham gia Zoom, Teams hay Meet.

Nhận dạng người nói trong bản ghi tiếp theo

Tải lên cuộc họp, phỏng vấn hoặc podcast và nhận bản chép lời có nhãn người nói ở từng dòng, trên mọi gói. Đặt tên người nói và thêm họ vào file xuất của bạn thuộc gói Tháng (9,99 US$) và gói Năm (89,99 US$), kèm số phút chuyển thành văn bản không giới hạn.