一个声音一个标签,从头到尾不变
整段录音一次性转写,所以第一分钟的说话人 2,一小时后依然是说话人 2。转录稿的每一行都带有说话人和时间戳;点击一行,播放器就会跳到那一刻,方便您核实到底是谁说的。在付费方案中,您可以把标签改成真实姓名,合并其实是同一个人的两个标签。模型分错时把任意一行移给另一位说话人,这一点任何方案都可以做。
开始使用看清对话是怎么分配的
说话人面板显示每个人在录音中的发言占比,一眼就能看出采访者是否比嘉宾说得多,或者会议是否被某一个人主导。Hear2Text 只在单段录音内区分声音;它不会在不同录音之间记住声音,也不会识别某人的身份,所以名字始终由您来添加。
开始使用多人录音:有无说话人标签的差别
| 功能 | 没有 | 使用Hear2Text |
|---|---|---|
| 多人会议 | 一大段文字,看不出谁说了什么 | 每一行都标有说话人 1、说话人 2 等 |
| 采访逐字稿 | 问题和回答混在一起 | 采访者和嘉宾分属不同标签,可重命名 |
| 播客节目笔记 | 重放整集来分辨主持人和嘉宾 | 一个面板显示每位说话人在节目中的发言占比 |
| 查找引语 | 拖着进度条凭耳朵找 | 搜索转录稿,点击那一行即可播放 |
使用场景
团队会议
看清每个观点是谁提的、谁答应了什么。把说话人改成同事的名字,写会议纪要前点击一行再听一遍。
采访和播客
把主持人和嘉宾分开,摘引语、写节目笔记都不必重放整集。说话人面板会显示每个人说了多少。
研究访谈和焦点小组
在小组访谈中区分各位参与者,回顾每个人说了什么。如果一个麦克风录下多个相似的声音,需要手动修正部分行。
说话人识别如何运作
上传文件或粘贴公开链接。录音会在一次处理中完成转写并按声音区分,然后您在浏览器里整理标签。无需设置,无需声音样本,也不用选择语言。
- 步骤 01
上传录音
上传不超过 500 MB、6 小时的音频或视频,或粘贴公开的 YouTube、Vimeo 或 Zoom 云录制分享链接。语种自动识别。
- 步骤 02
区分不同声音
整段录音一次性分析,找出说话人之间的轮换,每个声音全程保持同一个标签。
- 步骤 03
每行标注说话人
每一行都标有说话人 1、说话人 2 等,并附时间戳。只有一个声音时,标签会隐藏。
- 步骤 04
重命名并修正
在付费方案中,把说话人改成真实姓名,合并重复的标签。把某一行移给正确的人,这一点任何方案都可以做。
核心功能
自动识别说话人
直接从音频中识别说话人。无需标记,无需声音样本,也不用事先填写人数。
重命名与合并说话人
在付费方案中,一步把说话人 1 改成“Anna”,并合并属于同一个人的两个标签。
全程标签一致
整份文件一次处理,每个声音从第一分钟到最后一分钟都保持同一个标签。
人数不限
说话人数量不限:两人采访、团队会议和座谈会都可以。音频越清晰,区分效果越好。
手动修正
抢话和声音相似会导致错误。您可以在浏览器里把任意一行移给其他说话人并修改文字。
下载文件也能显示说话人
付费方案中,下载时可以选择是否加入说话人:TXT、Word、PDF 会在每段发言前加上说话人姓名,SRT 和 VTT 会在每条字幕前加上说话人姓名。
