Hear2Text

FLAC转文字:免费无损音频在线转文字

上传来自档案、录音机或采访现场的 FLAC 录音,几分钟就能得到带时间戳、可编辑的文字稿。语言自动识别。免费套餐每周 120 分钟,无需绑定信用卡。

FLAC 文件转文字

粘贴文件链接,或点击“转文字”上传文件

免费套餐:每周 120 分钟。文件最大 500 MB、最长 6 小时。

FLAC 文件原样上传

.flac 文件可以直接从录音机、档案硬盘或音频工作站导出后上传,无需转换。所有套餐都支持最大 500 MB 的文件和最长 6 小时的录音。无损立体声体积大,较长的录音可能超过 500 MB。这时导出一份 128 kbps 的 MP3 或 M4A,文件只有原来的一小部分,语音识别准确率不变。也可以不上传,直接粘贴网上 FLAC 文件的直链。

开始转录

真正决定准确率的因素

无损存储能把录音原样保留,但对语音识别来说,声源比容器更重要。安静房间里近距离收音,准确率最高可达 99%;风声、车流、人声下的音乐、多人抢话和浓重口音都会拉低准确率。老磁带转成 FLAC,里面依然是老磁带的声音。Hear2Text 不做降噪或音频增强,所以难听清的段落可能需要改几个词,打算引用的内容请回听核实。

开始转录

针对录音内容提问

FLAC 录音转成文字后,可以用日常语言向 AI 助手提问。它直接根据文字稿作答,面对两小时的口述历史或冗长的田野访谈时尤其省事,不用从头再读一遍。AI 助手属于付费套餐功能。

  • 概括一段长录音
  • 提取人名、日期和地点
  • 找到某个主题出现的时刻
  • 列出录音涉及的话题
试用AI对话

FLAC 文件怎么转文字

四步把无损录音变成带时间戳、可编辑的文字稿。

  1. 步骤 01

    上传 FLAC 文件

    从电脑或档案硬盘选择 .flac 文件,或粘贴文件直链。文件最大 500 MB、最长 6 小时。

  2. 步骤 02

    开始转写

    系统从 100 种语言中自动识别语言,一次性转写整段录音,每一段都带时间戳。

  3. 步骤 03

    检查并修改

    对照音频阅读文字稿,点任意时间戳跳转,直接在浏览器里修改人名、术语或听不清的词。

  4. 步骤 04

    导出文字

    免费套餐可下载 TXT 文件。付费套餐另外提供 SRT、VTT、Word 和 PDF,以及 AI 摘要和翻译。

谁在转写 FLAC 文件

适合用无损格式录音、需要的是文字而不只是波形的人。

  • 录音师

    录音师用无损立体声录下一场座谈,直接上传原始录音,不用另外导出音频副本,就能把文字稿交给客户。

  • 播客主

    用 FLAC 保存母带的播客主上传成品单集,用文字稿写节目简介、摘引语;付费套餐还能为视频版导出 SRT 字幕。

  • 研究人员

    结束田野调查的民族志研究者转写数小时的录音访谈,写进论文前再按时间戳核对每一句引语。

  • 档案馆和图书馆

    图书馆把口述历史磁带数字化为 FLAC 后逐个上传,得到可搜索、带时间戳的文字,馆藏编目和浏览都更方便。

为什么用 Hear2Text 转写 FLAC

  1. 无需转换

    从档案或录音机直接上传 .flac 文件,Hear2Text 能直接读取,您不必转换或重新导出。

  2. 任何标准 FLAC 设置

    录音机和音频工作站导出的文件原样接收,不需要先重新采样或改位深。

  3. 长录音、大文件

    支持最大 500 MB 的文件和最长 6 小时的录音。超过大小限制时,128 kbps 的 MP3 或 M4A 副本转写效果一样好。

  4. 区分说话人

    所有套餐都会把每个声音标为说话人 1、说话人 2 等,采访读起来像一段对话,而不是一整块文字。

  5. 清晰录音识别准确

    清晰语音准确率最高可达 99%,自动识别 100 种语言。嘈杂或多人重叠的段落值得再听一遍。

Google PlayApp Store

常见问题

FLAC文件可以直接转文字吗?
不一定要用 FLAC,但如果录音本来就是 FLAC,直接上传就行。档案、田野录音和音频工程师录制的采访常用 FLAC,仅仅为了转文字而转换格式是浪费时间。无损存储并不会让转写效果明显好于一个好的 MP3;麦克风、房间和说话人本身重要得多。
FLAC 文件太大传不上去怎么办?
有时会。每个文件的上传上限是 500 MB,无损音频体积大,较长的立体声 FLAC 录音可能超过这个限制。所有套餐都支持最长 6 小时的录音。如果文件超限,先转成 128 kbps 的 MP3 或 M4A,体积会小很多,语音识别准确率不受影响。
FLAC 转文字比 MP3 更准确吗?
几乎没有差别。语音识别取决于录音时人声是否清晰,而不是无损还是有损存储。正常码率的 MP3 已经保留了模型从人声中需要的全部信息。背景噪音、人声下的音乐、多人抢话和远距离麦克风对准确率的影响要大得多。音频清晰时,两种格式的准确率都最高可达 99%。
支持哪些位深和采样率?
任何标准 FLAC 文件都可以,不管录音机或音频软件导出时用的是什么位深和采样率。上传前不需要重新采样、混缩或修改设置,更高的分辨率对文字稿既没有帮助也没有坏处。真正要注意的限制是文件大小(500 MB)和时长(所有套餐每段录音最长 6 小时)。
上传前需要把 MP3 转成 FLAC 吗?
不需要。把 MP3 转成 FLAC 无法找回 MP3 压缩时丢掉的细节,只会让文件变大,更接近 500 MB 的上传上限。MP3 直接原样上传即可。其他格式也一样:Hear2Text 支持 MP3、WAV、M4A、AAC、FLAC、OGG 等格式,没有必要先转换。

随时随地访问Hear2Text

把 FLAC 档案变成可搜索的文字

Google PlayApp Store

免费转写第一个 FLAC 文件

免费开始使用