Hear2Text
WAV文字起こし

WAV音声を無料で文字起こし

レコーダー、スタジオ、放送アーカイブのWAVをアップロードすれば、100の言語で編集可能な文字起こしが数分で届きます。無料プランは毎週120分まで使えます。

  • 最大99%の精度
  • 一般的なサンプルレートすべて
  • あなたのアカウント内で非公開

WAV文字起こしの機能

レコーダーや編集ソフトのWAVをそのままアップロード。500MBを超えない限り変換は不要です。

  • 可逆品質

    MP3やAACとは異なり、WAVはデータ損失なしで完全な音声信号を含みます。

  • 100の言語

    100の言語で録音を文字起こし。言語は自動で判別されます。

  • 全セグメントにタイムスタンプ

    文字起こしのすべてのセグメントにタイムスタンプが付くので、録音のその場面にすぐ移動できます。

  • あなたのアカウント内で非公開

    録音と文字起こしは削除するまであなたのアカウント内で非公開に保たれます。HIPAAやSOC 2などの認証は取得していないため、機密性の高い資料をアップロードする前にご自身の規定をご確認ください。

音声品質のゴールドスタンダード

WAV(Waveform Audio File Format)は、スタジオ、放送、フィールドレコーダーで使われる非圧縮音声の標準です。その細部は編集や保存では重要ですが、音声認識ではフォーマットより声の明瞭さのほうがはるかに重要です。

  • 変換は不要

    文字起こしに関しては、通常そうではありません。WAVは非圧縮で、音声の編集や保存では重要ですが、音声認識にはその細部は必要ありません。アップロードはまず圧縮モノラル音声に変換され、通常のMP3でも同じようにきれいに文字起こしされます。手元にあるのがWAVならそのままアップロードし、500MBを超える場合だけ変換してください。

  • どのビット深度にも対応

    フィールドレコーダーの32ビットフロートを含め、一般的などのビット深度のWAVもそのまま受け付けます。

  • モノラル、ステレオ、マルチ

    はい。ステレオやマルチチャンネルのWAVも受け付け、文字起こし前に1チャンネルにミックスするため、別々のチャンネルの声も1つの文字起こしにまとまります。話者識別により「話者1」「話者2」のようにラベル付けされます。チャンネルごとに別々に文字起こしはされません。ファイルは最大500MB・6時間までです。

WAVの仕様

一般的なWAVならどれでも使えます。適用される上限は次のとおりです。

サンプルレート
一般的なサンプルレートすべて
ビット深度
16-bit, 24-bit, 32-bit float
チャンネル
モノラル、ステレオ、マルチ
最大ファイルサイズ
2 GB
最大時間
6時間
エンコーディング
Uncompressed (PCM)

WAVファイルの文字起こし方法

簡単なステップでWAVファイルを編集可能な文字起こしに。

  1. WAVファイルをアップロード

    WAVファイルをそのままアップロード。一般的などのサンプルレート・ビット深度でも、最大500MB・6時間まで対応します。

  2. 自動処理

    音声は自動で変換・文字起こしされ、言語も自動で判別されます。

  3. 可逆圧縮ファイルもそのまま

    WAV録音を文字起こしするとできること。

  4. 結果をエクスポート

    無料プランではTXTで、有料プランではセグメントごとのタイムスタンプ付きのSRT・VTT、またはWord・PDFで文字起こしをダウンロードできます。

WAVを使う人たち

レコーダーやスタジオが標準でWAVを保存する人たち。

  • 録音スタジオ

    制作ミーティング、インタビュー、セッション中の会話を文字起こし。歌声の文字起こしは精度が低く、歌詞抽出機能はありません。

  • 法律専門家

    法廷録音、証言録取、依頼人との面談に。タイムスタンプで該当箇所を探せます。人による確認はないため、引用は録音と照らし合わせてください。

  • 放送・ラジオ

    保存されたインタビューや番組を文字起こしし、音声を聞き直す代わりにテキスト検索で引用を探せます。

  • オーディオエンジニア

    クライアントのフィードバック、セッション中の会話、録音メモを、手元のWAVファイルからそのまま文字起こし。

よくある質問

WAVの文字起こしについてよくある質問。

WAVは圧縮フォーマットより文字起こしに向いていますか?

文字起こしに関しては、通常そうではありません。WAVは非圧縮で、音声の編集や保存では重要ですが、音声認識にはその細部は必要ありません。アップロードはまず圧縮モノラル音声に変換され、通常のMP3でも同じようにきれいに文字起こしされます。手元にあるのがWAVならそのままアップロードし、500MBを超える場合だけ変換してください。

長時間録音からの大容量WAVファイルに対応できますか?

はい、どのプランでも1ファイルあたり最大500MB・6時間まで対応しています。CD品質のステレオWAVは1時間未満で500MBを超えるため、長い録音はアップロード前にMP3やM4Aに変換してください。どのファイルもいずれ圧縮モノラル音声に変換されるので、文字起こしの結果は変わりません。無料プランは毎週120分まで使えます。

サンプルレートは文字起こしの精度に影響しますか?

ほとんど影響しません。アップロードされた音声はすべて文字起こし前に圧縮モノラル音声に変換されるため、同じ声なら低いサンプルレートでも高いサンプルレートでも結果は同じです。マイクとの距離、背景ノイズ、話者の声の重なりのほうがはるかに重要です。明瞭な音声なら一般的などのサンプルレートでも最大99%の精度が出ます。サンプルレートを下げれば、長い録音を500MB以内に収めやすくなります。

マルチチャンネルWAVファイルはどのように処理しますか?

はい。ステレオやマルチチャンネルのWAVも受け付け、文字起こし前に1チャンネルにミックスするため、別々のチャンネルの声も1つの文字起こしにまとまります。話者識別により「話者1」「話者2」のようにラベル付けされます。チャンネルごとに別々に文字起こしはされません。ファイルは最大500MB・6時間までです。

WAVの文字起こしをよく使うのはどんな業界?

主にプロ用機材で録音する人たちです。セッション中の会話を記録するスタジオ、インタビューを保存する放送局、レコーダーが標準でWAVを保存する弁護士や研究者などです。いずれも最大500MB・6時間のWAVをアップロードできます。人による確認はなく、HIPAAやSOC 2の認証もないため、機密性の高い録音をアップロードする前にご自身の規定をご確認ください。

WAV文字起こしはMP3より正確ですか?

目に見える差はありません。すべてのファイルは文字起こし前に圧縮モノラル音声に変換されるため、同じ録音のWAVと良質なMP3の結果はほぼ同じです。WAVの利点は編集や保存にあり、認識にはありません。WAVが500MBを超える場合は、先にMP3やM4Aに変換しても精度は落ちません。

外出先でも文字起こし

iPhone・Android向けのHear2Textアプリで録音するか、スマートフォンからWAVをアップロード。文字起こしはすべてアカウントにまとまります。

App StorePlay Store

WAVファイルを文字起こししませんか?

WAV録音を文字起こしするとできること。

無料で文字起こしを開始