FLACファイルを文字起こし
アーカイブやフィールドレコーダー、インタビュー収録のFLAC録音をアップロードすると、数分でタイムスタンプ付きの編集できる文字起こしが届きます。言語は自動で判別。無料プランは毎週120分、クレジットカード不要です。
FLACファイルを文字起こし
ファイルのリンクを貼り付けるか、「文字起こし」を押してアップロード
無料プラン:毎週120分。ファイルは500 MB・6時間まで。
FLACファイルをそのままアップロード
レコーダーやアーカイブ用ドライブ、DAWから書き出した.flacファイルをそのままアップロードできます。変換は不要です。どのプランでも、500 MBまでのファイル、6時間までの録音に対応しています。ロスレスのステレオ音声はサイズが大きく、長いセッションは500 MBを超えることがあります。その場合は128 kbpsのMP3かM4Aでコピーを書き出してください。サイズは数分の一になり、話し声の精度は変わりません。アップロードの代わりに、ネット上のFLACファイルへの直接リンクを貼り付けることもできます。
文字起こしを開始精度を本当に左右するもの
ロスレス保存は録音を収録したままの状態で残しますが、音声認識では入れ物より元の音が重要です。静かな部屋で近くのマイクなら精度は最大99%。風、車の音、声に重なる音楽、複数人の同時発話、強いなまりがあると下がります。古いテープをFLACに移しても、古いテープの音であることに変わりはありません。Hear2Textはノイズ除去や音質補正を行わないため、聞き取りにくい箇所では何語か修正が必要になり、引用する部分は聞き直すことをおすすめします。
文字起こしを開始録音の内容を質問する
FLACの録音を文字起こししたら、AIアシスタントにふだんの言葉で質問できます。答えは文字起こしそのものに基づくので、2時間のオーラルヒストリーや、最初から読み直したくない長いフィールドインタビューで役立ちます。アシスタントは有料プランの機能です。
- 長い録音を要約する
- 名前・日付・場所を抜き出す
- テーマが出てくる場面を探す
- 録音で扱われた話題を一覧にする
FLACファイルを文字起こしする方法
ロスレス録音から、編集できるタイムスタンプ付きの文字起こしまで、かんたんな手順で。
- ステップ 01
FLACファイルをアップロード
パソコンやアーカイブ用ドライブから.flacファイルを選ぶか、直接リンクを貼り付けます。500 MB・6時間まで。
- ステップ 02
文字起こしを実行
100の言語から話されている言語を自動で判別し、録音全体を一度に文字起こし。すべてのセグメントにタイムスタンプが付きます。
- ステップ 03
確認して修正
音声と並べて文字起こしを読み、タイムスタンプに飛び、名前や専門用語、不明瞭な語をブラウザで直接修正します。
- ステップ 04
テキストを書き出す
無料プランではTXTでダウンロード。有料プランならSRT、VTT、Word、PDFに加え、AI要約と翻訳も使えます。
FLACファイルを文字起こしする人
ロスレスで録音していて、波形ではなく言葉が必要な人に。
音響エンジニア
パネル討論をロスレスのステレオで収録した音響エンジニアが、セッションをアップロードし、音声を書き出し直すことなくクライアントに文字起こしを渡します。
ポッドキャスター
マスターファイルをFLACで保存しているポッドキャスターが、完成したエピソードをアップロード。文字起こしをショーノートや引用に使い、有料プランでは動画版用のSRT字幕も作れます。
研究者
フィールドワークから戻った民族誌研究者が、何時間分ものインタビュー録音を文字起こしし、論文に載せる前に各引用をタイムスタンプで確認します。
アーキビスト・図書館
オーラルヒストリーのテープをFLACでデジタル化している図書館が、インタビューを1本ずつアップロード。検索できるタイムスタンプ付きテキストで、コレクションの目録作りや閲覧が楽になります。
Hear2TextでFLACを文字起こしする理由
変換不要
アーカイブやレコーダーの.flacファイルを直接アップロード。変換や書き出し直しは必要ありません。
標準的なFLAC設定ならOK
フィールドレコーダーやDAWのファイルを書き出したまま使えます。事前のリサンプリングやビット深度の変更は不要です。
長い録音、500 MBのファイル
500 MBまでのファイル、6時間までの録音をアップロードできます。上限を超える場合は、128 kbpsのMP3やM4Aのコピーでも同じように文字起こしできます。
話者の識別
どのプランでも声ごとにSpeaker 1、Speaker 2のようにラベルが付き、インタビューがひとかたまりの文章ではなく会話として読めます。
クリアな録音で高精度
クリアな話し声なら精度は最大99%、100の言語を自動で判別。雑音や声が重なる箇所は聞き直す価値があります。
