// インタビュー文字起こし

インタビューを、すぐに引用できるテキストに。

インタビューや会話をタイムスタンプ付きでテキスト化。音声を整え、2名の話者に対応し、引用を抽出。TXT、DOCX、SRT、エージェントJSONで書き出せます。

MP3M4AWAVMP4MOV
vocce · transcribe● live
クリックまたはドラッグしてアップロード
音声または動画ファイル · ≤ 50MB
4 AI engines · 20+ formats · free tier · no signup · failed jobs never billed
// 得られるもの

1回のアップロードで、次のステップに必要なすべてのファイル。

信頼性の高いVocceパイプラインをこのジョブに特化。無料で開始し、さらに必要な場合は月額$9.90からのプラン。

Timestamped transcript
Speaker context
Quote-ready text
SRT / VTT
Agent JSON
// 仕組み

インタビューを文字起こしする手順

01
インタビュー音声をアップロード スマホの録音、Zoom通話、フィールドレコーダーのファイル — ドラッグするかリンクを貼るだけ。
02
音声を整えて文字起こし 2名の声、話者の重なり、室内ノイズ — まず音声をクリーンアップし、タイムスタンプ付きでテキスト化。
03
引用を抽出して書き出し タイムスタンプ付き文字起こし、引用に使えるテキスト、SRT/VTT、エージェントJSONを出力。

インタビュー文字起こしこそ、本番の作業が始まる場所です — 必要な発言は90分の音声のどこかに埋もれていて、耳で探すと午後が一瞬で消えます。全文をタイムスタンプ付きでテキスト化すれば、スクラブではなく検索で見つけられます。

インタビューの録音環境はスタジオとは限りません。カフェのテーブルに置いたスマホ、ラグのあるZoom通話、二人が同時に話す場面。Vocceはまず音声を整え、音量を均一にしノイズをカットしてから、単語レベルのタイムスタンプ付きで文字起こしします。すべての発言が、発せられた瞬間に紐づきます。

引用・出典に使えるクリーンな文字起こし(TXT/DOCX)、動画撮影があった場合はSRT/VTT、研究ツール向けのJSON版を出力。最初の3分は無料で、失敗したジョブは課金されません。

// 機能

実際のファイルに耐える設計。

2名の会話に最適化

話者の重なりや掛け合いを処理し、すべての発言にタイムスタンプを付与。誰が何に答えたかが一目でわかります。

自信を持って引用

単語レベルのタイムスタンプが各引用を正確な秒数に紐づけます — 数ヶ月後に「誰が言ったか」を間違えることがありません。

文字起こし前に音声をクリーニング

カフェの雑音、スマホマイク、不揃いな音量 — まず整えるからこそ、インタビューの精度が決まります。

長時間インタビューも安定

2時間の会話も分割して並列処理し、ドリフトのない1本のタイムラインに再結合します。

デフォルトでプライベート

録音はジョブ処理のみに使われ、学習に利用されることは一切ありません。

研究向けの書き出し

TXT、DOCX、JSONスキーマで出力。研究ワークフロー、RAGインデックス、独自分析にそのまま取り込めます。

// インタビュー文字起こしの利用者

実際のワークフロー向けに設計。

ジャーナリスト

録音インタビューを引用可能なタイムスタンプ付きテキストに — 聞き直さずに発言を見つけ、瞬間を引用。

UX・ユーザーリサーチャー

リサーチ通話を検索可能なテキストに起こし、タグ付け、テーマ分類、レポートへの引用が自由に。

採用・定性調査

候補者や研究対象者のインタビューを横比較可能に — 記憶ではなく、クリーンな文字起こしを並べて評価。

// FAQ

インタビュー文字起こし、回答します。

インタビューを文字起こしするには?+

上の枠に録音をアップロードしてください — スマホ音声、Zoom書き出し、フィールドレコーダーファイルに対応。Vocceが音声を整え、タイムスタンプ付きで文字起こしし、引用に使えるテキストを出力します。最初の3分は無料です。

2人の話者を区別できますか?+

話者分離機能は複数人録音向けに順次展開中です。現時点ではすべての発言にタイムスタンプが付くため、2名のインタビューは容易に追跡でき、書き出し時に話者をマークすることも可能です。

カフェの雑音が多い録音でも大丈夫?+

はい — ノイズリダクションとラウドネス均一化を文字起こし前に実行します。インタビュー音声で最も効果を発揮する処理です。

どれくらい長いインタビューを文字起こしできますか?+

数時間のインタビューでも問題ありません — 分割して並列処理し、1本の連続タイムラインに再結合します。

プライバシーは守られますか?+

はい — 録音はジョブ処理のみに使用され、学習に利用されることはありません。処理後の作業用コピーは一定期間後に削除されます。

何が出力されますか?+

タイムスタンプ付き文字起こし(TXT/DOCX)、動画撮影があった場合はSRT/VTT、研究ツールやパイプライン向けのエージェントJSONを出力します。