信頼性の高いVocceパイプラインをこのジョブに特化。無料で開始し、さらに必要な場合は月額$9.90からのプラン。
インタビュー文字起こしこそ、本番の作業が始まる場所です — 必要な発言は90分の音声のどこかに埋もれていて、耳で探すと午後が一瞬で消えます。全文をタイムスタンプ付きでテキスト化すれば、スクラブではなく検索で見つけられます。
インタビューの録音環境はスタジオとは限りません。カフェのテーブルに置いたスマホ、ラグのあるZoom通話、二人が同時に話す場面。Vocceはまず音声を整え、音量を均一にしノイズをカットしてから、単語レベルのタイムスタンプ付きで文字起こしします。すべての発言が、発せられた瞬間に紐づきます。
引用・出典に使えるクリーンな文字起こし(TXT/DOCX)、動画撮影があった場合はSRT/VTT、研究ツール向けのJSON版を出力。最初の3分は無料で、失敗したジョブは課金されません。
話者の重なりや掛け合いを処理し、すべての発言にタイムスタンプを付与。誰が何に答えたかが一目でわかります。
単語レベルのタイムスタンプが各引用を正確な秒数に紐づけます — 数ヶ月後に「誰が言ったか」を間違えることがありません。
カフェの雑音、スマホマイク、不揃いな音量 — まず整えるからこそ、インタビューの精度が決まります。
2時間の会話も分割して並列処理し、ドリフトのない1本のタイムラインに再結合します。
録音はジョブ処理のみに使われ、学習に利用されることは一切ありません。
TXT、DOCX、JSONスキーマで出力。研究ワークフロー、RAGインデックス、独自分析にそのまま取り込めます。
録音インタビューを引用可能なタイムスタンプ付きテキストに — 聞き直さずに発言を見つけ、瞬間を引用。
リサーチ通話を検索可能なテキストに起こし、タグ付け、テーマ分類、レポートへの引用が自由に。
候補者や研究対象者のインタビューを横比較可能に — 記憶ではなく、クリーンな文字起こしを並べて評価。
上の枠に録音をアップロードしてください — スマホ音声、Zoom書き出し、フィールドレコーダーファイルに対応。Vocceが音声を整え、タイムスタンプ付きで文字起こしし、引用に使えるテキストを出力します。最初の3分は無料です。
話者分離機能は複数人録音向けに順次展開中です。現時点ではすべての発言にタイムスタンプが付くため、2名のインタビューは容易に追跡でき、書き出し時に話者をマークすることも可能です。
はい — ノイズリダクションとラウドネス均一化を文字起こし前に実行します。インタビュー音声で最も効果を発揮する処理です。
数時間のインタビューでも問題ありません — 分割して並列処理し、1本の連続タイムラインに再結合します。
はい — 録音はジョブ処理のみに使用され、学習に利用されることはありません。処理後の作業用コピーは一定期間後に削除されます。
タイムスタンプ付き文字起こし(TXT/DOCX)、動画撮影があった場合はSRT/VTT、研究ツールやパイプライン向けのエージェントJSONを出力します。