MP3-Aufnahmen in timestampierten Text umwandeln — mit TXT-, DOCX-, SRT- und Agent-JSON-Export. Kostenlose 3-Minuten-Vorschau, ohne Karte.
Die gleiche zuverlässige Vocce-Pipeline, fokussiert auf diese Aufgabe. Kostenlos starten, dann Pläne ab $9.90/Monat, wenn du mehr brauchst.
MP3 ist das Format, in dem die meisten Aufnahmen landen — die Sprachnotiz, die heruntergeladene Folge, die Diktiergerät-Datei, der Export aus einem Call. Aus diesem MP3 Text zu machen ist der Unterschied zwischen einer Stunde, die du nochmal durchhören musst, und einer Seite, die du in Sekunden durchsuchst.
Ob das MP3 ein sauberer Studio-Bounce oder eine 64kbps-Telefonaufnahme ist, spielt keine Rolle. Vocce gleicht die Lautstärke an, senkt das Rauschen und transkribiert mit Wort-für-Wort-Zeitstempeln — Sprache übersteht starke Kompression weit besser als Musik, daher liefern selbst niedrige Bitraten genaue Ergebnisse.
Du bekommst Klartext, eine Zusammenfassung mit den Action Items, SRT/VTT falls du Untertitel brauchst, und ein JSON-Schema für Pipelines. Drei kostenlose Minuten pro Datei, um die Qualität zu prüfen — und keine Berechnung, falls ein Job fehlschlägt.
Selbst 64kbps-Sprach-MP3s werden sauber transkribiert — Sprache hält Kompression aus, wo Musik zerfällt.
Lautstärke-Angleichung und Rauschunterdrückung laufen zuerst — leise Sprecher und Hintergrundbrummen landen nicht als leere Lücken im Text.
Jede Zeile ist an das Audio gebunden; mehrstündige Dateien werden in Chunks transkribiert und ohne Drift zusammengesetzt.
Automatisch erkannt oder selbst eingestellt, wenn du sichergehen willst.
TXT, Markdown, DOCX, SRT, VTT und ein sauberes JSON-Schema — keine Read-only-Box zum Rauskopieren.
Derselbe Job läuft über API, CLI oder MCP-Server — ein ganzes Archiv auf einmal durchschleusen.
MP3 ist das Standard-Aufnahmeformat — mach Episoden und Interviews in durchsuchbaren, zitierfähigen Text.
Recorder und Apps, die MP3 speichern, liefern direkt saubere Transkripte.
Jahre alter MP3-Aufnahmen mit einem Batch-Durchlauf textdurchsuchbar machen.
Lad die MP3 oben hoch. Vocce bereinigt das Audio, transkribiert es mit Zeitstempeln und exportiert TXT, DOCX, SRT/VTT und Agent-JSON. Die ersten 3 Minuten sind kostenlos, ohne Karte.
Die Genauigkeit folgt der Audioqualität — deshalb werden Dateien vor der Erkennung entrauscht und lautstärkenormalisiert. Der Qualitätsbericht und Low-Confidence-Flags zeigen dir genau, was du gegenchecken solltest.
Ja — selbst 64kbps-Sprachaufnahmen werden sauber transkribiert, da Sprache Kompression weit besser übersteht als Musik.
Lange Dateien werden gechunkt, parallel transkribiert und ohne Zeitstempel-Drift zusammengesetzt.