동일한 신뢰할 수 있는 Vocce 파이프라인, 이 작업에 집중합니다. 무료로 시작하고, 더 필요하면 월 $9.90부터.
MP3는 대부분의 녹음이 최종적으로 남는 포맷입니다 — 음성 메모, 다운받은 에피소드, 딕터폰 파일, 통화 내보내기. 그 MP3를 텍스트로 바꾸는 건 다시 들어야 하는 1시간과 몇 초 만에 검색할 수 있는 한 페이지의 차이입니다.
스튜디오에서 깔끔하게 내보낸 MP3든, 64kbps짜리 폰 녹음이든 상관없습니다. Vocce가 음량을 정규화하고 노이즈를 잡은 뒤 워드 레벨 타임스탬프와 함께 텍스트로 변환합니다 — 음성은 압축에 강하기 때문에 낮은 비트레이트 파일도 정확하게 나옵니다.
일반 텍스트, 실행 항목이 포함된 요약, 자막용 SRT/VTT, 파이프라인용 JSON 스키마까지 제공합니다. 파일당 3분 무료로 품질을 확인할 수 있고, 실패한 작업은 요금이 부과되지 않습니다.
64kbps 음성 MP3도 정확하게 변환됩니다 — 음성은 압축에 강해서 음악과 달리 품질 저하가 적습니다.
음량 정규화와 노이즈 감소가 먼저 실행되므로, 작은 목소리나 배경 잡음이 빈 공백으로 남지 않습니다.
모든 라인이 오디오에 정확히 고정되며, 수시간 분량의 파일도 분할 처리 후 드리프트 없이 이어붙입니다.
자동 감지되며, 직접 언어를 지정할 수도 있습니다.
TXT, Markdown, DOCX, SRT, VTT, 깔끔한 JSON 스키마 — 복사만 가능한 읽기 전용 박스가 아닙니다.
API, CLI, MCP 서버에서 동일한 작업을 실행할 수 있어 전체 아카이브를 한 번에 처리할 수 있습니다.
MP3는 기본 녹음 포맷입니다 — 에피소드와 인터뷰를 검색 가능하고 인용할 수 있는 텍스트로 바꾸세요.
MP3로 저장하는 녹음기나 앱의 파일을 바로 깔끔한 대본으로 변환합니다.
수년치 MP3 녹음파일을 한 번의 배치 파이프라인으로 텍스트 검색 가능하게 만드세요.
위에 MP3를 업로드하세요. Vocce가 오디오를 정리하고 타임스탬프와 함께 텍스트로 변환한 뒤 TXT, DOCX, SRT/VTT, 에이전트 JSON으로 내보냅니다. 처음 3분은 카드 없이 무료입니다.
정확도는 오디오 품질에 비례하며, 변환 전에 노이즈 제거와 음량 정규화를 거치기 때문에 더 정확합니다. 품질 리포트와 저신뢰도 플래그로 확인이 필요한 부분을 바로 알 수 있습니다.
네 — 64kbps 음성 녹음도 잘 변환됩니다. 음성은 음악보다 압축에 훨씬 강하기 때문입니다.
긴 파일은 분할된 후 병렬로 변환되고 타임스탬프 드리프트 없이 이어붙여집니다.