// CLI de Vídeo para Texto

Automatize transcrições direto do terminal.

Instale um CLI de vídeo para texto pronto para automação. Envie mídia, crie jobs de transcrição, consulte o status e baixe transcrições, legendas, resumos e JSON.

CLIbashJSON
vocce · transcribe● live
Clique ou arraste para enviar
Arquivo de áudio ou vídeo · ≤ 50MB
// runs in your agent, ships to your stack Claude Code Cursor Gemini MCP CLI REST API n8n Zapier Make GitHub Actions Notion HubSpot
// runs in your agent, ships to your stack Claude Code Cursor Gemini MCP CLI REST API n8n Zapier Make GitHub Actions Notion HubSpot
// O que você ganha

Um upload. Cada arquivo que o próximo passo precisa.

O mesmo pipeline confiável do Vocce, focado nessa tarefa. Comece grátis, depois planos a partir de $9.90/mês quando precisar de mais.

vocce create
Job polling
Batch jobs
Transcript + subtitles
Agent JSON
// Como funciona

Como transcrever vídeo pelo terminal

// quem usa cli de vídeo para texto

Feito para fluxos reais.

Pipelines de CI

Transcreva demos de release e vídeos de PR automaticamente com uma GitHub Action ou uma linha de CLI.

Jobs em lote

Varra uma pasta de gravações com `vocce create` e colete transcrições, legendas e JSON.

Fluxos automatizados

Agende uma pasta monitorada com cron, consulte o status dos jobs e entregue os resultados por webhook — sem precisar abrir o dashboard.

// perguntas frequentes

CLI de Vídeo para Texto, respondido.

Como transcrever um vídeo pela linha de comando?+

npx vocce create ./video.mp4 --ops transcribe,subtitles,summary. O CLI faz upload, cria o job e pode monitorar até que suas exportações fiquem prontas.

Dá para processar vários arquivos em lote?+

Sim — os jobs são idempotentes (mesmo input, mesmo job_id), então você pode varrer pastas e repetir sem risco de cobrança duplicada.

Como levar os resultados para o meu sistema?+

Consulte o job, baixe os artefatos diretamente ou registre um webhook e deixe os resultados irem para sua fila ou automação.

A saída é legível por máquina?+

Todo job pode gerar JSON agent.v1 com falas por locutor, timestamps e links para os artefatos — o mesmo schema no CLI, na API e no MCP.