Modelos de fala para texto para transcrição rápida e precisa.
Modelos de transcrição EmpirioLabs transformam áudio (e, para alguns, vídeo) em texto, com recursos como carimbos de data de data, detecção de idiomas ou tradução, dependendo do modelo. Aponte para um arquivo ou URL e leia a transcrição, cobrada por minuto de áudio.
Whisper Large v3 Turbo roda por POST /v1/audio/transcriptions. A requisição retorna um job_id na hora; consulte GET /v1/jobs/{job_id} até o job terminar e leia as URLs de saída do resultado. Troque o id model por qualquer modelo acima. Obtenha uma chave de API no painel EmpirioLabs.
curl https://api.empiriolabs.ai/v1/audio/transcriptions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "whisper-large-v3-turbo",
"audio_url": "https://example.com/meeting-recording.mp3"
}'A EmpirioLabs lista 4 APIs de modelos de Transcrição, incluindo Whisper Large v3 Turbo, Deepgram Nova 3, OpenAI Whisper 1. Cada modelo tem sua própria página de API com preços ao vivo, parâmetros e um quickstart.
Cada modelo de Transcrição é cobrado por uso, sem mínimo mensal. A tabela de tarifas exata fica na página de cada modelo e sempre corresponde ao que a API cobra.
Não. Todo modelo aqui roda no playground da EmpirioLabs, uma interface amigável no navegador onde você ajusta as opções e vê resultados sem escrever código. Quando quiser automatizar, o mesmo modelo está disponível pela API.
Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.