
Fala para texto para clipes curtos e gravações longas, com segmentos de frases, carimbos de data e datação de palavras e reconhecimento multilíngue e dialetal chinês.
Fala para texto para clipes curtos e gravações longas, com segmentos de frases, carimbos de data e datação de palavras e reconhecimento multilíngue e dialetal chinês.
Envie um arquivo ou passe uma URL de áudio. O idioma é detectado automaticamente.
Também conhecido como Qwen Audio ASR, Alibaba Cloud Qwen Audio 3.1 ASR
qwen-audio-3-1-asr/v1/audio/transcriptionsqwen-audio-3.1-asralibaba/qwen-audio-3-1-asrTarifas pay-as-you-go ao vivo do catálogo EmpirioLabs. Você paga só pelo que usa, sem mínimo mensal.
Qwen Audio 3.1 ASR roda por POST /v1/audio/transcriptions. A requisição retorna um job_id na hora; consulte GET /v1/jobs/{job_id} até o job terminar e leia as URLs de saída do resultado. Obtenha uma chave de API no painel EmpirioLabs.
curl https://api.empiriolabs.ai/v1/audio/transcriptions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen-audio-3-1-asr",
"audio_url": "https://example.com/meeting-recording.mp3"
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/audio/transcriptions",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "qwen-audio-3-1-asr",
"audio_url": "https://example.com/meeting-recording.mp3",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)Enviando áudio Envie um arquivo como file multiparte, ou JSON com audio_url ou audio_base64, em formatos de áudio comuns. Clipes curtos e gravações longas são aceitos. Obtendo o resultado A solicitação retorna imediatamente um job_id e um poll_url. A pesquisa GET /v1/jobs/<job-id> até status ser completed. Clipes curtos terminam em segundos; gravações longas demoram mais. O que retorna O result do trabalho concluído contém a transcrição completa como text, segmentos de frases com horários de início e término, e carimbos de tempo das palavras. O idioma é detectado automaticamente, incluindo dialetos chineses. Faturamento Tokens de entrada e saída são precificados por 1M, e cada requisição é cobrada a partir do uso que o modelo reporta.
Na EmpirioLabs, Qwen Audio 3.1 ASR é cobrado por uso: Entrada $0.30 por 1M de tokens de entrada de áudio; Saída $0.94 por 1M de tokens gerados. A tabela de tarifas ao vivo desta página sempre corresponde ao que a API cobra.
Qwen Audio 3.1 ASR é servido por POST /v1/audio/transcriptions em api.empiriolabs.ai com autenticação padrão por token Bearer.
Sim. O playground da EmpirioLabs executa Qwen Audio 3.1 ASR no navegador com os mesmos parâmetros que a API expõe, para você testar prompts antes de escrever código.
Crie uma conta EmpirioLabs e gere uma chave em API Keys no painel. A cobrança usa créditos pay-as-you-go, então você paga apenas pelas requisições que faz.
Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.