
Whisper-1 speech-to-text transcrição treinada em áudio supervisionado multilingue, com um limite de upload de 25 MB por arquivo.
Whisper-1 speech-to-text transcrição treinada em áudio supervisionado multilingue, com um limite de upload de 25 MB por arquivo.
Também conhecido como OpenAI-Whisper-1
openai-whisper-1/v1/audio/transcriptionsopenai-whisperwhisper-1Tarifas pay-as-you-go ao vivo do catálogo EmpirioLabs. Você paga só pelo que usa, sem mínimo mensal.
OpenAI Whisper 1 roda por POST /v1/audio/transcriptions. A requisição retorna um job_id na hora; consulte GET /v1/jobs/{job_id} até o job terminar e leia as URLs de saída do resultado. Obtenha uma chave de API no painel EmpirioLabs.
curl https://api.empiriolabs.ai/v1/audio/transcriptions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openai-whisper-1",
"audio_url": "https://example.com/meeting-recording.mp3"
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/audio/transcriptions",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "openai-whisper-1",
"audio_url": "https://example.com/meeting-recording.mp3",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)Parâmetros de requisição suportados pela API OpenAI Whisper 1 na EmpirioLabs. Os padrões valem quando um campo é omitido.
| Parâmetro | Tipo | Padrão | Intervalo / valores | Descrição |
|---|---|---|---|---|
| file | string | - | - | Arquivo de áudio (upload em múltiplas partes) OU usar file_url para o caminho JSON. |
| file_url | string | - | - | URL pública para buscar áudio (alternativa ao upload de arquivo). |
| translate | boolean | false | - | Se for verdade, faça roteamento para /audio/translations e traduza para o inglês em vez de transcrever na língua de origem. |
| timestamps | boolean | false | - | Opção de conveniência. Se for verdadeiro, estabelece response_format=verbose_json e inclui timestamp_granularities em nível de palavra. |
| language | string | - | - | Código opcional da língua ISO-639-1. Detectado automaticamente se for omitido. Ignorado quando traduz=verdadeiro. |
| prompt | string | - | - | Glossário ou contexto prévio para viesar o modelo. |
| response_format | enum | json | json, text, srt, verbose_json, vtt | Sobrescrito para verbose_json quando timestamps=true. |
| temperature | number | 0 | 0 a 1 | Temperatura de amostragem. |
| timestamp_granularities | string | - | - | Lista separada por vírgula: palavra, segmento. Usado quando response_format=verbose_json. |
Na EmpirioLabs, OpenAI Whisper 1 é cobrado por uso: Por minuto de áudio $0.030 por minuto. A tabela de tarifas ao vivo desta página sempre corresponde ao que a API cobra.
OpenAI Whisper 1 é servido por POST /v1/audio/transcriptions em api.empiriolabs.ai com autenticação padrão por token Bearer.
Sim. O playground da EmpirioLabs executa OpenAI Whisper 1 no navegador com os mesmos parâmetros que a API expõe, para você testar prompts antes de escrever código.
Crie uma conta EmpirioLabs e gere uma chave em API Keys no painel. A cobrança usa créditos pay-as-you-go, então você paga apenas pelas requisições que faz.
Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.