
Whisper-1 speech-to-text transcripción entrenada con audio supervisado multilingüe, con un límite de subida de 25 MB por archivo.
Whisper-1 speech-to-text transcripción entrenada con audio supervisado multilingüe, con un límite de subida de 25 MB por archivo.
También conocido como OpenAI-Whisper-1
openai-whisper-1/v1/audio/transcriptionsopenai-whisperwhisper-1Tarifas de pago por uso en vivo del catálogo de EmpirioLabs. Solo pagas por lo que usas, sin mínimo mensual.
OpenAI Whisper 1 funciona a través de POST /v1/audio/transcriptions. La solicitud devuelve un job_id de inmediato; consulta GET /v1/jobs/{job_id} hasta que el trabajo termine y lee las URLs de salida del resultado. Consigue una clave de API en el panel de EmpirioLabs.
curl https://api.empiriolabs.ai/v1/audio/transcriptions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openai-whisper-1",
"audio_url": "https://example.com/meeting-recording.mp3"
}'curl https://api.empiriolabs.ai/v1/jobs/JOB_ID \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY"import requests
response = requests.post(
"https://api.empiriolabs.ai/v1/audio/transcriptions",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
json={
"model": "openai-whisper-1",
"audio_url": "https://example.com/meeting-recording.mp3",
},
)
job = response.json()
# Generation runs as an async job. Poll until it completes.
import time
while True:
status = requests.get(
f"https://api.empiriolabs.ai/v1/jobs/{job['job_id']}",
headers={"Authorization": "Bearer YOUR_EMPIRIOLABS_API_KEY"},
).json()
if status.get("status") in ("completed", "failed"):
print(status)
break
time.sleep(5)Parámetros de solicitud compatibles con la API de OpenAI Whisper 1 en EmpirioLabs. Los valores por defecto se aplican cuando se omite un campo.
| Parámetro | Tipo | Predeterminado | Rango / valores | Descripción |
|---|---|---|---|---|
| file | string | - | - | Audio (subida multiparte) O usar file_url para la ruta JSON. |
| file_url | string | - | - | URL pública para obtener audio (alternativa a la subida de archivos). |
| translate | boolean | false | - | Si es cierto, enruta a /audio/translations y traduce al inglés en lugar de transcribir en el idioma fuente. |
| timestamps | boolean | false | - | Interruptor de conveniencia. Si es cierto, se establece response_format=verbose_json e incluye timestamp_granularities a nivel de palabra. |
| language | string | - | - | Código opcional de idioma ISO-639-1. Se detecta automáticamente si se omite. Ignorado cuando translate=true. |
| prompt | string | - | - | Glosario o contexto previo para sesgar el modelo. |
| response_format | enum | json | json, text, srt, verbose_json, vtt | Se sobrescribe para verbose_json cuando marcas de tiempo=verdadero. |
| temperature | number | 0 | 0 a 1 | Temperatura de muestreo. |
| timestamp_granularities | string | - | - | Lista separada por comas: palabra, segmento. Se usa cuando response_format=verbose_json. |
En EmpirioLabs, OpenAI Whisper 1 se factura por uso: Por minuto de audio $0.030 por minuto. La tabla de tarifas en vivo de esta página siempre coincide con lo que cobra la API.
OpenAI Whisper 1 se sirve a través de POST /v1/audio/transcriptions en api.empiriolabs.ai con autenticación estándar de token Bearer.
Sí. El playground de EmpirioLabs ejecuta OpenAI Whisper 1 en el navegador con los mismos parámetros que expone la API, para que pruebes prompts antes de escribir código.
Crea una cuenta de EmpirioLabs y genera una clave en API Keys en el panel. La facturación es con créditos de pago por uso, así que solo pagas por las solicitudes que haces.
Consulta nuestros precios o contacta con nosotros si quieres que tu propio modelo se implemente en nuestra pila.