Modelos de reconocimiento de voz para transcripciones rápidas y precisas.
Los modelos de transcripción EmpirioLabs convertir audio (y, en algunos casos, vídeo) en texto, con capacidades como marcas de tiempo de palabras, detección de idiomas o traducción, dependiendo del modelo. Apunta a un archivo o URL y lee la transcripción, facturada por minuto de audio.
Whisper Large v3 Turbo funciona a través de POST /v1/audio/transcriptions. La solicitud devuelve un job_id de inmediato; consulta GET /v1/jobs/{job_id} hasta que el trabajo termine y lee las URLs de salida del resultado. Cambia el id model por cualquier modelo de arriba. Consigue una clave de API en el panel de EmpirioLabs.
curl https://api.empiriolabs.ai/v1/audio/transcriptions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "whisper-large-v3-turbo",
"audio_url": "https://example.com/meeting-recording.mp3"
}'EmpirioLabs lista 4 APIs de modelos de Transcripción, incluyendo Whisper Large v3 Turbo, Deepgram Nova 3, OpenAI Whisper 1. Cada modelo tiene su propia página de API con precios en vivo, parámetros y un quickstart.
Cada modelo de Transcripción se factura por uso, sin mínimo mensual. La tabla de tarifas exacta está en la página de cada modelo y siempre coincide con lo que cobra la API.
No. Cada modelo aquí funciona en el playground de EmpirioLabs, una interfaz amigable en el navegador donde ajustas las opciones y ves resultados sin escribir código. Cuando quieras automatizar, el mismo modelo está disponible a través de la API.
Consulta nuestros precios o contacta con nosotros si quieres que tu propio modelo se implemente en nuestra pila.