
Transcripción en directo a través de un socket, devolviendo resultados intermedios mientras el hablante sigue hablando y una transcripción establecida una vez que termina cada frase.
Transcripción en directo a través de un socket, devolviendo resultados intermedios mientras el hablante sigue hablando y una transcripción establecida una vez que termina cada frase.
El audio sube como tramas binarias en bruto de PCM mono de 16 bits a 16 kHz. Las transcripciones intermedias y asentadas vuelven como eventos de Resultados.
También conocido como Deepgram-Nova-3-Stream
deepgram-nova-3-stream/v1/realtimenova-3-streamdeepgram/deepgram-nova-3-streamTarifas de pago por uso en vivo del catálogo de EmpirioLabs. Solo pagas por lo que usas, sin mínimo mensual.
Deepgram Nova-3 Stream transcribe un flujo de audio en vivo a través de un WebSocket en wss://api.empiriolabs.ai/v1/realtime?model=deepgram-nova-3-stream, no a través de los endpoints HTTP. Conéctate con el id de modelo deepgram-nova-3-stream y envía tu clave de API de EmpirioLabs como cabecera Authorization: Bearer en el handshake. Añade audio PCM de 16 bits en base64 y lee los eventos de transcripción mientras la persona sigue hablando. Un navegador no puede establecer cabeceras en un WebSocket, así que abre esta conexión desde tu servidor y retransmite el audio al navegador por tu propio socket. Consigue una clave de API en el panel de EmpirioLabs.
import asyncio, json, os, websockets
async def main():
async with websockets.connect(
"wss://api.empiriolabs.ai/v1/realtime?model=deepgram-nova-3-stream",
additional_headers=[
("Authorization", f"Bearer {os.environ['EMPIRIOLABS_API_KEY']}"),
],
max_size=None,
) as ws:
print(json.loads(await ws.recv())["type"]) # session.created
import base64
# 16-bit PCM microphone audio, base64 encoded, in small chunks.
for chunk in read_microphone_chunks():
await ws.send(json.dumps({
"type": "input_audio_buffer.append",
"audio": base64.b64encode(chunk).decode(),
}))
await ws.send(json.dumps({"type": "input_audio_buffer.commit"}))
async for raw in ws:
event = json.loads(raw)
if event["type"].endswith("input_audio_transcription.delta"):
# "text" is settled transcript; "stash" is still in progress.
if event.get("text"):
print(event["text"], end="", flush=True)
asyncio.run(main())Parámetros de solicitud compatibles con la API de Deepgram Nova-3 Stream en EmpirioLabs. Los valores por defecto se aplican cuando se omite un campo.
| Parámetro | Tipo | Predeterminado | Rango / valores | Descripción |
|---|---|---|---|---|
| input_audio_format | enum | linear16 | linear16 | Encoding of the audio you send up: 16 kHz mono 16-bit PCM, as raw binary frames rather than base64. |
| language | string | - | - | Optional language hint. Omit to let the model detect it. |
Transcripción en directo a través de un WebSocket en wss://api.empiriolabs.ai/v1/realtime?model=deepgram-nova-3-stream, autenticada con el encabezado ordinario de Portador de Autorización. Envía PCM mono de 16 bits de 16 kHz como tramas binarias y lee los eventos de transcripción de vuelta; los resultados intermedios llegan mientras el hablante sigue hablando, y cada frase se asienta con is_final. Añadir language= a la URL de conexión para transcribir un idioma específico. La facturación es por minuto del audio que envíes.
En EmpirioLabs, Deepgram Nova-3 Stream se factura por uso: Transcripción $0.025 por minuto de audio. La tabla de tarifas en vivo de esta página siempre coincide con lo que cobra la API.
Deepgram Nova-3 Stream se sirve a través de WEBSOCKET /v1/realtime en api.empiriolabs.ai con autenticación estándar de token Bearer.
Deepgram Nova-3 Stream funciona sobre un WebSocket en lugar de una petición y una respuesta, así que empieza por la guía rápida de voz en tiempo real. Conéctate desde tu servidor con tu clave de API de EmpirioLabs y el id de modelo deepgram-nova-3-stream, y luego transmite audio en ambos sentidos.
Crea una cuenta de EmpirioLabs y genera una clave en API Keys en el panel. La facturación es con créditos de pago por uso, así que solo pagas por las solicitudes que haces.
Consulta nuestros precios o contacta con nosotros si quieres que tu propio modelo se implemente en nuestra pila.