
Live-Transkription über einen Socket, Zwischenergebnisse zurückgeben, während der Sprecher noch spricht, und ein festgelegtes Transkript, sobald jede Phrase endet.
Live-Transkription über einen Socket, Zwischenergebnisse zurückgeben, während der Sprecher noch spricht, und ein festgelegtes Transkript, sobald jede Phrase endet.
Audio wird als rohe Binärbilder von 16 kHz Mono 16-Bit-PCM hochgeladen. Zwischen- und festgelegte Transkripte erscheinen als Ergebnisereignisse.
Auch bekannt als Deepgram-Nova-3-Stream
deepgram-nova-3-stream/v1/realtimenova-3-streamdeepgram/deepgram-nova-3-streamLive Pay-as-you-go-Preise aus dem EmpirioLabs-Katalog. Du zahlst nur für das, was du nutzt, ohne monatliches Minimum.
Deepgram Nova-3 Stream transkribiert einen Live-Audiostream über einen WebSocket unter wss://api.empiriolabs.ai/v1/realtime?model=deepgram-nova-3-stream, nicht über die HTTP-Endpunkte. Verbinden Sie sich mit der Modell-ID deepgram-nova-3-stream und senden Sie Ihren EmpirioLabs-API-Schlüssel beim Handshake als Authorization: Bearer-Header. Hängen Sie base64-kodiertes 16-Bit-PCM-Audio an und lesen Sie die Transkript-Events, während noch gesprochen wird. Ein Browser kann bei einem WebSocket keine Header setzen. Öffnen Sie diese Verbindung daher von Ihrem Server aus und leiten Sie das Audio über Ihren eigenen Socket an den Browser weiter. Hol dir einen API-Schlüssel im EmpirioLabs Dashboard.
import asyncio, json, os, websockets
async def main():
async with websockets.connect(
"wss://api.empiriolabs.ai/v1/realtime?model=deepgram-nova-3-stream",
additional_headers=[
("Authorization", f"Bearer {os.environ['EMPIRIOLABS_API_KEY']}"),
],
max_size=None,
) as ws:
print(json.loads(await ws.recv())["type"]) # session.created
import base64
# 16-bit PCM microphone audio, base64 encoded, in small chunks.
for chunk in read_microphone_chunks():
await ws.send(json.dumps({
"type": "input_audio_buffer.append",
"audio": base64.b64encode(chunk).decode(),
}))
await ws.send(json.dumps({"type": "input_audio_buffer.commit"}))
async for raw in ws:
event = json.loads(raw)
if event["type"].endswith("input_audio_transcription.delta"):
# "text" is settled transcript; "stash" is still in progress.
if event.get("text"):
print(event["text"], end="", flush=True)
asyncio.run(main())Request-Parameter, die die Deepgram Nova-3 Stream API auf EmpirioLabs unterstützt. Standardwerte gelten, wenn ein Feld weggelassen wird.
| Parameter | Typ | Standard | Bereich / Werte | Beschreibung |
|---|---|---|---|---|
| input_audio_format | enum | linear16 | linear16 | Encoding of the audio you send up: 16 kHz mono 16-bit PCM, as raw binary frames rather than base64. |
| language | string | - | - | Optional language hint. Omit to let the model detect it. |
Live-Transkription über einen WebSocket unter wss://api.empiriolabs.ai/v1/realtime?model=deepgram-nova-3-stream, authentifiziert mit dem gewöhnlichen Authorization Bearer-Header. Senden Sie 16 kHz Mono 16-Bit-PCM als Binärframes und lesen Sie Transkriptereignisse zurück; Zwischenergebnisse erscheinen, während der Sprecher noch spricht, und jede Phrase wird mit is_final eingependelt. Fügen Sie Language= zur Verbindungs-URL hinzu, um eine bestimmte Sprache zu transkribieren. Die Abrechnung erfolgt pro Minute des gesendeten Audios.
Auf EmpirioLabs wird Deepgram Nova-3 Stream nach Verbrauch abgerechnet: Transkription $0.025 pro Minute Audio. Die Live-Preistabelle auf dieser Seite entspricht immer dem, was die API berechnet.
Deepgram Nova-3 Stream wird über WEBSOCKET /v1/realtime auf api.empiriolabs.ai mit normaler Bearer-Token-Authentifizierung bereitgestellt.
Deepgram Nova-3 Stream läuft über einen WebSocket statt über Anfrage und Antwort, beginnen Sie deshalb mit dem Schnellstart für Echtzeit-Sprache. Verbinden Sie sich von Ihrem Server aus mit Ihrem EmpirioLabs-API-Schlüssel und der Modell-ID deepgram-nova-3-stream und streamen Sie dann Audio in beide Richtungen.
Erstelle ein EmpirioLabs-Konto und generiere dann einen Schlüssel unter API Keys im Dashboard. Die Abrechnung erfolgt über Pay-as-you-go-Guthaben, du zahlst also nur für deine Requests.
Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.