
WebSocket पर एक साथ बोला जाने वाला अनुवाद। लक्ष्य भाषा सेट करें, फिर बोलें; मॉडल उस भाषा में पाठ और ऑडियो के साथ उत्तर देता है।
WebSocket पर एक साथ बोला जाने वाला अनुवाद। लक्ष्य भाषा सेट करें, फिर बोलें; मॉडल उस भाषा में पाठ और ऑडियो के साथ उत्तर देता है।
सत्र अनुरोध मापदंडों के बजाय सॉकेट पर session.update ईवेंट के साथ कॉन्फ़िगर किया गया है। लक्ष्य भाषा की आवश्यकता है। पाठ और ऑडियो टोकन अलग-अलग दरों पर बिल करते हैं।
इस नाम से भी जाना जाता है Alibaba Cloud Qwen3.8 LiveTranslate Flash Realtime
qwen3-8-livetranslate-flash-realtime/v1/realtimeqwen3.8-livetranslate-flash-realtimealibaba/qwen3-8-livetranslate-flash-realtimeEmpirioLabs कैटलॉग से लाइव pay-as-you-go दरें। आप सिर्फ उतना ही भुगतान करते हैं जितना उपयोग करते हैं, कोई मासिक न्यूनतम नहीं।
Qwen3.8 LiveTranslate Flash Realtime HTTP एंडपॉइंट के बजाय wss://api.empiriolabs.ai/v1/realtime?model=qwen3-8-livetranslate-flash-realtime पर एक WebSocket के ज़रिए बोली का अनुवाद करता है। मॉडल id qwen3-8-livetranslate-flash-realtime के साथ कनेक्ट करें और हैंडशेक पर अपनी EmpirioLabs API key को Authorization: Bearer हेडर के रूप में भेजें। ऑडियो भेजने से पहले session.update से लक्ष्य भाषा सेट करें। ऑडियो दोनों दिशाओं में base64 16-bit PCM के रूप में जाता है। ब्राउज़र WebSocket पर हेडर सेट नहीं कर सकता, इसलिए यह कनेक्शन अपने सर्वर से खोलें और ऑडियो को अपने सॉकेट के ज़रिए ब्राउज़र तक पहुँचाएँ। EmpirioLabs डैशबोर्ड से API key प्राप्त करें।
import asyncio, json, os, websockets
async def main():
async with websockets.connect(
"wss://api.empiriolabs.ai/v1/realtime?model=qwen3-8-livetranslate-flash-realtime",
additional_headers=[
("Authorization", f"Bearer {os.environ['EMPIRIOLABS_API_KEY']}"),
],
max_size=None,
) as ws:
print(json.loads(await ws.recv())["type"]) # session.created
import base64
await ws.send(json.dumps({
"type": "session.update",
"session": {
"voice": "Tina",
"translation": {"language": "en"},
"modalities": ["text", "audio"],
},
}))
# 16-bit PCM microphone audio, base64 encoded, in small chunks.
for chunk in read_microphone_chunks():
await ws.send(json.dumps({
"type": "input_audio_buffer.append",
"audio": base64.b64encode(chunk).decode(),
}))
async for raw in ws:
event = json.loads(raw)
if event["type"] == "response.audio.delta":
... # base64 audio chunk, append to your playback buffer
elif event["type"] in ("response.audio_transcript.text", "response.text.text"):
print(event.get("text") or "")
elif event["type"] == "response.done":
break
asyncio.run(main())EmpirioLabs पर Qwen3.8 LiveTranslate Flash Realtime API द्वारा समर्थित request पैरामीटर। फ़ील्ड छोड़ने पर डिफ़ॉल्ट मान लागू होते हैं।
| पैरामीटर | प्रकार | डिफॉल्ट | रेंज / मान | विवरण |
|---|---|---|---|---|
| voice | enum | Tina | Tina, Serena, Ethan, Cindy | अनुवादित ऑडियो के लिए बोलने वाली आवाज। मॉडल द्वारा कोई ऑडियो बनाने से पहले इसे session.update के साथ सेट करें। |
| target_language | enum | en | zh, en, ar, de, fr, es, pt, id, it, ko, ru, th, vi, ja, tr, h... | मॉडल जिस भाषा में अनुवाद करता है। आवश्यक। ऑडियो भेजने से पहले इसे session.update के साथ सेट करें। |
| source_language | enum | auto | auto, zh, en, ar, de, fr, es, pt, id, it, ko, ru, th, vi, ja,... | आप जिस भाषा में बोल रहे हैं। मॉडल को इसका पता लगाने देने के लिए ऑटो छोड़ दें। |
| modalities | string | ["text","audio"] | - | कौन सा आउटपुट प्रकार मॉडल एक मोड़ के लिए लौटाता है। केवल-पाठ अनुवाद के लिए ऑडियो ड्रॉप करें। |
| input_audio_format | enum | pcm | pcm | आपके द्वारा इनपुट बफर में जोड़े गए ऑडियो की एन्कोडिंग: base64 16-बिट पीसीएम। |
| output_audio_format | enum | pcm | pcm | ऑडियो की एन्कोडिंग मॉडल वापस स्ट्रीम करता है: base64 16-बिट पीसीएम। |
wss://api.empiriolabs.ai/v1/realtime?model=qwen3-8-livetranslate-flash-realtime पर WebSocket पर बोले गए अनुवाद, साधारण प्राधिकरण वाहक हेडर के साथ प्रमाणित। ऑडियो भेजने से पहले session.update के साथ लक्ष्य भाषा सेट करें। उस आवाज़ का उपयोग करें जिसे यह मॉडल स्वीकार करता है, या डिफ़ॉल्ट टीना छोड़ दें। ऑडियो और टेक्स्ट टोकन की कीमत अलग-अलग होती है, और प्रत्येक पूर्ण मोड़ को मॉडल रिपोर्ट के उपयोग से अपने आप बिल किया जाता है।
EmpirioLabs पर Qwen3.8 LiveTranslate Flash Realtime का बिल उपयोग के अनुसार बनता है: इनपुट: ऑडियो $15.00 प्रति 1M ऑडियो इनपुट टोकन; इनपुट $1.10 प्रति 1M प्रॉम्प्ट टोकन; उत्पादन $40.00 प्रति 1M जेनरेट किए गए टोकन; आउटपुट: ऑडियो $60.00 प्रति 1M जनरेट किए गए ऑडियो टोकन। इस पेज की लाइव दर तालिका हमेशा API की वास्तविक बिलिंग से मेल खाती है।
Qwen3.8 LiveTranslate Flash Realtime 53K टोकन की context window समर्थित करता है, प्रति उत्तर अधिकतम 4,096 आउटपुट टोकन के साथ।
Qwen3.8 LiveTranslate Flash Realtime api.empiriolabs.ai पर WEBSOCKET /v1/realtime के ज़रिए मिलता है, मानक Bearer टोकन प्रमाणीकरण के साथ।
EmpirioLabs playground खोलें और Start session दबाकर इसे अपने ब्राउज़र में आज़माएँ। Qwen3.8 LiveTranslate Flash Realtime अनुरोध और प्रतिक्रिया के बजाय WebSocket पर चलता है, इसलिए इसे जोड़ने के लिए रियलटाइम वॉइस क्विकस्टार्ट से शुरू करें। अपनी EmpirioLabs API key और मॉडल id qwen3-8-livetranslate-flash-realtime के साथ अपने सर्वर से कनेक्ट करें, फिर दोनों दिशाओं में ऑडियो स्ट्रीम करें।
EmpirioLabs खाता बनाएं, फिर डैशबोर्ड में API Keys में key जनरेट करें। बिलिंग pay-as-you-go क्रेडिट से होती है, इसलिए आप सिर्फ अपनी requests का भुगतान करते हैं।
हमारे मूल्य निर्धारण की जाँच करें या यदि आप चाहते हैं कि आपका अपना मॉडल हमारे स्टैक पर तैनात किया जाए, तो पहुंचें।