
الترجمة المنطوقة في نفس الوقت عبر WebSocket. قم بتعيين اللغة المستهدفة، ثم التحدث؛ يرد النموذج بتلك اللغة بالنص والصوت.
الترجمة المنطوقة في نفس الوقت عبر WebSocket. قم بتعيين اللغة المستهدفة، ثم التحدث؛ يرد النموذج بتلك اللغة بالنص والصوت.
يتم تكوين الجلسة باستخدام أحداث session.update عبر المنفذ بدلا من معلمات الطلب. اللغة المستهدفة مطلوبة. رموز النص والصوت تفرض فواتير بمعدلات منفصلة.
يعرف أيضا باسم Alibaba Cloud Qwen3.8 LiveTranslate Flash Realtime
qwen3-8-livetranslate-flash-realtime/v1/realtimeqwen3.8-livetranslate-flash-realtimealibaba/qwen3-8-livetranslate-flash-realtimeأسعار الدفع حسب الاستخدام مباشرة من كتالوج EmpirioLabs. تدفع فقط مقابل ما تستخدمه، بدون حد أدنى شهري.
يقدّم Qwen3.8 LiveTranslate Flash Realtime ترجمة منطوقة مباشرة عبر WebSocket على wss://api.empiriolabs.ai/v1/realtime?model=qwen3-8-livetranslate-flash-realtime، وليس عبر نقاط نهاية HTTP. اتصل باستخدام معرف النموذج qwen3-8-livetranslate-flash-realtime وأرسل مفتاح EmpirioLabs API في ترويسة Authorization: Bearer أثناء المصافحة. عيّن اللغة الهدف عبر session.update قبل إرسال الصوت. ينتقل الصوت في الاتجاهين بصيغة PCM 16-بت مرمّزة بـ base64. لا يستطيع المتصفح ضبط الترويسات على WebSocket، لذا افتح هذا الاتصال من خادمك ومرّر الصوت إلى المتصفح عبر مقبسك الخاص. احصل على مفتاح API من لوحة تحكم EmpirioLabs.
import asyncio, json, os, websockets
async def main():
async with websockets.connect(
"wss://api.empiriolabs.ai/v1/realtime?model=qwen3-8-livetranslate-flash-realtime",
additional_headers=[
("Authorization", f"Bearer {os.environ['EMPIRIOLABS_API_KEY']}"),
],
max_size=None,
) as ws:
print(json.loads(await ws.recv())["type"]) # session.created
import base64
await ws.send(json.dumps({
"type": "session.update",
"session": {
"voice": "Tina",
"translation": {"language": "en"},
"modalities": ["text", "audio"],
},
}))
# 16-bit PCM microphone audio, base64 encoded, in small chunks.
for chunk in read_microphone_chunks():
await ws.send(json.dumps({
"type": "input_audio_buffer.append",
"audio": base64.b64encode(chunk).decode(),
}))
async for raw in ws:
event = json.loads(raw)
if event["type"] == "response.audio.delta":
... # base64 audio chunk, append to your playback buffer
elif event["type"] in ("response.audio_transcript.text", "response.text.text"):
print(event.get("text") or "")
elif event["type"] == "response.done":
break
asyncio.run(main())معلمات الطلب التي تدعمها واجهة Qwen3.8 LiveTranslate Flash Realtime API على EmpirioLabs. تُطبق القيم الافتراضية عند حذف أي حقل.
| المعامل | النوع | الافتراضي | النطاق / القيم | الوصف |
|---|---|---|---|---|
| voice | enum | Tina | Tina, Serena, Ethan, Cindy | الصوت المتحدث للصوت المترجم. قم بضبطه مع session.update قبل أن ينتج النموذج أي صوت. |
| target_language | enum | en | zh, en, ar, de, fr, es, pt, id, it, ko, ru, th, vi, ja, tr, h... | اللغة التي يترجم إليها النموذج. مطلوب. ضبطها مع session.update قبل إرسال الصوت. |
| source_language | enum | auto | auto, zh, en, ar, de, fr, es, pt, id, it, ko, ru, th, vi, ja,... | اللغة التي تتحدثين بها. اترك التلقائية لتسمح للنموذج باكتشافها. |
| modalities | string | ["text","audio"] | - | أي نوع من الإخراج يعيدها النموذج للدور. اترك الصوت لترجمة نصية فقط. |
| input_audio_format | enum | pcm | pcm | ترميز الصوت الذي ترفقه إلى مخزن الإدخال: base64 PCM 16-بت. |
| output_audio_format | enum | pcm | pcm | ترميز الصوت الذي يبثه النموذج مرة أخرى: base64 PCM 16-بت. |
الترجمة المنطوقة عبر WebSocket على wss://api.empiriolabs.ai/v1/realtime?model=qwen3-8-livetranslate-flash-realtime، وتم التحقق منها باستخدام رأس حامل التفويض العادي. قم بتعيين اللغة المستهدفة باستخدام session.update قبل إرسال الصوت. استخدم صوتا يقبله هذا النموذج، أو اترك النسخة الافتراضية من Tina. يتم تسعير رموز الصوت والنص بشكل منفصل، ويتم احتساب كل دور مكتمل بشكل مستقل من الاستخدام الذي يبلغ عنه النموذج.
على EmpirioLabs، تتم فوترة Qwen3.8 LiveTranslate Flash Realtime حسب الاستخدام: الإدخال: الصوت $15.00 لكل 1M رموز إدخال صوت; المدخلات $1.10 لكل 1M رموز مطالبة; الإنتاج $40.00 لكل مليون رمز مولد; المخرج: الصوت $60.00 لكل مليون رمز صوتي مولد. جدول الأسعار المباشر في هذه الصفحة يطابق دائمًا ما تحتسبه الواجهة.
يدعم Qwen3.8 LiveTranslate Flash Realtime نافذة سياق من 53K رمز، مع ما يصل إلى 4,096 رمز إخراج لكل استجابة.
يُقدَّم Qwen3.8 LiveTranslate Flash Realtime عبر WEBSOCKET /v1/realtime على api.empiriolabs.ai مع مصادقة Bearer القياسية.
افتح ملعب EmpirioLabs واضغط Start session لتجربته في المتصفح. يعمل Qwen3.8 LiveTranslate Flash Realtime عبر WebSocket بدلاً من طلب واستجابة، لذا ابدأ من دليل البدء السريع للصوت الفوري عند الدمج. اتصل من خادمك باستخدام مفتاح EmpirioLabs API ومعرف النموذج qwen3-8-livetranslate-flash-realtime، ثم مرّر الصوت في الاتجاهين.
أنشئ حساب EmpirioLabs ثم أنشئ مفتاحًا من API Keys في لوحة التحكم. الفوترة برصيد الدفع حسب الاستخدام، فلا تدفع إلا مقابل الطلبات التي تنفذها.
تحقق من تسعيرنا أو تواصل إذا كنت ترغب في نشر نموذجك الخاص على مجموعتنا.