Qwen3.8 Omni Flash هو نموذج الفلاش متعدد الإدخال من علي بابا: يقرأ النصوص، الصور، الصوت، والفيديو، ويرد بالنص. يأتي مع سياق رمز بحجم 1M، معتقدا أنه مفعل بشكل افتراضي، واستدعاء للوظائف، ومخرجات منظمة صارمة لمخطط JSON، وأداة مدمجة واحدة، وهي البحث على الويب.
Qwen3.8 Omni Flash متاح على EmpirioLabs اليوم من خلال واجهة برمجة تطبيقات متوافقة مع OpenAI، مع بث ورموز إخراج تصل إلى 128K. جربه في الملعب أو استدعاه من أي عميل متوافق مع OpenAI. المواصفات الكاملة وأسعار السعر الحالية موجودة على صفحة نموذج Qwen3.8 Omni Flash و وثائق واجهة برمجة التطبيقات.
الشحن في نفس الإطلاق هو Qwen3.8 LiveTranslate Flash Realtime: الترجمة المنطوقة عبر WebSocket. قم بتعيين اللغة المستهدفة، والتحدث، ويرد النموذج بتلك اللغة بالنص والصوت. افتحه في الملعب أو الاتصال ب WSS://api.empiriolabs.ai/v1/realtime?model=qwen3-8-livetranslate-flash-realtime. التفاصيل مباشرة على واجهة برمجة التطبيقات للصوت في الوقت الحقيقي الصفحة.
التسعير
تعتمد فوترة أومني فلاش على الاستخدام بمعدل إدخال ثابت واحد ومعدل إخراج ثابت عند كل حجم طلب. تستخدم رموز الصوت والفيديو نفس معدل الإدخال مثل النص؛ يتم احتساب الموسيقى التصويرية للفيديو كرموز صوتية إلى جانب رموز الفيديو. يضيف البحث على الويب رسوما صغيرة لكل مكالمة تنطبق فقط عند تشغيل المكالمة فعليا. يتم احتساب رموز التفكير كرموز إخراج.
فواتير LiveTranslate تكتمل كل دور مكتمل من الاستخدام الذي يبلغ عنه النموذج، مع أسعار منفصلة للرموز الصوتية والرموز النصية. الأسعار الحالية لكلا الطرازين دائما قائمة على صفحات النماذج و صفحة الأسعار، والتي تبقى متزامنة مع ما تفرض عليك.
البداية السريعة
وجه أي حزمة تطوير OpenAI إلى رابط القاعدة EmpirioLabs ومررها qwen3-8-omni-flash كنموذج:
من openai استيراد عميل OpenAI = OpenAI(base_url="https://api.empiriolabs.ai/v1", api_key="YOUR_EMPIRIOLABS_API_KEY",) resp = client.chat.completions.create(model="qwen3-8-omni-flash", messages=[ {"role": "user", "content": [ {"type": "text", "text": "ما الذي يقال وماذا يظهر على الشاشة؟"}, {"type": "input_audio", "input_audio": { "format": "mp3", "data": "https://example.com/clip.mp3", }}, ]}, ], extra_body={"enable_thinking": صحيح، "thinking_budget": 8192},) print(resp.choices[0].message.content)
نفس معرف الموديل يعمل عليه /v1/responses، الشكل الأنثروبي /v1/messages، والبرنامج المتوافق مع جوجل /v1beta/models/qwen3-8-omni-flash:generate Content الطريق. المعرف البديل qwen3.8-omni-flash تحل إلى نفس النموذج.
LiveTranslate عبر WebSocket
LiveTranslate ليس HTTP. اتصل بمقبس الوقت الحقيقي بنفس مفتاح API الذي تستخدمه في كل مكان آخر، ثم أرسل session.update الذي يحدد اللغة المستهدفة قبل أي صوت:
{"type": "session.update", "session": { "voice": "تينا", "ترجمة": {"language": "en"}, "modalities": ["text", "audio"] }}
ثم أضف صوت الميكروفون ك input_audio_buffer.append الأحداث. النموذج يترجم أثناء حديثك ويبث الصوت مرة أخرى. الأصوات في هذا النموذج هي تينا، سيرينا، إيثان، وسيندي. الهوية البديلة qwen3.8-livetranslate-flash-realtime تحل إلى نفس النموذج. يتم رفض استدعاء إكمال الدردشة على هذا الجهاز؛ النقطة النهائية المعلنة الوحيدة هي المقبس.
التفكير
في أومني فلاش، التفكير العميق يعمل بشكل افتراضي ويعاد بثه ك reasoning_content إلى جانب الإجابة. تحكم بها enable_thinking و thinking_budget (حتى 262,144 رمزا)، أو إرسال reasoning_effort والمنصة تحدد الميزانية المناسبة للنموذج. رموز التفكير تعتبر رموز إخراج، لذا قم بتعطيل التفكير أو حدد ميزانية صغيرة للدورات القصيرة الحساسة للزمن.
الأدوات المدمجة
البحث على الإنترنت عن أومني فلاش خلف tool_web_search و مغلق بشكل افتراضي. هذا النموذج لا يعرض مستخرج الويب أو مفسر الشيفرة أو أدوات البحث بالصور. عند تشغيل البحث، فإن الاستجابة usage.tool_usage تحدد MAP بالضبط عدد المكالمات التي تم إجراؤها، حتى تتمكن من مراجعة الفوترة لكل أداة. يمكن لطلب واحد أن يستدعي البحث أكثر من مرة، وكل مكالمة يتم استدعاؤها يتم تحميلها. لا يوجد بحث ويب في LiveTranslate.
الإنتاج المنظم
للحصول على شكل استجابة دقيق في أومني فلاش، تجاوزها response_format مع {"type": "json_schema",...} و "صارم": صحيح: النموذج يعيد مفاتيح المخطط بالضبط دون إضافات. وضع JSON العادي مع {"type": "json_object"} كما أنه مدعوم.
أشياء تستحق المعرفة قبل مكالمتك الأولى
- أومني فلاش يقرأ الصوت والفيديو، ويرد عليه عبر الرسائل النصية. لا تطلب إخراج صوتي. لا يوجد تحكم صوتي في هذا الطراز.
- أرسل صوت Omni Flash كعنوان URL أو URI بيانات base64. متداخلة
input_audio.dataيجب أن يكون URL أوالبيانات:URI، وليس raw base64. تحميل MP3 playground يستخدمالصيغة: "MPEG"; الذي يطلق علىmp3. tool_choice: "مطلوب"لا يعمل أثناء تفكير. تم رفض الطلب بوجود خطأ واضح. احتفظtool_choice: "أوتو"مع تفعيل التفكير، أو مع تعيينenable_thinking: خاطئعندما تحتاج إلى فرض استدعاء وظيفة.- يحتاج LiveTranslate إلى لغة هدف في أول جلسة تحديث. بدونه، يغلق المقبس قبل إنتاج أي صوت. اترك لغة المصدر غير مضبوطة على الكشف التلقائي.
كلا الطرازين متوفران الآن في playground ومن خلال واجهة برمجة التطبيقات EmpirioLabs.



