Qwen3.8 Flash هو أحدث نموذج متعدد الوسائط في عائلة Qwen3.8 من علي بابا، تم إصداره في 26 أغسطس 2026، مصمم للبرمجة السريعة ومنخفضة التكلفة والعمل على الوكيل والرؤية. يربط سياق رمز بحجم مليون دولار مع فهم للنص والصورة والفيديو، والتفكير العميق الذي يعمل افتراضيا، ونفس الأدوات الخمسة المدمجة مثل Qwen3.8 Max.
Qwen3.8 Flash متاح على EmpirioLabs اليوم من خلال واجهة برمجة تطبيقات متوافقة مع OpenAI، مع استدعاء للوظائف، ومخرجات هيكلية صارمة لمخطط JSON، وبث، ورموز إخراج تصل إلى 128K. جربها في الملعب أو استدعاه من أي عميل متوافق مع OpenAI. المواصفات الكاملة وأسعار السعر الحالية موجودة على صفحة موديل فلاش Qwen3.8 و وثائق واجهة برمجة التطبيقات.
التسعير
الفوترة تعتمد على الاستخدام بمعدل إدخال ثابت واحد ومعدل إخراج ثابت عند كل حجم مطالبة، ولا يوجد طبقة ذاكرة تخزين مؤقت منفصلة. البحث على الويب، والبحث text-to-image، والبحث image-to-image يضيف رسوما صغيرة لكل مكالمة تنطبق فقط عند تشغيل المكالمة فعليا؛ يعمل مستخرج الويب ومفسر الشيفرة دون تكلفة إضافية. الأسعار الحالية دائما قائمة على صفحة النماذج و صفحة الأسعار، والتي تبقى متزامنة مع ما تفرض عليك.
البداية السريعة
وجه أي حزمة تطوير OpenAI إلى رابط القاعدة EmpirioLabs ومررها qwen3-8-flash كنموذج:
من استيراد openai OpenAI client = OpenAI(base_url="https://api.empiriolabs.ai/v1", api_key="YOUR_EMPIRIOLABS_API_KEY",) resp = client.chat.completions.create(model="qwen3-8-flash", messages=[ {"role": "user", "content": [ {"type": "text", "text": "ماذا يحدث في هذا الرسم البياني؟"}, {"type": "image_url", "image_url": {"url": "https://example.com/chart.png"}}, ]}, ], extra_body={"enable_thinking": صحيح، "thinking_budget": 8192},) print(resp.choices[0].message.content)
نفس معرف الموديل يعمل عليه /v1/responses، الشكل الأنثروبي /v1/messages، والبرنامج المتوافق مع جوجل /v1beta/models/qwen3-8-flash:generate Content الطريق. المعرف البديل qwen3.8-flash تحل إلى نفس النموذج.
التفكير
التفكير العميق يعمل بشكل افتراضي ويبث مرة أخرى ك reasoning_content إلى جانب الإجابة. تحكم بها enable_thinking و التفكير - الميزانية (حتى 262,144 رمزا)، أو إرسال reasoning_effort والمنصة تحدد الميزانية المناسبة للنموذج. رموز التفكير تعتبر رموز إخراج، لذا قم بتعطيل التفكير أو حدد ميزانية صغيرة للدورات القصيرة الحساسة للزمن.
أدوات البناء
خمسة أدوات مدمجة خلفها الأداة* التبديل السري: tool_web_search, tool_web_extractor, tool_code_interpreter, tool_web_search_image، و tool_image_search. يتطلب مستخرج الويب بحثا على الويب، وكل من المستخرج ومفسر الشيفرة يعملان فقط أثناء تفعيل التفكير. عندما تعمل الأدوات، يكون الرد الاستخدام. تقوم MAP بتسجيل عدد المكالمات التي تم إجراؤها بدقة، حتى تتمكن من مراجعة الفوترة لكل أداة.
النواتج الهيكلية
للحصول على شكل استجابة دقيق، مرر response_format مع {"type": "json_schema",...} و "صارم": صحيح: النموذج يعيد مفاتيح المخطط بالضبط دون إضافات. وضع JSON العادي مع {"نوع": "جيسون-هجوم" كما أنه مدعوم.
أشياء تستحق المعرفة قبل مكالمتك الأولى
- جميع الأدوات الخمسة المدمجة توضع افتراضيا على التشغيل، وتبحث عن الفاتورة لكل مكالمة يتم استدعاؤها. يمكن لطلب واحد أن يشغل بحثا على الويب عدة مرات، ويتم احتساب كل استدعاء. للدردشة العادية بدون رسوم أدوات، قم بتعيين
tool_web_search,tool_web_search_image، وtool_image_searchإلىكاذب. "المطلوب"لا يعمل أثناء تفكير. تم رفض الطلب بوجود خطأ واضح. احتفظtool_choice: "أوتو"مع تفعيل التفكير، أو مع تعيينenable_thinking: خاطئعندما تحتاج إلى فرض استدعاء وظيفة.- وضع JSON يحتاج إلى كلمة "json" في رسائلك. A
{"نوع": "جيسون-هجوم"يتم رفض الطلب إلا إذا ظهرت الكلمة في مكان ما أثناء المحادثة. طلبات مخطط JSON لا تتطلب مثل هذا الشرط.
Qwen3.8 Flash متوفر الآن في الملعب ومن خلال واجهة برمجة التطبيقات EmpirioLabs.



