
Qwen3.6 35B A3B هو نموذج استدلال mixture-of-experts مكون من 256 خبير مع سياق 128K وأدوات دوال ومخرجات JSON منظمة صارمة.
Qwen3.6 35B A3B هو نموذج استدلال mixture-of-experts مكون من 256 خبير مع سياق 128K وأدوات دوال ومخرجات JSON منظمة صارمة.
نص فقط. هذا الإصدار لا يقبل مدخلات الصور أو الفيديو، على عكس Qwen3.6 35B A3B الأساسي. الأوزان تم تقديمها من نسخة W2 من eschamoe ذات البت 2 التي نشرتها Escha Labs (eschalabs.com) ك EschaLabs/Qwen3.6-35B-A3B-Escha-W2 على Hugging Face، تحت Apache-2.0. يتم تكميم الخبراء إلى 2 بت، مختلطة لكل إسقاط (gate_up_proj عند 2-بت و down_proj 3-بت)، والطبقات الكثيفة هي int8، وذاكرة KV هي FP16. تنشر Escha Labs مقارنة الجودة مقابل أساس FP8 لنفس النموذج: تكافؤ أو أفضل في الرياضيات، والدراسات العليا، استخدام الأدوات، والسياق الطويل، وأقل بحوالي 2٪ في المعرفة العامة، وأقل بحوالي 7٪ في توليد الشيفرة ذات الأفق الطويل، وهو الفجوة الواضحة الوحيدة. راجع بطاقة النموذج لجدول الاختبار الكامل والبروتوكول. السلوك يدعم البث، وأدوات الوظائف، ومخرجات JSON المنظمة بما في ذلك المخططات الصارمة، ووضع التفكير مفعل بشكل افتراضي. اضبط enable_thinking=خاطئ للإجابات المباشرة. مع تفكير، يصل الاستدلال إلى reasoning_content والإجابة في المحتوى، لذا اقرأ كلاهما. يمكن تخصيص max_tokens منخفض للتفكير بالكامل على التفكير، لذا اترك مساحة للإجابة. التخزين المؤقت يتم فوترة قراءات الكاش التلقائية للبادئة عند الإبلاغ عنها. لا يتم دعم ضوابط الكاش الصريحة. إلغاء طلب البث في منتصف التوليد يفرض فقط الرموز المنتجة حتى تلك النقطة.
يعرف أيضا باسم EschaLabs/Qwen3.6-35B-A3B-Escha-W2, Alibaba Cloud Qwen3.6 35B A3B
qwen3-6-35b-a3b/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1/completionsPOST/v1beta/models/qwen3-6-35b-a3b:generateContentqwen3.6-35b-a3bqwen/qwen3.6-35b-a3bEschaLabs/Qwen3.6-35B-A3B-Escha-W2أسعار الدفع حسب الاستخدام مباشرة من كتالوج EmpirioLabs. تدفع فقط مقابل ما تستخدمه، بدون حد أدنى شهري.
يقدم Qwen3.6 35B A3B واجهة Chat Completions المتوافقة مع OpenAI. وجّه أي OpenAI SDK إلى https://api.empiriolabs.ai/v1 بمفتاح EmpirioLabs API الخاص بك واستخدم معرّف النموذج qwen3-6-35b-a3b. احصل على مفتاح API من لوحة تحكم EmpirioLabs.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3-6-35b-a3b",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="qwen3-6-35b-a3b",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)معلمات الطلب التي تدعمها واجهة Qwen3.6 35B A3B API على EmpirioLabs. تُطبق القيم الافتراضية عند حذف أي حقل.
| المعامل | النوع | الافتراضي | النطاق / القيم | الوصف |
|---|---|---|---|---|
| temperature | number | 0.7 | 0 إلى 2 | أخذ عينات من درجة الحرارة. 0 هو حتمي و2 هو أقصى عشوائية. |
| top_p | number | 0.95 | 0 إلى 1 | عينة النواة: كتلة الاحتمالية. القيم المنخفضة تجعل المخرجات أكثر تركيزا. |
| max_tokens | number | 4096 | 1 إلى 16384 | أقصى رموز إخراج. |
| stop | string | - | - | حتى 4 سلاسل حيث يتوقف النموذج عن توليد رموز إضافية. |
| enable_thinking | boolean | true | - | فعل التفكير قبل الإجابة. |
| reasoning_effort | enum | medium | none, low, medium, high, max | مستوى جهد التفكير. لا أحد يعيق التفكير. المنخفض والمتوسط والعالي والقصوى يحدد ميزانيات التفكير المحدودة حسب النموذج المختار. |
| top_k | number | 20 | 1 إلى 200 | حدد العينة على أعلى رموز K المرشحة عند الدعم. |
| min_p | number | 0 | 0 إلى 1 | الحد الأدنى للاحتمال لأخذ عينات الرموز. |
| frequency_penalty | number | 0 | -2 إلى 2 | العقوبة تعتمد على عدد مرات ظهور الرمز بالفعل. |
| presence_penalty | number | 0 | -2 إلى 2 | عقوبة على الرموز التي ظهرت بالفعل في النص المولد. |
| seed | number | - | 0 إلى 2147483647 | بذرة عشوائية اختيارية لأخذ عينات قابلة للتكرار. |
| response_format | enum | - | text, json_object, json_schema | قيد الإخراج إلى JSON صالح. استخدم وضع JSON لأي كائن JSON، أو زود مخطط JSON لإجبار شكل استجابة دقيق. |
| web_search_linkup | boolean | false | - | بحث ويب اختياري مدعوم من لينك أب. عند تفعيلها، يتم استرجاع مصادر الويب الحديثة باستخدام رسالة المستخدم الأخيرة كاستعلام وتقديمها للنموذج كسياق إضافي. تضيف $0.013 لكل مكالمة عند استدعاؤها فوق تكلفة الرمز العادية للنموذج. معطلة بشكل افتراضي. |
| disable_formatting | boolean | false | - | عند تفعيلها، لن تضيف البوابة تذريلة "المصادر" إلى ردود المساعدين التي استخدمت البحث عبر الويب لينك أب. مفيد عندما يتم نقل مخرج النموذج إلى نظام آخر لا يتوقع أي زخرفة. |
نص فقط. هذا الإصدار لا يقبل مدخلات الصور أو الفيديو، على عكس Qwen3.6 35B A3B الأساسي. الأوزان تم تقديمها من نسخة W2 من eschamoe ذات البت 2 التي نشرتها Escha Labs (eschalabs.com) ك EschaLabs/Qwen3.6-35B-A3B-Escha-W2 على Hugging Face، تحت Apache-2.0. يتم تكميم الخبراء إلى 2 بت، مختلطة لكل إسقاط (gate_up_proj عند 2-بت و down_proj 3-بت)، والطبقات الكثيفة هي int8، وذاكرة KV هي FP16. تنشر Escha Labs مقارنة الجودة مقابل أساس FP8 لنفس النموذج: تكافؤ أو أفضل في الرياضيات، والدراسات العليا، استخدام الأدوات، والسياق الطويل، وأقل بحوالي 2٪ في المعرفة العامة، وأقل بحوالي 7٪ في توليد الشيفرة ذات الأفق الطويل، وهو الفجوة الواضحة الوحيدة. راجع بطاقة النموذج لجدول الاختبار الكامل والبروتوكول. السلوك يدعم البث، وأدوات الوظائف، ومخرجات JSON المنظمة بما في ذلك المخططات الصارمة، ووضع التفكير مفعل بشكل افتراضي. اضبط enable_thinking=خاطئ للإجابات المباشرة. مع تفكير، يصل الاستدلال إلى reasoning_content والإجابة في المحتوى، لذا اقرأ كلاهما. يمكن تخصيص max_tokens منخفض للتفكير بالكامل على التفكير، لذا اترك مساحة للإجابة. التخزين المؤقت يتم فوترة قراءات الكاش التلقائية للبادئة عند الإبلاغ عنها. لا يتم دعم ضوابط الكاش الصريحة. إلغاء طلب البث في منتصف التوليد يفرض فقط الرموز المنتجة حتى تلك النقطة.
على EmpirioLabs، تتم فوترة Qwen3.6 35B A3B حسب الاستخدام. جدول الأسعار المباشر في هذه الصفحة يطابق دائمًا ما تحتسبه الواجهة.
يدعم Qwen3.6 35B A3B نافذة سياق من 128K رمز، مع ما يصل إلى 16,384 رمز إخراج لكل استجابة.
نعم. يقدم Qwen3.6 35B A3B واجهة Chat Completions المتوافقة مع OpenAI، لذا تعمل حزم OpenAI SDK الحالية بتوجيه base_url إلى https://api.empiriolabs.ai/v1 وتعيين معرّف النموذج إلى qwen3-6-35b-a3b.
نعم. يشغّل ملعب EmpirioLabs نموذج Qwen3.6 35B A3B في المتصفح بنفس المعلمات التي تتيحها الواجهة، لتجربة المطالبات قبل كتابة الكود.
أنشئ حساب EmpirioLabs ثم أنشئ مفتاحًا من API Keys في لوحة التحكم. الفوترة برصيد الدفع حسب الاستخدام، فلا تدفع إلا مقابل الطلبات التي تنفذها.
تحقق من تسعيرنا أو تواصل إذا كنت ترغب في نشر نموذجك الخاص على مجموعتنا.