Qwen3.6 35B A3B واجهة برمجة التطبيقات

Qwen3.6 35B A3B هو نموذج استدلال mixture-of-experts مكون من 256 خبير مع سياق 128K وأدوات دوال ومخرجات JSON منظمة صارمة.

Alibaba Cloudتوليد النصوص128K السياقتاريخ الإصدار 16 أبريل 2026استدلال أصليجديد

حول Qwen3.6 35B A3B

Qwen3.6 35B A3B هو نموذج استدلال mixture-of-experts مكون من 256 خبير مع سياق 128K وأدوات دوال ومخرجات JSON منظمة صارمة.

نص فقط. هذا الإصدار لا يقبل مدخلات الصور أو الفيديو، على عكس Qwen3.6 35B A3B الأساسي. الأوزان تم تقديمها من نسخة W2 من eschamoe ذات البت 2 التي نشرتها Escha Labs (eschalabs.com) ك EschaLabs/Qwen3.6-35B-A3B-Escha-W2 على Hugging Face، تحت Apache-2.0. يتم تكميم الخبراء إلى 2 بت، مختلطة لكل إسقاط (gate_up_proj عند 2-بت و down_proj 3-بت)، والطبقات الكثيفة هي int8، وذاكرة KV هي FP16. تنشر Escha Labs مقارنة الجودة مقابل أساس FP8 لنفس النموذج: تكافؤ أو أفضل في الرياضيات، والدراسات العليا، استخدام الأدوات، والسياق الطويل، وأقل بحوالي 2٪ في المعرفة العامة، وأقل بحوالي 7٪ في توليد الشيفرة ذات الأفق الطويل، وهو الفجوة الواضحة الوحيدة. راجع بطاقة النموذج لجدول الاختبار الكامل والبروتوكول. السلوك يدعم البث، وأدوات الوظائف، ومخرجات JSON المنظمة بما في ذلك المخططات الصارمة، ووضع التفكير مفعل بشكل افتراضي. اضبط enable_thinking=خاطئ للإجابات المباشرة. مع تفكير، يصل الاستدلال إلى reasoning_content والإجابة في المحتوى، لذا اقرأ كلاهما. يمكن تخصيص max_tokens منخفض للتفكير بالكامل على التفكير، لذا اترك مساحة للإجابة. التخزين المؤقت يتم فوترة قراءات الكاش التلقائية للبادئة عند الإبلاغ عنها. لا يتم دعم ضوابط الكاش الصريحة. إلغاء طلب البث في منتصف التوليد يفرض فقط الرموز المنتجة حتى تلك النقطة.

يعرف أيضا باسم EschaLabs/Qwen3.6-35B-A3B-Escha-W2, Alibaba Cloud Qwen3.6 35B A3B

reasoningfunction callingjson modecache

مواصفات Qwen3.6 35B A3B

معرّف النموذج
qwen3-6-35b-a3b
المطور
Alibaba Cloud
الفئة
توليد النصوص
تاريخ الإصدار
16 أبريل 2026
نافذة السياق
128K رمز
أقصى إخراج
16,384 رمز
الإدخال
نص
الإخراج
نص
إخراج منظم
JSON Schema
نقاط النهاية
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1/completionsPOST/v1beta/models/qwen3-6-35b-a3b:generateContent
معرّفات نموذج بديلة
qwen3.6-35b-a3bqwen/qwen3.6-35b-a3bEschaLabs/Qwen3.6-35B-A3B-Escha-W2

أسعار واجهة Qwen3.6 35B A3B APIوفّر حتى 72%

أسعار الدفع حسب الاستخدام مباشرة من كتالوج EmpirioLabs. تدفع فقط مقابل ما تستخدمه، بدون حد أدنى شهري.

النوع
المواصفة
السعر
المدخلات
لكل 1M رموز مطالبة
$0.248$0.07
الإنتاج
لكل مليون رمز مولد
$1.485$0.42
قراءة الذاكرة المؤقتة الضمنية
لكل مليون رمز إدخال مخبأ
$0.035
البحث على الويب (لينك أب)
لكل نداء عند استدعائه
$0.013
قارن في صفحة الأسعار الكاملة

كيفية استدعاء واجهة Qwen3.6 35B A3B API

يقدم Qwen3.6 35B A3B واجهة Chat Completions المتوافقة مع OpenAI. وجّه أي OpenAI SDK إلى https://api.empiriolabs.ai/v1 بمفتاح EmpirioLabs API الخاص بك واستخدم معرّف النموذج qwen3-6-35b-a3b. احصل على مفتاح API من لوحة تحكم EmpirioLabs.

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3-6-35b-a3b",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="qwen3-6-35b-a3b",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
المرجع الكامل لواجهة Qwen3.6 35B A3B API

معلمات واجهة Qwen3.6 35B A3B API

معلمات الطلب التي تدعمها واجهة Qwen3.6 35B A3B API على EmpirioLabs. تُطبق القيم الافتراضية عند حذف أي حقل.

المعاملالنوعالافتراضيالنطاق / القيمالوصف
temperaturenumber0.70 إلى 2أخذ عينات من درجة الحرارة. 0 هو حتمي و2 هو أقصى عشوائية.
top_pnumber0.950 إلى 1عينة النواة: كتلة الاحتمالية. القيم المنخفضة تجعل المخرجات أكثر تركيزا.
max_tokensnumber40961 إلى 16384أقصى رموز إخراج.
stopstring--حتى 4 سلاسل حيث يتوقف النموذج عن توليد رموز إضافية.
enable_thinkingbooleantrue-فعل التفكير قبل الإجابة.
reasoning_effortenummediumnone, low, medium, high, maxمستوى جهد التفكير. لا أحد يعيق التفكير. المنخفض والمتوسط والعالي والقصوى يحدد ميزانيات التفكير المحدودة حسب النموذج المختار.
top_knumber201 إلى 200حدد العينة على أعلى رموز K المرشحة عند الدعم.
min_pnumber00 إلى 1الحد الأدنى للاحتمال لأخذ عينات الرموز.
frequency_penaltynumber0-2 إلى 2العقوبة تعتمد على عدد مرات ظهور الرمز بالفعل.
presence_penaltynumber0-2 إلى 2عقوبة على الرموز التي ظهرت بالفعل في النص المولد.
seednumber-0 إلى 2147483647بذرة عشوائية اختيارية لأخذ عينات قابلة للتكرار.
response_formatenum-text, json_object, json_schemaقيد الإخراج إلى JSON صالح. استخدم وضع JSON لأي كائن JSON، أو زود مخطط JSON لإجبار شكل استجابة دقيق.
web_search_linkupbooleanfalse-بحث ويب اختياري مدعوم من لينك أب. عند تفعيلها، يتم استرجاع مصادر الويب الحديثة باستخدام رسالة المستخدم الأخيرة كاستعلام وتقديمها للنموذج كسياق إضافي. تضيف $0.013 لكل مكالمة عند استدعاؤها فوق تكلفة الرمز العادية للنموذج. معطلة بشكل افتراضي.
disable_formattingbooleanfalse-عند تفعيلها، لن تضيف البوابة تذريلة "المصادر" إلى ردود المساعدين التي استخدمت البحث عبر الويب لينك أب. مفيد عندما يتم نقل مخرج النموذج إلى نظام آخر لا يتوقع أي زخرفة.

معلومات مفيدة

نص فقط. هذا الإصدار لا يقبل مدخلات الصور أو الفيديو، على عكس Qwen3.6 35B A3B الأساسي. الأوزان تم تقديمها من نسخة W2 من eschamoe ذات البت 2 التي نشرتها Escha Labs (eschalabs.com) ك EschaLabs/Qwen3.6-35B-A3B-Escha-W2 على Hugging Face، تحت Apache-2.0. يتم تكميم الخبراء إلى 2 بت، مختلطة لكل إسقاط (gate_up_proj عند 2-بت و down_proj 3-بت)، والطبقات الكثيفة هي int8، وذاكرة KV هي FP16. تنشر Escha Labs مقارنة الجودة مقابل أساس FP8 لنفس النموذج: تكافؤ أو أفضل في الرياضيات، والدراسات العليا، استخدام الأدوات، والسياق الطويل، وأقل بحوالي 2٪ في المعرفة العامة، وأقل بحوالي 7٪ في توليد الشيفرة ذات الأفق الطويل، وهو الفجوة الواضحة الوحيدة. راجع بطاقة النموذج لجدول الاختبار الكامل والبروتوكول. السلوك يدعم البث، وأدوات الوظائف، ومخرجات JSON المنظمة بما في ذلك المخططات الصارمة، ووضع التفكير مفعل بشكل افتراضي. اضبط enable_thinking=خاطئ للإجابات المباشرة. مع تفكير، يصل الاستدلال إلى reasoning_content والإجابة في المحتوى، لذا اقرأ كلاهما. يمكن تخصيص max_tokens منخفض للتفكير بالكامل على التفكير، لذا اترك مساحة للإجابة. التخزين المؤقت يتم فوترة قراءات الكاش التلقائية للبادئة عند الإبلاغ عنها. لا يتم دعم ضوابط الكاش الصريحة. إلغاء طلب البث في منتصف التوليد يفرض فقط الرموز المنتجة حتى تلك النقطة.

واجهة Qwen3.6 35B A3B API: أسئلة شائعة

كم تكلف واجهة Qwen3.6 35B A3B API؟

على EmpirioLabs، تتم فوترة Qwen3.6 35B A3B حسب الاستخدام. جدول الأسعار المباشر في هذه الصفحة يطابق دائمًا ما تحتسبه الواجهة.

ما حجم نافذة السياق في Qwen3.6 35B A3B؟

يدعم Qwen3.6 35B A3B نافذة سياق من 128K رمز، مع ما يصل إلى 16,384 رمز إخراج لكل استجابة.

هل واجهة Qwen3.6 35B A3B API متوافقة مع OpenAI؟

نعم. يقدم Qwen3.6 35B A3B واجهة Chat Completions المتوافقة مع OpenAI، لذا تعمل حزم OpenAI SDK الحالية بتوجيه base_url إلى https://api.empiriolabs.ai/v1 وتعيين معرّف النموذج إلى qwen3-6-35b-a3b.

هل يمكنني تجربة Qwen3.6 35B A3B في المتصفح قبل الدمج؟

نعم. يشغّل ملعب EmpirioLabs نموذج Qwen3.6 35B A3B في المتصفح بنفس المعلمات التي تتيحها الواجهة، لتجربة المطالبات قبل كتابة الكود.

كيف أحصل على مفتاح API لنموذج Qwen3.6 35B A3B؟

أنشئ حساب EmpirioLabs ثم أنشئ مفتاحًا من API Keys في لوحة التحكم. الفوترة برصيد الدفع حسب الاستخدام، فلا تدفع إلا مقابل الطلبات التي تنفذها.

هل أنت مستعد لاستخدام نقاط نهاية أفضل؟

تحقق من تسعيرنا أو تواصل إذا كنت ترغب في نشر نموذجك الخاص على مجموعتنا.