Qwen3.5 4B واجهة برمجة التطبيقات

Qwen3.5 4B هو نموذج استدلال متعدد الوسائط منخفض التكلفة مع 256K سياق، ومدخلات صور وفيديو، وأدوات وظيفية، ومخرجات منظمة.

Alibaba Cloudتوليد النصوص256K السياقتاريخ الإصدار 2 مارس 2026استدلال أصلي

حول Qwen3.5 4B

Qwen3.5 4B هو نموذج استدلال متعدد الوسائط منخفض التكلفة مع 256K سياق، ومدخلات صور وفيديو، وأدوات وظيفية، ومخرجات منظمة.

يدعم إدخال النصوص والصور والفيديو، والبث، وأدوات الوظائف، وإخراج JSON الهيكلي، والتحكم في البذرة، ووضع التفكير بشكل افتراضي. استخدم reasoning_effort أو thinking_budget للتفكير المحدود، أو enable_thinking=خاطئ للإجابات المباشرة. يتم احتساب القراءات التلقائية للذاكرة المؤقتة عند الإبلاغ عن التخزين المؤقت عند الإبلاغ عنها من قبل خدمة النموذج. لا يتم دعم التحكم الصريح في ذاكرة التخزين المؤقت.

يعرف أيضا باسم Alibaba Cloud Qwen3.5 4B

reasoningvisionvideofunction callingcachemultimodaljson modelogprobs

مواصفات Qwen3.5 4B

معرّف النموذج
qwen3-5-4b
المزود
Alibaba Cloud
الفئة
توليد النصوص
تاريخ الإصدار
2 مارس 2026
نافذة السياق
256K رمز
أقصى إخراج
32,768 رمز
الإدخال
نصصورةفيديو
الإخراج
نص
إخراج منظم
JSON Schema
نقاط النهاية
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1/completionsPOST/v1beta/models/qwen3-5-4b:generateContent
معرّفات نموذج بديلة
qwen3.5-4b

أسعار واجهة Qwen3.5 4B API

أسعار الدفع حسب الاستخدام مباشرة من كتالوج EmpirioLabs. تدفع فقط مقابل ما تستخدمه، بدون حد أدنى شهري.

النوع
المواصفة
السعر
المدخلات
لكل 1M رموز مطالبة
$0.04
الإنتاج
لكل مليون رمز مولد
$0.07
قراءة الذاكرة المؤقتة الضمنية
لكل مليون رمز إدخال مخبأ
$0.02
البحث على الويب (لينك أب)
لكل نداء عند استدعائه
$0.013
قارن في صفحة الأسعار الكاملة

كيفية استدعاء واجهة Qwen3.5 4B API

يقدم Qwen3.5 4B واجهة Chat Completions المتوافقة مع OpenAI. وجّه أي OpenAI SDK إلى https://api.empiriolabs.ai/v1 بمفتاح EmpirioLabs API الخاص بك واستخدم معرّف النموذج qwen3-5-4b. احصل على مفتاح API من لوحة تحكم EmpirioLabs.

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3-5-4b",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="qwen3-5-4b",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
المرجع الكامل لواجهة Qwen3.5 4B API

معلمات واجهة Qwen3.5 4B API

معلمات الطلب التي تدعمها واجهة Qwen3.5 4B API على EmpirioLabs. تُطبق القيم الافتراضية عند حذف أي حقل.

المعاملالنوعالافتراضيالنطاق / القيمالوصف
temperaturenumber0.70 إلى 2أخذ عينات من درجة الحرارة. 0 هو حتمي و2 هو أقصى عشوائية.
top_pnumber0.950 إلى 1عينة النواة: كتلة الاحتمالية. القيم المنخفضة تجعل المخرجات أكثر تركيزا.
max_tokensinteger40961 إلى 32768أقصى رموز إخراج.
stopstring--حتى 4 سلاسل حيث يتوقف النموذج عن توليد رموز إضافية.
enable_thinkingbooleantrue-فعل التفكير قبل الإجابة.
reasoning_effortenummediumnone, low, medium, high, maxمستوى جهد التفكير. لا أحد يعيق التفكير. المنخفض والمتوسط والعالي والقصوى يحدد ميزانيات التفكير المحدودة حسب النموذج المختار.
thinking_budgetinteger40961024 إلى 32768الحد الأقصى من الرموز المخصص للمنطق عند تفعيل التفكير.
top_kinteger201 إلى 200حدد العينة على أعلى رموز K المرشحة عند الدعم.
min_pnumber00 إلى 1الحد الأدنى للاحتمال لأخذ عينات الرموز.
frequency_penaltynumber0-2 إلى 2العقوبة تعتمد على عدد مرات ظهور الرمز بالفعل.
presence_penaltynumber0-2 إلى 2عقوبة على الرموز التي ظهرت بالفعل في النص المولد.
repetition_penaltynumber10.1 إلى 2العقوبة التي يستخدمها SGLang لتقليل تكرار النصوص النصية.
seedinteger-0 إلى 2147483647بذرة عشوائية اختيارية لأخذ عينات قابلة للتكرار.
logprobsbooleanfalse-أعيد احتمالات سجل الرموز عند الدعم.
8 معلمات إضافية في الوثائق

معلومات مفيدة

يدعم إدخال النصوص والصور والفيديو، والبث، وأدوات الوظائف، وإخراج JSON الهيكلي، والتحكم في البذرة، ووضع التفكير بشكل افتراضي. استخدم reasoning_effort أو thinking_budget للتفكير المحدود، أو enable_thinking=خاطئ للإجابات المباشرة. يتم احتساب القراءات التلقائية للذاكرة المؤقتة عند الإبلاغ عن التخزين المؤقت عند الإبلاغ عنها من قبل خدمة النموذج. لا يتم دعم التحكم الصريح في ذاكرة التخزين المؤقت.

واجهة Qwen3.5 4B API: أسئلة شائعة

كم تكلف واجهة Qwen3.5 4B API؟

على EmpirioLabs، تتم فوترة Qwen3.5 4B حسب الاستخدام: المدخلات $0.04 لكل 1M رموز مطالبة; الإنتاج $0.07 لكل مليون رمز مولد; قراءة الذاكرة المؤقتة الضمنية $0.02 لكل مليون رمز إدخال مخبأ. جدول الأسعار المباشر في هذه الصفحة يطابق دائمًا ما تحتسبه الواجهة.

ما حجم نافذة السياق في Qwen3.5 4B؟

يدعم Qwen3.5 4B نافذة سياق من 256K رمز، مع ما يصل إلى 32,768 رمز إخراج لكل استجابة.

هل واجهة Qwen3.5 4B API متوافقة مع OpenAI؟

نعم. يقدم Qwen3.5 4B واجهة Chat Completions المتوافقة مع OpenAI، لذا تعمل حزم OpenAI SDK الحالية بتوجيه base_url إلى https://api.empiriolabs.ai/v1 وتعيين معرّف النموذج إلى qwen3-5-4b.

هل يمكنني تجربة Qwen3.5 4B في المتصفح قبل الدمج؟

نعم. يشغّل ملعب EmpirioLabs نموذج Qwen3.5 4B في المتصفح بنفس المعلمات التي تتيحها الواجهة، لتجربة المطالبات قبل كتابة الكود.

كيف أحصل على مفتاح API لنموذج Qwen3.5 4B؟

أنشئ حساب EmpirioLabs ثم أنشئ مفتاحًا من API Keys في لوحة التحكم. الفوترة برصيد الدفع حسب الاستخدام، فلا تدفع إلا مقابل الطلبات التي تنفذها.

هل أنت مستعد لاستخدام نقاط نهاية أفضل؟

تحقق من تسعيرنا أو تواصل إذا كنت ترغب في نشر نموذجك الخاص على مجموعتنا.