Qwen3.5 4B एपीआई

Qwen3.5 4B 256K संदर्भ, छवि और वीडियो इनपुट, फ़ंक्शन टूल और संरचित आउटपुट के साथ एक कम लागत वाली बहुमॉडल तर्क मॉडल है।

Alibaba Cloudटेक्स्ट जनरेशन256K कॉन्टेक्स्टरिलीज 2 मार्च 2026नेटिव इन्फरेंस

Qwen3.5 4B के बारे में

Qwen3.5 4B 256K संदर्भ, छवि और वीडियो इनपुट, फ़ंक्शन टूल और संरचित आउटपुट के साथ एक कम लागत वाली बहुमॉडल तर्क मॉडल है।

पाठ, छवि और वीडियो इनपुट, स्ट्रीमिंग, फंक्शन टूल, संरचित JSON आउटपुट, बीज नियंत्रण और डिफ़ॉल्ट रूप से सोच मोड का समर्थन करता है। बाउंड सोच के लिए तर्क effort या Think budget का उपयोग करें, या प्रत्यक्ष उत्तरों के लिए सक्षम thinking=false करें। मॉडल सेवा द्वारा रिपोर्ट करते समय स्वचालित कैश रीडिंग को कैश-इनपुट दर पर बिल दिया जाता है। स्पष्ट कैश नियंत्रण समर्थित नहीं हैं।

इस नाम से भी जाना जाता है Alibaba Cloud Qwen3.5 4B

reasoningvisionvideofunction callingcachemultimodaljson modelogprobs

Qwen3.5 4B की विशेषताएं

मॉडल ID
qwen3-5-4b
प्रदाता
Alibaba Cloud
श्रेणी
टेक्स्ट जनरेशन
रिलीज
2 मार्च 2026
कॉन्टेक्स्ट विंडो
256K टोकन
अधिकतम आउटपुट
32,768 टोकन
इनपुट
टेक्स्टइमेजवीडियो
आउटपुट
टेक्स्ट
संरचित आउटपुट
JSON Schema
एंडपॉइंट
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1/completionsPOST/v1beta/models/qwen3-5-4b:generateContent
वैकल्पिक मॉडल ID
qwen3.5-4b

Qwen3.5 4B API की कीमतें

EmpirioLabs कैटलॉग से लाइव pay-as-you-go दरें। आप सिर्फ उतना ही भुगतान करते हैं जितना उपयोग करते हैं, कोई मासिक न्यूनतम नहीं।

प्रकार
स्पेक
दर
इनपुट
प्रति 1M शीघ्र टोकन
$0.04
उत्पादन
प्रति 1M उत्पन्न टोकन
$0.07
Implicit कैश पढ़ा
प्रति 1M कैश इनपुट टोकन
$0.02
वेब खोज (लिंकअप)
जब बुलाना
$0.013
पूरे कीमत पेज पर तुलना करें

Qwen3.5 4B API को कैसे कॉल करें

Qwen3.5 4B OpenAI-संगत Chat Completions API देता है। किसी भी OpenAI SDK को अपनी EmpirioLabs API key के साथ https://api.empiriolabs.ai/v1 पर सेट करें और model id qwen3-5-4b उपयोग करें। EmpirioLabs डैशबोर्ड से API key प्राप्त करें।

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3-5-4b",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="qwen3-5-4b",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Qwen3.5 4B API का पूरा संदर्भ

Qwen3.5 4B API के पैरामीटर

EmpirioLabs पर Qwen3.5 4B API द्वारा समर्थित request पैरामीटर। फ़ील्ड छोड़ने पर डिफ़ॉल्ट मान लागू होते हैं।

पैरामीटरप्रकारडिफॉल्टरेंज / मानविवरण
temperaturenumber0.70 से 2नमूना तापमान। 0 नियतात्मक है और 2 अधिकतम यादृच्छिकता है।
top_pnumber0.950 से 1नाभिक नमूनाकरण संभाव्यता द्रव्यमान। कम मान आउटपुट को अधिक केंद्रित बनाते हैं।
max_tokensinteger40961 से 32768अधिकतम आउटपुट टोकन।
stopstring--4 स्ट्रिंग्स तक जहां मॉडल आगे टोकन उत्पन्न करना बंद कर देगा।
enable_thinkingbooleantrue-उत्तर देने से पहले तर्क सक्षम करें।
reasoning_effortenummediumnone, low, medium, high, maxतर्क प्रयास स्तर। कोई भी सोच को अक्षम नहीं करता है। निम्न, मध्यम, उच्च और अधिकतम सेट चयनित मॉडल के आकार के बाउंड थिंकिंग बजट।
thinking_budgetinteger40961024 से 32768सोच सक्षम होने पर तर्क के लिए आरक्षित अधिकतम टोकन।
top_kinteger201 से 200समर्थित होने पर नमूनाकरण को शीर्ष K उम्मीदवार टोकन तक सीमित करें।
min_pnumber00 से 1टोकन नमूने के लिए न्यूनतम संभावना सीमा।
frequency_penaltynumber0-2 से 2टोकन कितनी बार पहले ही दिखाई दे चुका है, इसके आधार पर जुर्माना।
presence_penaltynumber0-2 से 2टोकन के लिए जुर्माना जो पहले से ही जेनरेट किए गए टेक्स्ट में दिखाई दे रहे हैं।
repetition_penaltynumber10.1 से 2बार-बार पाठ को कम करने के लिए SGLang द्वारा उपयोग किया जाने वाला जुर्माना।
seedinteger-0 से 2147483647प्रतिलिपि प्रस्तुत करने योग्य नमूने के लिए वैकल्पिक यादृच्छिक बीज।
logprobsbooleanfalse-समर्थित होने पर टोकन लॉग संभावनाएँ लौटाएँ।
डॉक्स में 8 और पैरामीटर

जानने योग्य

पाठ, छवि और वीडियो इनपुट, स्ट्रीमिंग, फंक्शन टूल, संरचित JSON आउटपुट, बीज नियंत्रण और डिफ़ॉल्ट रूप से सोच मोड का समर्थन करता है। बाउंड सोच के लिए तर्क effort या Think budget का उपयोग करें, या प्रत्यक्ष उत्तरों के लिए सक्षम thinking=false करें। मॉडल सेवा द्वारा रिपोर्ट करते समय स्वचालित कैश रीडिंग को कैश-इनपुट दर पर बिल दिया जाता है। स्पष्ट कैश नियंत्रण समर्थित नहीं हैं।

Qwen3.5 4B API: आम सवाल

Qwen3.5 4B API की कीमत कितनी है?

EmpirioLabs पर Qwen3.5 4B का बिल उपयोग के अनुसार बनता है: इनपुट $0.04 प्रति 1M शीघ्र टोकन; उत्पादन $0.07 प्रति 1M उत्पन्न टोकन; Implicit कैश पढ़ा $0.02 प्रति 1M कैश इनपुट टोकन। इस पेज की लाइव दर तालिका हमेशा API की वास्तविक बिलिंग से मेल खाती है।

Qwen3.5 4B की context window कितनी है?

Qwen3.5 4B 256K टोकन की context window समर्थित करता है, प्रति उत्तर अधिकतम 32,768 आउटपुट टोकन के साथ।

क्या Qwen3.5 4B API OpenAI-संगत है?

हां। Qwen3.5 4B OpenAI-संगत Chat Completions API देता है, इसलिए मौजूदा OpenAI SDKs base_url को https://api.empiriolabs.ai/v1 पर सेट करके और model id qwen3-5-4b रखकर काम करते हैं।

क्या मैं इंटीग्रेट करने से पहले ब्राउज़र में Qwen3.5 4B आज़मा सकता हूं?

हां। EmpirioLabs playground ब्राउज़र में Qwen3.5 4B को उन्हीं पैरामीटरों के साथ चलाता है जो API देता है, ताकि आप कोड लिखने से पहले prompt आज़मा सकें।

Qwen3.5 4B की API key कैसे मिलेगी?

EmpirioLabs खाता बनाएं, फिर डैशबोर्ड में API Keys में key जनरेट करें। बिलिंग pay-as-you-go क्रेडिट से होती है, इसलिए आप सिर्फ अपनी requests का भुगतान करते हैं।

बेहतर समापन बिंदुओं का उपयोग करने के लिए तैयार हैं?

हमारे मूल्य निर्धारण की जाँच करें या यदि आप चाहते हैं कि आपका अपना मॉडल हमारे स्टैक पर तैनात किया जाए, तो पहुंचें।