
हाइब्रिड रैखिक-attention प्लस sparse MoE, 1M संदर्भ, और तेजी से multimodal text/image /वीडियो inference के साथ दृष्टि-भाषा मॉडल।
हाइब्रिड रैखिक-attention प्लस sparse MoE, 1M संदर्भ, और तेजी से multimodal text/image /वीडियो inference के साथ दृष्टि-भाषा मॉडल।
इस नाम से भी जाना जाता है Alibaba Cloud Qwen3.5 Flash, Qwen3.5-Flash, qwen3-5-flash
qwen3-5-flash/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/qwen3-5-flash:generateContentqwen3.5-flashEmpirioLabs कैटलॉग से लाइव pay-as-you-go दरें। आप सिर्फ उतना ही भुगतान करते हैं जितना उपयोग करते हैं, कोई मासिक न्यूनतम नहीं।
Qwen3.5 Flash OpenAI-संगत Chat Completions API देता है। किसी भी OpenAI SDK को अपनी EmpirioLabs API key के साथ https://api.empiriolabs.ai/v1 पर सेट करें और model id qwen3-5-flash उपयोग करें। EmpirioLabs डैशबोर्ड से API key प्राप्त करें।
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3-5-flash",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="qwen3-5-flash",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)EmpirioLabs पर Qwen3.5 Flash API द्वारा समर्थित request पैरामीटर। फ़ील्ड छोड़ने पर डिफ़ॉल्ट मान लागू होते हैं।
| पैरामीटर | प्रकार | डिफॉल्ट | रेंज / मान | विवरण |
|---|---|---|---|---|
| temperature | number | 0.7 | 0 से 2 | नमूना तापमान। 0 = नियतात्मक, 2 = अधिकतम यादृच्छिकता। |
| top_p | number | 0.9 | 0 से 1 | नाभिक नमूनाकरण संभाव्यता द्रव्यमान। निचला = अधिक केंद्रित। |
| max_tokens | number | 4096 | 1 से 32768 | प्रतिक्रिया में अधिकतम टोकन। |
| enable_thinking | boolean | true | - | विस्तारित सोच मोड सक्षम करें। धीमा लेकिन तर्क-भारी कार्यों में सुधार करता है। |
| vl_high_resolution_images | boolean | true | - | इनपुट छवियों के लिए उच्च रिज़ॉल्यूशन का उपयोग करें। उच्च लागत पर बेहतर विवरण। |
| max_pixels | number | 2621440 | 1 से 99999999 | प्रति इनपुट छवि अधिकतम पिक्सेल। बड़ा = अधिक विवरण लेकिन धीमा/अधिक टोकन। |
| tool_web_search | boolean | false | - | वास्तविक समय की जानकारी के लिए वेब पर खोजें। |
| tool_web_extractor | boolean | true | - | URL से सामग्री निकालें और पढ़ें। वेब खोज और सोच की आवश्यकता है। |
| tool_code_interpreter | boolean | true | - | सैंडबॉक्स में पायथन कोड चलाएँ। सोचने की जरूरत है। |
| tool_web_search_image | boolean | true | - | पाठ विवरण से छवियों के लिए वेब पर खोजें। |
| tool_image_search | boolean | true | - | अपलोड की गई छवि से मिलते-जुलते चित्र ढूंढें. |
| video_fps | number | 2 | 0.1 से 10 | विश्लेषण के लिए इनपुट वीडियो से फ्रेम्स-प्रति-सेकंड का नमूना लिया गया। |
| treat_images_as_video | boolean | false | - | अस्थायी तर्क के लिए एक वीडियो के रूप में इनपुट छवियों के एक अनुक्रम का इलाज करें। |
| response_format | enum | - | - | आउटपुट को वैध JSON ऑब्जेक्ट (JSON मोड) के रूप में लौटाएं। अपने प्रॉम्प्ट में उन फ़ील्ड का वर्णन करें जिन्हें आप चाहते हैं। |
**बिल्ट-इन टूल* (केवल जब आमंत्रित किया जाता है) - वेब खोज: $0.015/call वेब एक्सट्रैक्टर: मुफ्त - कोड व्याख्याता: मुफ्त - टेक्स्ट-टू-image खोज: $0.012/call Image-to-image search: $0.012/call **अन्य* - सोचे गए टोकनों को आउटपुट टोकन टेक्स्ट-टू-Image Search और इमेज-टू-Image Search के रूप में बिल दिया जाता है, छवि खोज मूल्य निर्धारण पंक्ति का उपयोग करता है। प्रत्येक प्रकाशित छवि खोज को उस सूचीबद्ध प्रति-कॉल दर पर बिल दिया जाता है।
When this model invokes tools (web search, code interpreter, etc.) inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts. The example below shows the shape — exact field names, units, and which tools appear can vary slightly per provider:
"usage": {
"prompt_tokens": 123,
"completion_tokens": 456,
"cost_usd": 0.0042,
"tool_usage": {"web_search": 3, "code_interpreter": 1}
}The tool counts are already factored into cost_usd — they are surfaced for transparency so you can audit per-tool billing. The field is omitted when no tools were invoked.
:variant1
पाठ, छवि और वीडियो इनपुट का समर्थन करता है। वेब खोज tool_web_search सोच टोकन को आउटपुट टोकन के रूप में बिल दिया जाता है। स्पष्ट कैश नियंत्रण समर्थित नहीं हैं।
वेरिएंट Qwen3.5 Flash के वैकल्पिक संस्करण हैं जिनकी अपनी model id होती है। वेरिएंट के अनुसार serving region, कीमतें या समर्थित पैरामीटर अलग हो सकते हैं; बाकी सब वैसा ही काम करता है।
qwen3-5-flash:variant1EmpirioLabs पर Qwen3.5 Flash का बिल उपयोग के अनुसार बनता है। इस पेज की लाइव दर तालिका हमेशा API की वास्तविक बिलिंग से मेल खाती है।
Qwen3.5 Flash 1M टोकन की context window समर्थित करता है, प्रति उत्तर अधिकतम 32,768 आउटपुट टोकन के साथ।
हां। Qwen3.5 Flash OpenAI-संगत Chat Completions API देता है, इसलिए मौजूदा OpenAI SDKs base_url को https://api.empiriolabs.ai/v1 पर सेट करके और model id qwen3-5-flash रखकर काम करते हैं।
Qwen3.5 Flash 2 model ids के रूप में उपलब्ध है: डिफ़ॉल्ट qwen3-5-flash और qwen3-5-flash:variant1 (China)। वेरिएंट serving region, कीमतों या समर्थित पैरामीटरों में अलग हो सकते हैं; हर एक की दर तालिका इसी पेज पर है।
हां। EmpirioLabs playground ब्राउज़र में Qwen3.5 Flash को उन्हीं पैरामीटरों के साथ चलाता है जो API देता है, ताकि आप कोड लिखने से पहले prompt आज़मा सकें।
EmpirioLabs खाता बनाएं, फिर डैशबोर्ड में API Keys में key जनरेट करें। बिलिंग pay-as-you-go क्रेडिट से होती है, इसलिए आप सिर्फ अपनी requests का भुगतान करते हैं।
हमारे मूल्य निर्धारण की जाँच करें या यदि आप चाहते हैं कि आपका अपना मॉडल हमारे स्टैक पर तैनात किया जाए, तो पहुंचें।