
एजेंट कोडिंग, गणित तर्क, स्थानिक समझ, OCR और पाठ, छवि और वीडियो इनपुट के लिए फास्ट Qwen3.6 दृष्टि-भाषा मॉडल।
एजेंट कोडिंग, गणित तर्क, स्थानिक समझ, OCR और पाठ, छवि और वीडियो इनपुट के लिए फास्ट Qwen3.6 दृष्टि-भाषा मॉडल।
पाठ, छवि और वीडियो इनपुट का समर्थन करता है, सक्षम थिंकिंग और Think budget, फंक्शन कॉलिंग, संरचित आउटपुट और वेब सर्च के माध्यम से tool_web_search वेब खोज सक्षम होने पर क्वेरी के अनुसार $0.02 जोड़ती है। सोच टोकन को आउटपुट टोकन के रूप में बिल दिया जाता है। स्पष्ट कैश नियंत्रण समर्थित नहीं हैं।
इस नाम से भी जाना जाता है Alibaba Cloud Qwen3.6 Flash, Qwen3.6-Flash, qwen3-6-flash
qwen3-6-flash/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/qwen3-6-flash:generateContentqwen3.6-flashEmpirioLabs कैटलॉग से लाइव pay-as-you-go दरें। आप सिर्फ उतना ही भुगतान करते हैं जितना उपयोग करते हैं, कोई मासिक न्यूनतम नहीं।
Qwen3.6 Flash OpenAI-संगत Chat Completions API देता है। किसी भी OpenAI SDK को अपनी EmpirioLabs API key के साथ https://api.empiriolabs.ai/v1 पर सेट करें और model id qwen3-6-flash उपयोग करें। EmpirioLabs डैशबोर्ड से API key प्राप्त करें।
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3-6-flash",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="qwen3-6-flash",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)EmpirioLabs पर Qwen3.6 Flash API द्वारा समर्थित request पैरामीटर। फ़ील्ड छोड़ने पर डिफ़ॉल्ट मान लागू होते हैं।
| पैरामीटर | प्रकार | डिफॉल्ट | रेंज / मान | विवरण |
|---|---|---|---|---|
| temperature | number | 0.7 | 0 से 2 | नमूना तापमान। 0 नियतात्मक है और 2 अधिकतम यादृच्छिकता है। |
| top_p | number | 0.9 | 0 से 1 | नाभिक नमूनाकरण संभाव्यता द्रव्यमान। कम मान आउटपुट को अधिक केंद्रित बनाते हैं। |
| max_tokens | number | 4096 | 1 से 65536 | अधिकतम आउटपुट टोकन। |
| stop | string | - | - | 4 स्ट्रिंग्स तक जहां मॉडल आगे टोकन उत्पन्न करना बंद कर देगा। |
| enable_thinking | boolean | true | - | उत्तर देने से पहले तर्क सक्षम करें। |
| reasoning_effort | enum | medium | none, low, medium, high, max | तर्क प्रयास स्तर। कोई भी सोच को अक्षम नहीं करता है। निम्न, मध्यम, उच्च और अधिकतम सेट चयनित मॉडल के आकार के बाउंड थिंकिंग बजट। OpenAI-शैली reasoning_effort फ़ील्ड के... |
| thinking_budget | number | 32768 | 1 से 64000 | सोच सक्षम होने पर तर्क के लिए आरक्षित अधिकतम टोकन। |
| vl_high_resolution_images | boolean | true | - | छवि इनपुट के लिए उच्च रिज़ॉल्यूशन प्रसंस्करण का उपयोग करें। |
| max_pixels | number | 2621440 | 4096 से 16777216 | उच्च रिज़ॉल्यूशन प्रसंस्करण अक्षम होने पर प्रति छवि अधिकतम पिक्सेल गणना। |
| video_fps | number | 2 | 0.1 से 10 | वीडियो इनपुट से नमूना लेने के लिए प्रति सेकंड फ्रेम। |
| tool_web_search | boolean | false | - | वास्तविक समय की जानकारी के लिए वेब पर खोजें। सक्षम होने पर अनुरोध लागत में $0.02 जोड़ता है। |
| response_format | enum | - | - | आउटपुट को वैध JSON ऑब्जेक्ट (JSON मोड) के रूप में लौटाएं। अपने प्रॉम्प्ट में उन फ़ील्ड का वर्णन करें जिन्हें आप चाहते हैं। |
पाठ, छवि और वीडियो इनपुट का समर्थन करता है। वेब खोज tool_web_search सोच टोकन को आउटपुट टोकन के रूप में बिल दिया जाता है। स्पष्ट कैश नियंत्रण समर्थित नहीं हैं।
:variant1
पाठ, छवि और वीडियो इनपुट का समर्थन करता है। वेब खोज tool_web_search सोच टोकन को आउटपुट टोकन के रूप में बिल दिया जाता है। स्पष्ट कैश नियंत्रण समर्थित नहीं हैं।
वेरिएंट Qwen3.6 Flash के वैकल्पिक संस्करण हैं जिनकी अपनी model id होती है। वेरिएंट के अनुसार serving region, कीमतें या समर्थित पैरामीटर अलग हो सकते हैं; बाकी सब वैसा ही काम करता है।
qwen3-6-flash:variant1EmpirioLabs पर Qwen3.6 Flash का बिल उपयोग के अनुसार बनता है। इस पेज की लाइव दर तालिका हमेशा API की वास्तविक बिलिंग से मेल खाती है।
Qwen3.6 Flash 1M टोकन की context window समर्थित करता है, प्रति उत्तर अधिकतम 65,536 आउटपुट टोकन के साथ।
हां। Qwen3.6 Flash OpenAI-संगत Chat Completions API देता है, इसलिए मौजूदा OpenAI SDKs base_url को https://api.empiriolabs.ai/v1 पर सेट करके और model id qwen3-6-flash रखकर काम करते हैं।
Qwen3.6 Flash 2 model ids के रूप में उपलब्ध है: डिफ़ॉल्ट qwen3-6-flash और qwen3-6-flash:variant1 (China)। वेरिएंट serving region, कीमतों या समर्थित पैरामीटरों में अलग हो सकते हैं; हर एक की दर तालिका इसी पेज पर है।
हां। EmpirioLabs playground ब्राउज़र में Qwen3.6 Flash को उन्हीं पैरामीटरों के साथ चलाता है जो API देता है, ताकि आप कोड लिखने से पहले prompt आज़मा सकें।
EmpirioLabs खाता बनाएं, फिर डैशबोर्ड में API Keys में key जनरेट करें। बिलिंग pay-as-you-go क्रेडिट से होती है, इसलिए आप सिर्फ अपनी requests का भुगतान करते हैं।
हमारे मूल्य निर्धारण की जाँच करें या यदि आप चाहते हैं कि आपका अपना मॉडल हमारे स्टैक पर तैनात किया जाए, तो पहुंचें।