Qwen3.6 Flash एपीआई

एजेंट कोडिंग, गणित तर्क, स्थानिक समझ, OCR और पाठ, छवि और वीडियो इनपुट के लिए फास्ट Qwen3.6 दृष्टि-भाषा मॉडल।

Alibaba Cloudटेक्स्ट जनरेशन1M कॉन्टेक्स्टरिलीज 16 अप्रैल 2026Singaporeस्वामित्व वाला एंडपॉइंट

Qwen3.6 Flash के बारे में

एजेंट कोडिंग, गणित तर्क, स्थानिक समझ, OCR और पाठ, छवि और वीडियो इनपुट के लिए फास्ट Qwen3.6 दृष्टि-भाषा मॉडल।

पाठ, छवि और वीडियो इनपुट का समर्थन करता है, सक्षम थिंकिंग और Think budget, फंक्शन कॉलिंग, संरचित आउटपुट और वेब सर्च के माध्यम से tool_web_search वेब खोज सक्षम होने पर क्वेरी के अनुसार $0.02 जोड़ती है। सोच टोकन को आउटपुट टोकन के रूप में बिल दिया जाता है। स्पष्ट कैश नियंत्रण समर्थित नहीं हैं।

इस नाम से भी जाना जाता है Alibaba Cloud Qwen3.6 Flash, Qwen3.6-Flash, qwen3-6-flash

reasoningvisionvideoweb searchfunction callingagentic coding

Qwen3.6 Flash की विशेषताएं

मॉडल ID
qwen3-6-flash
प्रदाता
Alibaba Cloud
श्रेणी
टेक्स्ट जनरेशन
रिलीज
16 अप्रैल 2026
कॉन्टेक्स्ट विंडो
1M टोकन
अधिकतम आउटपुट
65,536 टोकन
इनपुट
टेक्स्टइमेजवीडियो
आउटपुट
टेक्स्ट
संरचित आउटपुट
JSON मोड
रीजन
Singapore
एंडपॉइंट
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/qwen3-6-flash:generateContent
वैकल्पिक मॉडल ID
qwen3.6-flash

Qwen3.6 Flash API की कीमतें

EmpirioLabs कैटलॉग से लाइव pay-as-you-go दरें। आप सिर्फ उतना ही भुगतान करते हैं जितना उपयोग करते हैं, कोई मासिक न्यूनतम नहीं।

प्रकार
स्पेक
दर
इनपुट
प्रति 1M शीघ्र टोकन
<=256K $0.25256K-1M $1.00
उत्पादन
प्रति 1M उत्पन्न टोकन
<=256K $1.50256K-1M $4.00
वेब खोज
जब सक्षम
$0.02
पूरे कीमत पेज पर तुलना करें

Qwen3.6 Flash API को कैसे कॉल करें

Qwen3.6 Flash OpenAI-संगत Chat Completions API देता है। किसी भी OpenAI SDK को अपनी EmpirioLabs API key के साथ https://api.empiriolabs.ai/v1 पर सेट करें और model id qwen3-6-flash उपयोग करें। EmpirioLabs डैशबोर्ड से API key प्राप्त करें।

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3-6-flash",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="qwen3-6-flash",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Qwen3.6 Flash API का पूरा संदर्भ

Qwen3.6 Flash API के पैरामीटर

EmpirioLabs पर Qwen3.6 Flash API द्वारा समर्थित request पैरामीटर। फ़ील्ड छोड़ने पर डिफ़ॉल्ट मान लागू होते हैं।

पैरामीटरप्रकारडिफॉल्टरेंज / मानविवरण
temperaturenumber0.70 से 2नमूना तापमान। 0 नियतात्मक है और 2 अधिकतम यादृच्छिकता है।
top_pnumber0.90 से 1नाभिक नमूनाकरण संभाव्यता द्रव्यमान। कम मान आउटपुट को अधिक केंद्रित बनाते हैं।
max_tokensnumber40961 से 65536अधिकतम आउटपुट टोकन।
stopstring--4 स्ट्रिंग्स तक जहां मॉडल आगे टोकन उत्पन्न करना बंद कर देगा।
enable_thinkingbooleantrue-उत्तर देने से पहले तर्क सक्षम करें।
reasoning_effortenummediumnone, low, medium, high, maxतर्क प्रयास स्तर। कोई भी सोच को अक्षम नहीं करता है। निम्न, मध्यम, उच्च और अधिकतम सेट चयनित मॉडल के आकार के बाउंड थिंकिंग बजट। OpenAI-शैली reasoning_effort फ़ील्ड के...
thinking_budgetnumber327681 से 64000सोच सक्षम होने पर तर्क के लिए आरक्षित अधिकतम टोकन।
vl_high_resolution_imagesbooleantrue-छवि इनपुट के लिए उच्च रिज़ॉल्यूशन प्रसंस्करण का उपयोग करें।
max_pixelsnumber26214404096 से 16777216उच्च रिज़ॉल्यूशन प्रसंस्करण अक्षम होने पर प्रति छवि अधिकतम पिक्सेल गणना।
video_fpsnumber20.1 से 10वीडियो इनपुट से नमूना लेने के लिए प्रति सेकंड फ्रेम।
tool_web_searchbooleanfalse-वास्तविक समय की जानकारी के लिए वेब पर खोजें। सक्षम होने पर अनुरोध लागत में $0.02 जोड़ता है।
response_formatenum--आउटपुट को वैध JSON ऑब्जेक्ट (JSON मोड) के रूप में लौटाएं। अपने प्रॉम्प्ट में उन फ़ील्ड का वर्णन करें जिन्हें आप चाहते हैं।

जानने योग्य

पाठ, छवि और वीडियो इनपुट का समर्थन करता है। वेब खोज tool_web_search सोच टोकन को आउटपुट टोकन के रूप में बिल दिया जाता है। स्पष्ट कैश नियंत्रण समर्थित नहीं हैं।

:variant1

पाठ, छवि और वीडियो इनपुट का समर्थन करता है। वेब खोज tool_web_search सोच टोकन को आउटपुट टोकन के रूप में बिल दिया जाता है। स्पष्ट कैश नियंत्रण समर्थित नहीं हैं।

Qwen3.6 Flash के वेरिएंट

वेरिएंट Qwen3.6 Flash के वैकल्पिक संस्करण हैं जिनकी अपनी model id होती है। वेरिएंट के अनुसार serving region, कीमतें या समर्थित पैरामीटर अलग हो सकते हैं; बाकी सब वैसा ही काम करता है।

Qwen3.6 Flash :variant134% तक बचाएं

मॉडल ID
qwen3-6-flash:variant1
रीजन
China
कॉन्टेक्स्ट विंडो
1M टोकन
संरचित आउटपुट
JSON मोड
प्रकार
स्पेक
दर
इनपुट
प्रति 1M शीघ्र टोकन
$0.25<=256K $0.165$1.00256K-1M $0.66
उत्पादन
प्रति 1M उत्पन्न टोकन
$1.50<=256K $0.99$4.00256K-1M $3.961
वेब खोज
जब सक्षम
$0.01
Playground में :variant1 आज़माएं

Qwen3.6 Flash API: आम सवाल

Qwen3.6 Flash API की कीमत कितनी है?

EmpirioLabs पर Qwen3.6 Flash का बिल उपयोग के अनुसार बनता है। इस पेज की लाइव दर तालिका हमेशा API की वास्तविक बिलिंग से मेल खाती है।

Qwen3.6 Flash की context window कितनी है?

Qwen3.6 Flash 1M टोकन की context window समर्थित करता है, प्रति उत्तर अधिकतम 65,536 आउटपुट टोकन के साथ।

क्या Qwen3.6 Flash API OpenAI-संगत है?

हां। Qwen3.6 Flash OpenAI-संगत Chat Completions API देता है, इसलिए मौजूदा OpenAI SDKs base_url को https://api.empiriolabs.ai/v1 पर सेट करके और model id qwen3-6-flash रखकर काम करते हैं।

Qwen3.6 Flash के कौन से वेरिएंट उपलब्ध हैं?

Qwen3.6 Flash 2 model ids के रूप में उपलब्ध है: डिफ़ॉल्ट qwen3-6-flash और qwen3-6-flash:variant1 (China)। वेरिएंट serving region, कीमतों या समर्थित पैरामीटरों में अलग हो सकते हैं; हर एक की दर तालिका इसी पेज पर है।

क्या मैं इंटीग्रेट करने से पहले ब्राउज़र में Qwen3.6 Flash आज़मा सकता हूं?

हां। EmpirioLabs playground ब्राउज़र में Qwen3.6 Flash को उन्हीं पैरामीटरों के साथ चलाता है जो API देता है, ताकि आप कोड लिखने से पहले prompt आज़मा सकें।

Qwen3.6 Flash की API key कैसे मिलेगी?

EmpirioLabs खाता बनाएं, फिर डैशबोर्ड में API Keys में key जनरेट करें। बिलिंग pay-as-you-go क्रेडिट से होती है, इसलिए आप सिर्फ अपनी requests का भुगतान करते हैं।

बेहतर समापन बिंदुओं का उपयोग करने के लिए तैयार हैं?

हमारे मूल्य निर्धारण की जाँच करें या यदि आप चाहते हैं कि आपका अपना मॉडल हमारे स्टैक पर तैनात किया जाए, तो पहुंचें।