Qwen3.5 Flash एपीआई

हाइब्रिड रैखिक-ध्यान प्लस विरल MoE, 1M संदर्भ, और तेज़ मल्टीमॉडल text/image/वीडियो अनुमान के साथ दृष्टि-भाषा मॉडल।

Alibaba Cloudपाठ निर्माण1M कॉन्टेक्स्टरिलीज 24 फ़र॰ 2026Singaporeस्वामित्व वाला एंडपॉइंट

Qwen3.5 Flash के बारे में

हाइब्रिड रैखिक-ध्यान प्लस विरल MoE, 1M संदर्भ, और तेज़ मल्टीमॉडल text/image/वीडियो अनुमान के साथ दृष्टि-भाषा मॉडल।

इस नाम से भी जाना जाता है Alibaba Cloud Qwen3.5 Flash

visionweb searchcode interpreterfunction callingreasoning

Qwen3.5 Flash की विशेषताएं

मॉडल ID
qwen3-5-flash
निर्माता
Alibaba Cloud
श्रेणी
पाठ निर्माण
रिलीज
24 फ़र॰ 2026
कॉन्टेक्स्ट विंडो
1M टोकन
अधिकतम आउटपुट
32,768 टोकन
इनपुट
टेक्स्टइमेजवीडियो
आउटपुट
टेक्स्ट
संरचित आउटपुट
JSON मोड
रीजन
Singapore
एंडपॉइंट
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/qwen3-5-flash:generateContent
वैकल्पिक मॉडल ID
qwen3.5-flash

Qwen3.5 Flash API की कीमतें10% तक बचाएं

EmpirioLabs कैटलॉग से लाइव pay-as-you-go दरें। आप सिर्फ उतना ही भुगतान करते हैं जितना उपयोग करते हैं, कोई मासिक न्यूनतम नहीं।

प्रकार
स्पेक
दर
इनपुट
प्रति 1M प्रॉम्प्ट टोकन
$0.10$0.090
उत्पादन
प्रति 1M जेनरेट किए गए टोकन
$0.40$0.368
वेब खोज
प्रति कॉल जब लागू किया जाता है
$0.015
टेक्स्ट-टू-इमेज खोज
प्रति कॉल जब लागू किया जाता है
$0.012
छवि-से-छवि खोज
प्रति कॉल जब लागू किया जाता है
$0.012
वेब चिमटा
प्रति कॉल जब लागू किया जाता है
$0.00
कोड दुभाषिया
प्रति कॉल जब लागू किया जाता है
$0.00
पूरे कीमत पेज पर तुलना करें

Qwen3.5 Flash API को कैसे कॉल करें

Qwen3.5 Flash OpenAI-संगत Chat Completions API देता है। किसी भी OpenAI SDK को अपनी EmpirioLabs API key के साथ https://api.empiriolabs.ai/v1 पर सेट करें और model id qwen3-5-flash उपयोग करें। EmpirioLabs डैशबोर्ड से API key प्राप्त करें।

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3-5-flash",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="qwen3-5-flash",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Qwen3.5 Flash API का पूरा संदर्भ

Qwen3.5 Flash API के पैरामीटर

EmpirioLabs पर Qwen3.5 Flash API द्वारा समर्थित request पैरामीटर। फ़ील्ड छोड़ने पर डिफ़ॉल्ट मान लागू होते हैं।

पैरामीटरप्रकारडिफॉल्टरेंज / मानविवरण
temperaturenumber0.70 से 2नमूना तापमान। 0 नियतात्मक है और 2 अधिकतम यादृच्छिकता है।
top_pnumber0.90 से 1नाभिक नमूनाकरण संभाव्यता द्रव्यमान। कम मान आउटपुट को अधिक केंद्रित बनाते हैं।
max_tokensnumber40961 से 32768अधिकतम आउटपुट टोकन।
enable_thinkingbooleantrue-उत्तर देने से पहले तर्क सक्षम करें।
vl_high_resolution_imagesbooleantrue-छवि इनपुट के लिए उच्च रिज़ॉल्यूशन प्रसंस्करण का उपयोग करें।
max_pixelsnumber26214401 से 99999999उच्च रिज़ॉल्यूशन प्रसंस्करण अक्षम होने पर प्रति छवि अधिकतम पिक्सेल गणना।
video_fpsnumber20.1 से 10वीडियो इनपुट से नमूना लेने के लिए प्रति सेकंड फ्रेम।
treat_images_as_videobooleanfalse-छवियों के अनुक्रम को वीडियो फ़्रेम के रूप में मानें।
tool_web_searchbooleanfalse-वास्तविक समय की जानकारी के लिए वेब पर खोजें. प्रत्येक आह्वान किए गए कॉल के लिए अनुरोध लागत में $0.015 जोड़ता है.
tool_web_extractorbooleanfalse-URL से सामग्री निकालें और पढ़ें। वेब खोज और सोच की आवश्यकता है।
tool_code_interpreterbooleanfalse-सैंडबॉक्स में पायथन कोड चलाएँ। सोचने की जरूरत है।
tool_web_search_imagebooleanfalse-पाठ विवरण से छवियों के लिए वेब पर खोजें. प्रत्येक आह्वान किए गए कॉल के लिए अनुरोध लागत में $0.012 जोड़ता है.
tool_image_searchbooleanfalse-अपलोड की गई इमेज से मिलते-जुलते इमेज ढूंढें. हर कॉल के लिए अनुरोध की कीमत में $0.012 जोड़ता है.
response_formatenum--आउटपुट को वैध JSON ऑब्जेक्ट (JSON मोड) के रूप में लौटाएं। अपने प्रॉम्प्ट में उन फ़ील्ड का वर्णन करें जिन्हें आप चाहते हैं।
डॉक्स में 1 और पैरामीटर

जानने योग्य

अंतर्निहित उपकरण (केवल लागू होने पर बिल किया जाता है) - वेब खोज: $0.015/call - वेब चिमटा: मुक्त - कोड दुभाषिया: मुफ्त - टेक्स्ट-टू-इमेज खोज: $0.012/call - छवि-से-छवि खोज: $0.012/call अन्य - थिंकिंग टोकन को आउटपुट टोकन के रूप में बिल किया जाता है टेक्स्ट-टू-इमेज सर्च और इमेज-टू-इमेज सर्च इमेज सर्च मूल्य निर्धारण पंक्ति का उपयोग करते हैं। प्रत्येक आह्वान की गई छवि खोज को उस सूचीबद्ध प्रति-कॉल दर पर बिल किया जाता है।

Per-tool billing (usage.tool_usage)

When this model invokes tools (web search, code interpreter, etc.) inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts. The example below shows the shape, exact field names, units, and which tools appear can vary slightly per provider:

"usage": {
  "prompt_tokens": 123,
  "completion_tokens": 456,
  "cost_usd": 0.0042,
  "tool_usage": {"web_search": 3, "code_interpreter": 1}
}

The tool counts are already factored into cost_usd, they are surfaced for transparency so you can audit per-tool billing. The field is omitted when no tools were invoked.

:variant1

टेक्स्ट, इमेज और वीडियो इनपुट का समर्थन करता है. वेब खोज tool_web_search के माध्यम से उपलब्ध है और सक्षम होने पर प्रति क्वेरी $0.01 जोड़ती है. थिंकिंग टोकन को आउटपुट टोकन के रूप में बिल किया जाता है. स्पष्ट कैश नियंत्रण समर्थित नहीं हैं.

Qwen3.5 Flash के वेरिएंट

वेरिएंट Qwen3.5 Flash के वैकल्पिक संस्करण हैं जिनकी अपनी model id होती है। वेरिएंट के अनुसार serving region, कीमतें या समर्थित पैरामीटर अलग हो सकते हैं; बाकी सब वैसा ही काम करता है।

Qwen3.5 Flash :variant168% तक बचाएं

मॉडल ID
qwen3-5-flash:variant1
रीजन
China
कॉन्टेक्स्ट विंडो
1M टोकन
संरचित आउटपुट
JSON मोड
Batch API
उपलब्ध, सूची मूल्य पर 35% छूट
प्रकार
स्पेक
दर
इनपुट
प्रति 1M प्रॉम्प्ट टोकन
$0.090<=128K $0.029128K-256K $0.115256K-1M $0.172
उत्पादन
प्रति 1M जेनरेट किए गए टोकन
$0.368<=128K $0.287128K-256K $1.147256K-1M $1.72
वेब खोज
प्रति कॉल जब लागू किया जाता है
$0.01
Playground में :variant1 आज़माएं

Qwen3.5 Flash API: आम सवाल

Qwen3.5 Flash API की कीमत कितनी है?

EmpirioLabs पर Qwen3.5 Flash का बिल उपयोग के अनुसार बनता है। इस पेज की लाइव दर तालिका हमेशा API की वास्तविक बिलिंग से मेल खाती है।

Qwen3.5 Flash की context window कितनी है?

Qwen3.5 Flash 1M टोकन की context window समर्थित करता है, प्रति उत्तर अधिकतम 32,768 आउटपुट टोकन के साथ।

क्या Qwen3.5 Flash API OpenAI-संगत है?

हां। Qwen3.5 Flash OpenAI-संगत Chat Completions API देता है, इसलिए मौजूदा OpenAI SDKs base_url को https://api.empiriolabs.ai/v1 पर सेट करके और model id qwen3-5-flash रखकर काम करते हैं।

Qwen3.5 Flash के कौन से वेरिएंट उपलब्ध हैं?

Qwen3.5 Flash 2 model ids के रूप में उपलब्ध है: डिफ़ॉल्ट qwen3-5-flash और qwen3-5-flash:variant1 (China)। वेरिएंट serving region, कीमतों या समर्थित पैरामीटरों में अलग हो सकते हैं; हर एक की दर तालिका इसी पेज पर है।

क्या मैं इंटीग्रेट करने से पहले ब्राउज़र में Qwen3.5 Flash आज़मा सकता हूं?

हां। EmpirioLabs playground ब्राउज़र में Qwen3.5 Flash को उन्हीं पैरामीटरों के साथ चलाता है जो API देता है, ताकि आप कोड लिखने से पहले prompt आज़मा सकें।

Qwen3.5 Flash की API key कैसे मिलेगी?

EmpirioLabs खाता बनाएं, फिर डैशबोर्ड में API Keys में key जनरेट करें। बिलिंग pay-as-you-go क्रेडिट से होती है, इसलिए आप सिर्फ अपनी requests का भुगतान करते हैं।

बेहतर समापन बिंदुओं का उपयोग करने के लिए तैयार हैं?

हमारे मूल्य निर्धारण की जाँच करें या यदि आप चाहते हैं कि आपका अपना मॉडल हमारे स्टैक पर तैनात किया जाए, तो पहुंचें।