Qwen3.5 Flash एपीआई

हाइब्रिड रैखिक-attention प्लस sparse MoE, 1M संदर्भ, और तेजी से multimodal text/image /वीडियो inference के साथ दृष्टि-भाषा मॉडल।

Alibaba Cloudटेक्स्ट जनरेशन1M कॉन्टेक्स्टरिलीज 24 फ़र॰ 2026Singaporeस्वामित्व वाला एंडपॉइंट

Qwen3.5 Flash के बारे में

हाइब्रिड रैखिक-attention प्लस sparse MoE, 1M संदर्भ, और तेजी से multimodal text/image /वीडियो inference के साथ दृष्टि-भाषा मॉडल।

इस नाम से भी जाना जाता है Alibaba Cloud Qwen3.5 Flash, Qwen3.5-Flash, qwen3-5-flash

visionweb searchcode interpreterfunction callingreasoning

Qwen3.5 Flash की विशेषताएं

मॉडल ID
qwen3-5-flash
प्रदाता
Alibaba Cloud
श्रेणी
टेक्स्ट जनरेशन
रिलीज
24 फ़र॰ 2026
कॉन्टेक्स्ट विंडो
1M टोकन
अधिकतम आउटपुट
32,768 टोकन
इनपुट
टेक्स्टइमेजवीडियो
आउटपुट
टेक्स्ट
संरचित आउटपुट
JSON मोड
रीजन
Singapore
एंडपॉइंट
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/qwen3-5-flash:generateContent
वैकल्पिक मॉडल ID
qwen3.5-flash

Qwen3.5 Flash API की कीमतें10% तक बचाएं

EmpirioLabs कैटलॉग से लाइव pay-as-you-go दरें। आप सिर्फ उतना ही भुगतान करते हैं जितना उपयोग करते हैं, कोई मासिक न्यूनतम नहीं।

प्रकार
स्पेक
दर
इनपुट
प्रति 1M शीघ्र टोकन
$0.10$0.090
उत्पादन
प्रति 1M उत्पन्न टोकन
$0.40$0.368
वेब खोज
जब सक्षम
$0.015
छवि खोज
प्रति कॉल
$0.012
पूरे कीमत पेज पर तुलना करें

Qwen3.5 Flash API को कैसे कॉल करें

Qwen3.5 Flash OpenAI-संगत Chat Completions API देता है। किसी भी OpenAI SDK को अपनी EmpirioLabs API key के साथ https://api.empiriolabs.ai/v1 पर सेट करें और model id qwen3-5-flash उपयोग करें। EmpirioLabs डैशबोर्ड से API key प्राप्त करें।

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3-5-flash",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="qwen3-5-flash",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Qwen3.5 Flash API का पूरा संदर्भ

Qwen3.5 Flash API के पैरामीटर

EmpirioLabs पर Qwen3.5 Flash API द्वारा समर्थित request पैरामीटर। फ़ील्ड छोड़ने पर डिफ़ॉल्ट मान लागू होते हैं।

पैरामीटरप्रकारडिफॉल्टरेंज / मानविवरण
temperaturenumber0.70 से 2नमूना तापमान। 0 = नियतात्मक, 2 = अधिकतम यादृच्छिकता।
top_pnumber0.90 से 1नाभिक नमूनाकरण संभाव्यता द्रव्यमान। निचला = अधिक केंद्रित।
max_tokensnumber40961 से 32768प्रतिक्रिया में अधिकतम टोकन।
enable_thinkingbooleantrue-विस्तारित सोच मोड सक्षम करें। धीमा लेकिन तर्क-भारी कार्यों में सुधार करता है।
vl_high_resolution_imagesbooleantrue-इनपुट छवियों के लिए उच्च रिज़ॉल्यूशन का उपयोग करें। उच्च लागत पर बेहतर विवरण।
max_pixelsnumber26214401 से 99999999प्रति इनपुट छवि अधिकतम पिक्सेल। बड़ा = अधिक विवरण लेकिन धीमा/अधिक टोकन।
tool_web_searchbooleanfalse-वास्तविक समय की जानकारी के लिए वेब पर खोजें।
tool_web_extractorbooleantrue-URL से सामग्री निकालें और पढ़ें। वेब खोज और सोच की आवश्यकता है।
tool_code_interpreterbooleantrue-सैंडबॉक्स में पायथन कोड चलाएँ। सोचने की जरूरत है।
tool_web_search_imagebooleantrue-पाठ विवरण से छवियों के लिए वेब पर खोजें।
tool_image_searchbooleantrue-अपलोड की गई छवि से मिलते-जुलते चित्र ढूंढें.
video_fpsnumber20.1 से 10विश्लेषण के लिए इनपुट वीडियो से फ्रेम्स-प्रति-सेकंड का नमूना लिया गया।
treat_images_as_videobooleanfalse-अस्थायी तर्क के लिए एक वीडियो के रूप में इनपुट छवियों के एक अनुक्रम का इलाज करें।
response_formatenum--आउटपुट को वैध JSON ऑब्जेक्ट (JSON मोड) के रूप में लौटाएं। अपने प्रॉम्प्ट में उन फ़ील्ड का वर्णन करें जिन्हें आप चाहते हैं।
डॉक्स में 1 और पैरामीटर

जानने योग्य

**बिल्ट-इन टूल* (केवल जब आमंत्रित किया जाता है) - वेब खोज: $0.015/call वेब एक्सट्रैक्टर: मुफ्त - कोड व्याख्याता: मुफ्त - टेक्स्ट-टू-image खोज: $0.012/call Image-to-image search: $0.012/call **अन्य* - सोचे गए टोकनों को आउटपुट टोकन टेक्स्ट-टू-Image Search और इमेज-टू-Image Search के रूप में बिल दिया जाता है, छवि खोज मूल्य निर्धारण पंक्ति का उपयोग करता है। प्रत्येक प्रकाशित छवि खोज को उस सूचीबद्ध प्रति-कॉल दर पर बिल दिया जाता है।

Per-tool billing (usage.tool_usage)

When this model invokes tools (web search, code interpreter, etc.) inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts. The example below shows the shape — exact field names, units, and which tools appear can vary slightly per provider:

"usage": {
  "prompt_tokens": 123,
  "completion_tokens": 456,
  "cost_usd": 0.0042,
  "tool_usage": {"web_search": 3, "code_interpreter": 1}
}

The tool counts are already factored into cost_usd — they are surfaced for transparency so you can audit per-tool billing. The field is omitted when no tools were invoked.

:variant1

पाठ, छवि और वीडियो इनपुट का समर्थन करता है। वेब खोज tool_web_search सोच टोकन को आउटपुट टोकन के रूप में बिल दिया जाता है। स्पष्ट कैश नियंत्रण समर्थित नहीं हैं।

Qwen3.5 Flash के वेरिएंट

वेरिएंट Qwen3.5 Flash के वैकल्पिक संस्करण हैं जिनकी अपनी model id होती है। वेरिएंट के अनुसार serving region, कीमतें या समर्थित पैरामीटर अलग हो सकते हैं; बाकी सब वैसा ही काम करता है।

Qwen3.5 Flash :variant168% तक बचाएं

मॉडल ID
qwen3-5-flash:variant1
रीजन
China
कॉन्टेक्स्ट विंडो
1M टोकन
संरचित आउटपुट
JSON मोड
Batch API
उपलब्ध, सूची मूल्य पर 35% छूट
प्रकार
स्पेक
दर
इनपुट
प्रति 1M शीघ्र टोकन
$0.090<=128K $0.029128K-256K $0.115256K-1M $0.172
उत्पादन
प्रति 1M उत्पन्न टोकन
$0.368<=128K $0.287128K-256K $1.147256K-1M $1.72
वेब खोज
जब सक्षम
$0.01
Playground में :variant1 आज़माएं

Qwen3.5 Flash API: आम सवाल

Qwen3.5 Flash API की कीमत कितनी है?

EmpirioLabs पर Qwen3.5 Flash का बिल उपयोग के अनुसार बनता है। इस पेज की लाइव दर तालिका हमेशा API की वास्तविक बिलिंग से मेल खाती है।

Qwen3.5 Flash की context window कितनी है?

Qwen3.5 Flash 1M टोकन की context window समर्थित करता है, प्रति उत्तर अधिकतम 32,768 आउटपुट टोकन के साथ।

क्या Qwen3.5 Flash API OpenAI-संगत है?

हां। Qwen3.5 Flash OpenAI-संगत Chat Completions API देता है, इसलिए मौजूदा OpenAI SDKs base_url को https://api.empiriolabs.ai/v1 पर सेट करके और model id qwen3-5-flash रखकर काम करते हैं।

Qwen3.5 Flash के कौन से वेरिएंट उपलब्ध हैं?

Qwen3.5 Flash 2 model ids के रूप में उपलब्ध है: डिफ़ॉल्ट qwen3-5-flash और qwen3-5-flash:variant1 (China)। वेरिएंट serving region, कीमतों या समर्थित पैरामीटरों में अलग हो सकते हैं; हर एक की दर तालिका इसी पेज पर है।

क्या मैं इंटीग्रेट करने से पहले ब्राउज़र में Qwen3.5 Flash आज़मा सकता हूं?

हां। EmpirioLabs playground ब्राउज़र में Qwen3.5 Flash को उन्हीं पैरामीटरों के साथ चलाता है जो API देता है, ताकि आप कोड लिखने से पहले prompt आज़मा सकें।

Qwen3.5 Flash की API key कैसे मिलेगी?

EmpirioLabs खाता बनाएं, फिर डैशबोर्ड में API Keys में key जनरेट करें। बिलिंग pay-as-you-go क्रेडिट से होती है, इसलिए आप सिर्फ अपनी requests का भुगतान करते हैं।

बेहतर समापन बिंदुओं का उपयोग करने के लिए तैयार हैं?

हमारे मूल्य निर्धारण की जाँच करें या यदि आप चाहते हैं कि आपका अपना मॉडल हमारे स्टैक पर तैनात किया जाए, तो पहुंचें।