Qwen3.5 APIs

Qwen3.5 परिवार के 8 टेक्स्ट जनरेशन मॉडलों की तुलना करें, फिर वही कॉल करें जो आपकी latency, गुणवत्ता और कीमत की ज़रूरतों पर खरा उतरे।

Alibaba Cloudटेक्स्ट जनरेशन8 मॉडल

Qwen3.5 APIs के बारे में

EmpirioLabs पर Qwen3.5, Alibaba Cloud के 8 टेक्स्ट जनरेशन मॉडल APIs को एक साथ लाता है, जिनमें Qwen3.5 Plus, Qwen3.5 122B-A10B, Qwen3.5 397B-A17B, Qwen3.5 35B-A3B शामिल हैं। हर मॉडल का अपना पेज है जिसमें लाइव कीमतें, पैरामीटर, डॉक्स और playground एक्सेस है।

पूरे परिवार में वही EmpirioLabs API key और endpoint पैटर्न उपयोग करें, और request में model id बदलकर व्यवहार बदलें।

Qwen3.5 मॉडल (8)

Qwen3.5 API की कीमतें

परिवार की एक नज़र में तुलना करें, फिर पूरी लाइव दर तालिका और पैरामीटरों के लिए मॉडल पेज खोलें।

Endpoint
POST/v1/chat/completions
कीमतें
प्रकार
स्पेक
दर
इनपुट
प्रति 1M शीघ्र टोकन
$0.40<=256K $0.36$1.20256K-1M $1.08
उत्पादन
प्रति 1M उत्पन्न टोकन
$2.40<=256K $2.21$7.20256K-1M $6.62
वेब खोज
जब बुलाना
$0.015
Text-to-image search
जब बुलाना
$0.012
छवि-to-image search
जब बुलाना
$0.012
वेब एक्सट्रैक्टर
जब बुलाना
$0.00
कोड व्याख्याता
जब बुलाना
$0.00
सबसे उपयुक्त
1M संदर्भ पर पाठ, छवि और वीडियो में कुशल गहरी सोच और दृश्य समझ के लिए हाइब्रिड आर्किटेक्चर के साथ मल्टीमॉडल मॉडल।
Endpoint
POST/v1/chat/completions
कीमतें
प्रकार
स्पेक
दर
इनपुट
प्रति 1M शीघ्र टोकन
$0.40<=128K $0.115$0.40128K-256K $0.287
उत्पादन
प्रति 1M उत्पन्न टोकन
$3.20<=128K $0.917$3.20128K-256K $2.294
वेब खोज
जब बुलाना
$0.01
सबसे उपयुक्त
Qwen3.5 122B-A10B 256K संदर्भ, कुशल sparse MoE inference, और पाठ, छवि, और वीडियो इनपुट के साथ एक बहुमॉडल तर्क मॉडल है।
Endpoint
POST/v1/chat/completions
कीमतें
प्रकार
स्पेक
दर
इनपुट
प्रति 1M शीघ्र टोकन
$0.60<=128K $0.172$0.60128K-256K $0.43
उत्पादन
प्रति 1M उत्पन्न टोकन
$3.60<=128K $1.032$3.60128K-256K $2.58
वेब खोज
जब बुलाना
$0.01
सबसे उपयुक्त
Qwen3.5 397B-A17B भाषा, कोड, एजेंट, GUI कार्यों और छवि और वीडियो समझ के लिए एक प्रमुख बहुमॉडल तर्क मॉडल है।
Endpoint
POST/v1/chat/completions
कीमतें
प्रकार
स्पेक
दर
इनपुट
प्रति 1M शीघ्र टोकन
$0.25<=128K $0.057$0.25128K-256K $0.229
उत्पादन
प्रति 1M उत्पन्न टोकन
$2.00<=128K $0.459$2.00128K-256K $1.835
वेब खोज
जब बुलाना
$0.01
सबसे उपयुक्त
Qwen3.5 35B-A3B sparse MoE रूटिंग, गहरी सोच और पाठ, छवि और वीडियो इनपुट के साथ एक कुशल मूल दृष्टि भाषा मॉडल है।
Endpoint
POST/v1/chat/completions
कीमतें
प्रकार
स्पेक
दर
इनपुट
प्रति 1M शीघ्र टोकन
$0.30<=128K $0.086$0.30128K-256K $0.258
उत्पादन
प्रति 1M उत्पन्न टोकन
$2.40<=128K $0.688$2.40128K-256K $2.064
वेब खोज
जब बुलाना
$0.01
सबसे उपयुक्त
Qwen3.5 27B तेजी से प्रतिक्रियाओं, 256K संदर्भ, और पाठ, छवि और वीडियो समझ के साथ एक घनी बहुमॉडल तर्क मॉडल है।
Endpoint
POST/v1/chat/completions
कीमतें
प्रकार
स्पेक
दर
इनपुट
प्रति 1M शीघ्र टोकन
$0.10$0.09
उत्पादन
प्रति 1M उत्पन्न टोकन
$0.15$0.13
Implicit कैश पढ़ा
प्रति 1M कैश इनपुट टोकन
$0.045
वेब खोज (लिंकअप)
जब बुलाना
$0.013
सबसे उपयुक्त
Qwen3.5 9B 256K संदर्भ, छवि और वीडियो इनपुट, फ़ंक्शन टूल और संरचित आउटपुट के साथ एक कॉम्पैक्ट मल्टीमॉडल तर्क मॉडल है।
Endpoint
POST/v1/chat/completions
कीमतें
प्रकार
स्पेक
दर
इनपुट
प्रति 1M शीघ्र टोकन
$0.04
उत्पादन
प्रति 1M उत्पन्न टोकन
$0.07
Implicit कैश पढ़ा
प्रति 1M कैश इनपुट टोकन
$0.02
वेब खोज (लिंकअप)
जब बुलाना
$0.013
सबसे उपयुक्त
Qwen3.5 4B 256K संदर्भ, छवि और वीडियो इनपुट, फ़ंक्शन टूल और संरचित आउटपुट के साथ एक कम लागत वाली बहुमॉडल तर्क मॉडल है।
Endpoint
POST/v1/chat/completions
कीमतें
प्रकार
स्पेक
दर
इनपुट
प्रति 1M शीघ्र टोकन
$0.10$0.090
उत्पादन
प्रति 1M उत्पन्न टोकन
$0.40$0.368
वेब खोज
जब बुलाना
$0.015
Text-to-image search
जब बुलाना
$0.012
छवि-to-image search
जब बुलाना
$0.012
वेब एक्सट्रैक्टर
जब बुलाना
$0.00
कोड व्याख्याता
जब बुलाना
$0.00
सबसे उपयुक्त
हाइब्रिड रैखिक-attention प्लस sparse MoE, 1M संदर्भ, और तेजी से multimodal text/image /वीडियो inference के साथ दृष्टि-भाषा मॉडल।
पूरे pricing पेज पर हर मॉडल की तुलना करें

Qwen3.5 मॉडलों को कैसे कॉल करें

Qwen3.5 Plus OpenAI-संगत Chat Completions API देता है। किसी भी OpenAI SDK को अपनी EmpirioLabs API key के साथ https://api.empiriolabs.ai/v1 पर सेट करें और model id qwen3-5-plus उपयोग करें। इस परिवार के लिए, model मान को किसी भी समर्थित id से बदलें: qwen3-5-plus qwen3-5-122b-a10b qwen3-5-397b-a17b qwen3-5-35b-a3b qwen3-5-27b qwen3-5-9b qwen3-5-4b qwen3-5-flashEmpirioLabs डैशबोर्ड से API key प्राप्त करें।

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3-5-plus",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'

Qwen3.5 के उदाहरण और तुलनाएं

इस मॉडल परिवार का ज़िक्र करने वाले prompt परीक्षण, आउटपुट नोट्स और तुलना रन देखें।

Qwen3.5 APIs: आम सवाल

Qwen3.5 API क्या है?

EmpirioLabs पर Qwen3.5, Alibaba Cloud के 8 टेक्स्ट जनरेशन मॉडल APIs का परिवार है: Qwen3.5 Plus, Qwen3.5 122B-A10B, Qwen3.5 397B-A17B, Qwen3.5 35B-A3B, Qwen3.5 27B, Qwen3.5 9B, Qwen3.5 4B, Qwen3.5 Flash। आप एक EmpirioLabs API key उपयोग करते हैं और request के हिसाब से model id चुनते हैं।

मुझे कौन सा Qwen3.5 मॉडल उपयोग करना चाहिए?

उस मॉडल से शुरू करें जिसका पेज आपकी गति, गुणवत्ता और कीमत की ज़रूरतों से मेल खाता हो, फिर उसे EmpirioLabs playground में परखें। ऊपर के तुलना कार्ड हर मॉडल की लाइव दर तालिका और quickstart से जुड़े हैं।

क्या मैं अपना इंटीग्रेशन दोबारा बनाए बिना Qwen3.5 मॉडलों के बीच बदल सकता हूं?

हां। परिवार उसी EmpirioLabs API पैटर्न पर बना है, इसलिए ज़्यादातर इंटीग्रेशन सिर्फ model मान बदलकर स्विच करते हैं। अगर आप किसी मॉडल-विशेष पैरामीटर पर निर्भर हैं तो शिप करने से पहले मॉडल पेज देखें।

Qwen3.5 की कीमतें कैसे दिखाई जाती हैं?

कीमतें pay-as-you-go हैं। इस पेज के कार्ड लाइव कैटलॉग का छोटा सारांश दिखाते हैं, और हर मॉडल पेज पूरी दर तालिका दिखाता है जो API बिलिंग से मेल खाती है।

क्या मैं ब्राउज़र में Qwen3.5 आज़मा सकता हूं?

हां। इस परिवार का कोई भी मॉडल पेज खोलें और API इंटीग्रेट करने से पहले उसके playground लिंक से ब्राउज़र में prompt और पैरामीटर आज़माएं।

बेहतर समापन बिंदुओं का उपयोग करने के लिए तैयार हैं?

हमारे मूल्य निर्धारण की जाँच करें या यदि आप चाहते हैं कि आपका अपना मॉडल हमारे स्टैक पर तैनात किया जाए, तो पहुंचें।