Qwen3.8 Max एपीआई

कोडिंग, लंबे समय तक चलने वाले एजेंटों और पेशेवर काम के लिए ट्रिलियन पैमाने पर मोई फ्लैगशिप, जिसमें 1M-token संदर्भ में छवि और वीडियो समझ शामिल है।

Alibaba Cloudटेक्स्ट जनरेशन1M कॉन्टेक्स्टरिलीज 3 अग॰ 2026Singaporeस्वामित्व वाला एंडपॉइंटनया

Qwen3.8 Max के बारे में

कोडिंग, लंबे समय तक चलने वाले एजेंटों और पेशेवर काम के लिए ट्रिलियन पैमाने पर मोई फ्लैगशिप, जिसमें 1M-token संदर्भ में छवि और वीडियो समझ शामिल है।

पाठ, छवि और वीडियो इनपुट का समर्थन करता है, सक्षम थिंकिंग और सोच के साथ सोच मोड budget up to 262144 tokens, फंक्शन कॉलिंग, संरचित उत्पादन जिसमें सख्त JSON स्कीमा, और पांच अंतर्निहित उपकरण शामिल हैं: tool_web_search tool_code_interpreter, tool_web_search_image, और tool_image_search सोच टोकन को आउटपुट टोकन के रूप में बिल दिया जाता है।

इस नाम से भी जाना जाता है Alibaba Cloud Qwen3.8 Max

reasoningvisionmultimodalweb searchcode interpreterfunction callingstructured outputagentic coding

Qwen3.8 Max की विशेषताएं

मॉडल ID
qwen3-8-max
प्रदाता
Alibaba Cloud
श्रेणी
टेक्स्ट जनरेशन
रिलीज
3 अग॰ 2026
कॉन्टेक्स्ट विंडो
1M टोकन
अधिकतम आउटपुट
1,31,072 टोकन
इनपुट
टेक्स्टइमेजवीडियो
आउटपुट
टेक्स्ट
संरचित आउटपुट
JSON Schema
रीजन
Singapore
एंडपॉइंट
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/qwen3-8-max:generateContent
वैकल्पिक मॉडल ID
qwen3.8-max

Qwen3.8 Max API की कीमतें

EmpirioLabs कैटलॉग से लाइव pay-as-you-go दरें। आप सिर्फ उतना ही भुगतान करते हैं जितना उपयोग करते हैं, कोई मासिक न्यूनतम नहीं।

प्रकार
स्पेक
दर
इनपुट
प्रति 1M शीघ्र टोकन
$2.00
उत्पादन
प्रति 1M उत्पन्न टोकन
$6.00
वेब खोज
जब बुलाना
$0.02
Text-to-image search
जब बुलाना
$0.02
छवि-to-image search
जब बुलाना
$0.02
वेब एक्सट्रैक्टर
जब बुलाना
$0.00
कोड व्याख्याता
जब बुलाना
$0.00
पूरे कीमत पेज पर तुलना करें

Qwen3.8 Max API को कैसे कॉल करें

Qwen3.8 Max OpenAI-संगत Chat Completions API देता है। किसी भी OpenAI SDK को अपनी EmpirioLabs API key के साथ https://api.empiriolabs.ai/v1 पर सेट करें और model id qwen3-8-max उपयोग करें। EmpirioLabs डैशबोर्ड से API key प्राप्त करें।

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3-8-max",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="qwen3-8-max",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Qwen3.8 Max API का पूरा संदर्भ

Qwen3.8 Max API के पैरामीटर

EmpirioLabs पर Qwen3.8 Max API द्वारा समर्थित request पैरामीटर। फ़ील्ड छोड़ने पर डिफ़ॉल्ट मान लागू होते हैं।

पैरामीटरप्रकारडिफॉल्टरेंज / मानविवरण
temperaturenumber0.70 से 2नमूना तापमान। 0 नियतात्मक है और 2 अधिकतम यादृच्छिकता है।
top_pnumber0.90 से 1नाभिक नमूनाकरण संभाव्यता द्रव्यमान। कम मान आउटपुट को अधिक केंद्रित बनाते हैं।
max_tokensnumber40961 से 131072अधिकतम आउटपुट टोकन।
stopstring--4 स्ट्रिंग्स तक जहां मॉडल आगे टोकन उत्पन्न करना बंद कर देगा।
enable_thinkingbooleantrue-उत्तर देने से पहले तर्क सक्षम करें।
reasoning_effortenummediumnone, low, medium, high, maxतर्क प्रयास स्तर। कोई भी सोच को अक्षम नहीं करता है। निम्न, मध्यम, उच्च और अधिकतम सेट चयनित मॉडल के आकार के बाउंड थिंकिंग बजट।
thinking_budgetnumber327681 से 262144सोच सक्षम होने पर तर्क के लिए आरक्षित अधिकतम टोकन।
vl_high_resolution_imagesbooleantrue-छवि इनपुट के लिए उच्च रिज़ॉल्यूशन प्रसंस्करण का उपयोग करें।
max_pixelsnumber26214404096 से 16777216उच्च रिज़ॉल्यूशन प्रसंस्करण अक्षम होने पर प्रति छवि अधिकतम पिक्सेल गणना।
video_fpsnumber20.1 से 10वीडियो इनपुट से नमूना लेने के लिए प्रति सेकंड फ्रेम।
treat_images_as_videobooleanfalse-छवियों के अनुक्रम को वीडियो फ़्रेम के रूप में मानें।
tool_web_searchbooleantrue-वास्तविक समय की जानकारी के लिए वेब खोजें। Adds $0.02
tool_web_extractorbooleantrue-URL से सामग्री निकालें और पढ़ें। वेब खोज और सोच की आवश्यकता है।
tool_code_interpreterbooleantrue-सैंडबॉक्स में पायथन कोड चलाएँ। सोचने की जरूरत है।
डॉक्स में 4 और पैरामीटर

जानने योग्य

पाठ, छवि और वीडियो इनपुट समर्थित हैं। वेब खोज, वेब एक्सट्रैक्टर, कोड अनुवादक, text-to-image खोज, और image-to-image खोज वैकल्पिक अंतर्निहित उपकरण हैं जो टूल * मापदंडों के माध्यम से उजागर होते हैं। वेब खोज, text-to-image search, and image-to-image search add $0.02 वेब एक्सट्रैक्टर को वेब सर्च की आवश्यकता होती है और दोनों वेब एक्सट्रैक्टर और कोड अनुवादक को सोचने की आवश्यकता होती है। एक एकल अनुरोध एक से अधिक एक टूल को बुला सकता है, और प्रत्येक रद्द कॉल बिल किया जाता है। सोच टोकन को आउटपुट टोकन के रूप में बिल दिया जाता है।

Per-tool billing (usage.tool_usage)

When this model invokes built-in tools inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts:

"usage": {
  "prompt_tokens": 123,
  "completion_tokens": 456,
  "cost_usd": 0.0042,
  "tool_usage": {"web_search": 3, "code_interpreter": 1}
}

Tool counts are already factored into cost_usd and are surfaced for transparency so you can audit per-tool billing. The field is omitted when no tools were invoked.

:variant1

पाठ, छवि और वीडियो इनपुट समर्थित हैं। वेब खोज, वेब एक्सट्रैक्टर, कोड अनुवादक, text-to-image खोज, और image-to-image खोज वैकल्पिक अंतर्निहित उपकरण हैं जो टूल * मापदंडों के माध्यम से उजागर होते हैं। वेब खोज, text-to-image search, and image-to-image search add $0.02 वेब एक्सट्रैक्टर को वेब सर्च की आवश्यकता होती है और दोनों वेब एक्सट्रैक्टर और कोड अनुवादक को सोचने की आवश्यकता होती है। एक एकल अनुरोध एक से अधिक एक टूल को बुला सकता है, और प्रत्येक रद्द कॉल बिल किया जाता है। सोच टोकन को आउटपुट टोकन के रूप में बिल दिया जाता है।

Qwen3.8 Max के वेरिएंट

वेरिएंट Qwen3.8 Max के वैकल्पिक संस्करण हैं जिनकी अपनी model id होती है। वेरिएंट के अनुसार serving region, कीमतें या समर्थित पैरामीटर अलग हो सकते हैं; बाकी सब वैसा ही काम करता है।

Qwen3.8 Max :variant118% तक बचाएं

मॉडल ID
qwen3-8-max:variant1
रीजन
China
कॉन्टेक्स्ट विंडो
1M टोकन
संरचित आउटपुट
JSON Schema
वैकल्पिक मॉडल ID
qwen3.8-max:variant1
प्रकार
स्पेक
दर
इनपुट
प्रति 1M शीघ्र टोकन
$2.00$1.65
उत्पादन
प्रति 1M उत्पन्न टोकन
$6.00$4.951
वेब खोज
जब बुलाना
$0.01
Text-to-image search
जब बुलाना
$0.01
छवि-to-image search
जब बुलाना
$0.01
वेब एक्सट्रैक्टर
जब बुलाना
$0.00
कोड व्याख्याता
जब बुलाना
$0.00
Playground में :variant1 आज़माएं

Qwen3.8 Max API: आम सवाल

Qwen3.8 Max API की कीमत कितनी है?

EmpirioLabs पर Qwen3.8 Max का बिल उपयोग के अनुसार बनता है: इनपुट $2.00 प्रति 1M शीघ्र टोकन; उत्पादन $6.00 प्रति 1M उत्पन्न टोकन; वेब खोज $0.02 जब बुलाना। इस पेज की लाइव दर तालिका हमेशा API की वास्तविक बिलिंग से मेल खाती है।

Qwen3.8 Max की context window कितनी है?

Qwen3.8 Max 1M टोकन की context window समर्थित करता है, प्रति उत्तर अधिकतम 1,31,072 आउटपुट टोकन के साथ।

क्या Qwen3.8 Max API OpenAI-संगत है?

हां। Qwen3.8 Max OpenAI-संगत Chat Completions API देता है, इसलिए मौजूदा OpenAI SDKs base_url को https://api.empiriolabs.ai/v1 पर सेट करके और model id qwen3-8-max रखकर काम करते हैं।

Qwen3.8 Max के कौन से वेरिएंट उपलब्ध हैं?

Qwen3.8 Max 2 model ids के रूप में उपलब्ध है: डिफ़ॉल्ट qwen3-8-max और qwen3-8-max:variant1 (China)। वेरिएंट serving region, कीमतों या समर्थित पैरामीटरों में अलग हो सकते हैं; हर एक की दर तालिका इसी पेज पर है।

क्या मैं इंटीग्रेट करने से पहले ब्राउज़र में Qwen3.8 Max आज़मा सकता हूं?

हां। EmpirioLabs playground ब्राउज़र में Qwen3.8 Max को उन्हीं पैरामीटरों के साथ चलाता है जो API देता है, ताकि आप कोड लिखने से पहले prompt आज़मा सकें।

Qwen3.8 Max की API key कैसे मिलेगी?

EmpirioLabs खाता बनाएं, फिर डैशबोर्ड में API Keys में key जनरेट करें। बिलिंग pay-as-you-go क्रेडिट से होती है, इसलिए आप सिर्फ अपनी requests का भुगतान करते हैं।

बेहतर समापन बिंदुओं का उपयोग करने के लिए तैयार हैं?

हमारे मूल्य निर्धारण की जाँच करें या यदि आप चाहते हैं कि आपका अपना मॉडल हमारे स्टैक पर तैनात किया जाए, तो पहुंचें।