Qwen3.8 Max 0902 अलीबाबा के फ्लैगशिप Qwen3.8 Max का उन्नत स्नैपशॉट है, जिसे 2 सितंबर, 2026 को रिलीज़ किया गया है। यह फ्लैगशिप के लिए जाना जाता है, एक 1M टोकन संदर्भ, टेक्स्ट, छवि और वीडियो समझ, गहरी सोच जो डिफ़ॉल्ट रूप से चालू है, और पांच अंतर्निहित उपकरण, और वास्तविक काम के लिए महत्वपूर्ण भागों को तेज करता है: इंजीनियरिंग-पैमाने की परियोजनाओं पर कोडिंग, लंबे-क्षितिज स्वायत्त विकास, स्थिर मल्टी-टूल एजेंट ऑर्केस्ट्रेशन, और अधिक विश्वसनीय चार्ट रीजनिंग और दस्तावेज़ पार्सिंग।
Qwen3.8 Max 0902 आज EmpirioLabs पर एक OpenAI-संगत API के माध्यम से लाइव है, जिसमें फ़ंक्शन कॉलिंग, सख्त JSON स्कीमा संरचित आउटपुट, स्ट्रीमिंग और 128K आउटपुट टोकन तक हैं। इसे में आज़माएं खेल इसे किसी भी OpenAI-compatible क्लाइंट से कॉल करें। पूर्ण कल्पना और वर्तमान दरों पर रहते हैं Qwen3.8 अधिकतम 0902 मॉडल पृष्ठ और एपीआई डॉक।.
मूल्य निर्धारण
बिलिंग एक फ्लैट इनपुट दर और प्रत्येक प्रॉम्प्ट आकार पर एक फ्लैट आउटपुट दर के साथ उपयोग किया जाता है, जो Qwen3.8 Max के समान दर है, और कोई अलग कैश टियर नहीं है। वेब खोज, text-to-image खोज, और image-to-image खोज एक छोटा प्रति-कॉल शुल्क जोड़ती है जो केवल तभी लागू होती है जब कोई कॉल वास्तव में चलती है; वेब एक्सट्रैक्टर और कोड दुभाषिया बिना किसी अतिरिक्त लागत के चलते हैं। टोकन को आउटपुट टोकन के रूप में सोचना। वर्तमान दरें हमेशा पर रहती हैं मॉडल पेज और मूल्य निर्धारण पृष्ठ, जो आप जो चार्ज कर रहे हैं उसके साथ सिंक में रहते हैं।.
क्विकस्टार्ट
EmpirioLabs आधार URL पर किसी भी OpenAI SDK को इंगित करें और पास करें qwen3-8-max-0902 मॉडल के रूप में:
OpenAI आयात OpenAI क्लाइंट से = OpenAI (base_url="https://api.empiriolabs.ai/v1", api_key="YOUR_EMPIRIOLABS_API_KEY",) resp = client.chat.completions.create(model ="qwen3-8-max-0902", messages=[ {"role": "user", "content": [ {"type": "text", "text": "इस चार्ट में प्रवृत्ति को सारांशित करें और किसी भी असामान्य चीज़ को फ़्लैग करें। "}, {"प्रकार": "image_url", "image_url": {"url": "https://example.com/chart.png"}}, ]}, ], extra_body={"enable_thinking": सच, "thinking_budget": 8192},) print(resp.choices[0].message.content)
वही मॉडल आईडी काम करती है TOKEN, मानवशास्त्रीय आकार का TOKEN, और Google-संगत /v1beta/models/qwen3-8-max-0902:generateContent मार्ग। वैकल्पिक आईडी qwen3.8-max-0902 तथा qwen3.8-max-2026-09-02 एक ही मॉडल के लिए हल करें।
विचारशील
गहरी सोच डिफ़ॉल्ट रूप से चालू है और वापस स्ट्रीम करती है तर्क content उत्तर के साथ। इसे नियंत्रित करें सक्षम तथा thinking_budget (262,144 टोकन तक), या भेजें तर्क effort और प्लेटफ़ॉर्म इसे मॉडल के लिए बजट आकार में मैप करता है। टोकन को आउटपुट टोकन के रूप में सोचना, इसलिए सोच को अक्षम करें या छोटे, विलंबता-संवेदनशील मोड़ों के लिए एक छोटा बजट निर्धारित करें।
अंतर्निहित उपकरण
पांच अंतर्निर्मित उपकरण पीछे की सवारी करते हैं tool_* टॉगल करता है और डिफ़ॉल्ट रूप से सभी बंद हैं: TOKEN, tool_web_extractor, tool_code_interpreter, tool_web_search_image, और tool_image_search. वेब एक्सट्रैक्टर को वेब खोज की आवश्यकता होती है, और एक्सट्रैक्टर और कोड दुभाषिया दोनों केवल तभी चलते हैं जब सोच सक्षम होती है। जब उपकरण चलते हैं, तो प्रतिक्रिया की usage.tool_usage MAP रिपोर्ट करता है कि वास्तव में कितनी कॉल की गई थीं, ताकि आप प्रति-टूल बिलिंग का ऑडिट कर सकें.
संरचित आउटपुट
सटीक प्रतिक्रिया आकार के लिए, पास करें response_format साथ {"प्रकार": "json_schema",...} तथा "सख्त": सच: मॉडल बिना किसी अतिरिक्त के स्कीमा की चाबियाँ लौटाता है। सादा JSON मोड के साथ {"प्रकार": "json_object"} भी समर्थित है।
आपकी पहली कॉल से पहले जानने लायक बातें
- दिनांकित आईडी पिन करें जब आपके तहत व्यवहार नहीं बदलना चाहिए।
qwen3-8-maxअलीबाबा के वर्तमान डिफ़ॉल्ट Qwen3.8 Max बिल्ड का अनुसरण करता है, जबकिqwen3-8-max-0902इस स्नैपशॉट पर रहता है। evals और उत्पादन पाइपलाइनों के लिए दिनांकित आईडी का उपयोग करें जिन्हें प्रतिलिपि प्रस्तुत करने योग्य आउटपुट की आवश्यकता होती है। tool_choice: "आवश्यक"सोच के दौरान काम नहीं करता है। अनुरोध एक स्पष्ट त्रुटि के साथ अस्वीकार कर दिया जाता है। रखनाtool_choice: "ऑटो"सोच सक्षम या सेट के साथenable_thinking: असत्यजब आपको किसी फ़ंक्शन कॉल को बाध्य करने की आवश्यकता होती है।- JSON मोड को आपके संदेशों में "json" शब्द की आवश्यकता होती है। A
{"प्रकार": "json_object"}अनुरोध तब तक अस्वीकार कर दिया जाता है जब तक कि यह शब्द बातचीत में कहीं दिखाई न दे। JSON स्कीमा अनुरोधों की ऐसी कोई आवश्यकता नहीं है।
Qwen3.8 Max 0902 अब उपलब्ध है खेल और के माध्यम से EmpirioLabs एपीआई।.



