Qwen3 Max Thinking एपीआई

अनुकूली उपकरण उपयोग (अनुसंधान, स्मृति, कोड अनुवादक) और जटिल कार्यों पर उच्च सटीकता के लिए परीक्षण समय स्केलिंग के साथ रीजनिंग मॉडल।

Alibaba Cloudटेक्स्ट जनरेशन256K कॉन्टेक्स्टरिलीज 23 सित॰ 2025Singaporeस्वामित्व वाला एंडपॉइंट

Qwen3 Max Thinking के बारे में

अनुकूली उपकरण उपयोग (अनुसंधान, स्मृति, कोड अनुवादक) और जटिल कार्यों पर उच्च सटीकता के लिए परीक्षण समय स्केलिंग के साथ रीजनिंग मॉडल।

इस नाम से भी जाना जाता है Alibaba Cloud Qwen3 Max Thinking, Qwen3-Max-Thinking

reasoningcode interpreterweb searchthinking

Qwen3 Max Thinking की विशेषताएं

मॉडल ID
qwen3-max-thinking
प्रदाता
Alibaba Cloud
श्रेणी
टेक्स्ट जनरेशन
रिलीज
23 सित॰ 2025
कॉन्टेक्स्ट विंडो
256K टोकन
अधिकतम आउटपुट
65,536 टोकन
इनपुट
टेक्स्ट
आउटपुट
टेक्स्ट
संरचित आउटपुट
JSON मोड
रीजन
Singapore
एंडपॉइंट
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/qwen3-max-thinking:generateContent

Qwen3 Max Thinking API की कीमतें10% तक बचाएं

EmpirioLabs कैटलॉग से लाइव pay-as-you-go दरें। आप सिर्फ उतना ही भुगतान करते हैं जितना उपयोग करते हैं, कोई मासिक न्यूनतम नहीं।

प्रकार
स्पेक
दर
इनपुट
प्रति 1M शीघ्र टोकन
$1.20<=32K $1.08$2.4032K-128K $2.16$3.00128K-256K $2.70
उत्पादन
प्रति 1M उत्पन्न टोकन
$6.00<=32K $5.52$12.0032K-128K $11.04$15.00128K-256K $13.80
वेब खोज
प्रति अनुरोध
$0.015
पूरे कीमत पेज पर तुलना करें

Qwen3 Max Thinking API को कैसे कॉल करें

Qwen3 Max Thinking OpenAI-संगत Chat Completions API देता है। किसी भी OpenAI SDK को अपनी EmpirioLabs API key के साथ https://api.empiriolabs.ai/v1 पर सेट करें और model id qwen3-max-thinking उपयोग करें। EmpirioLabs डैशबोर्ड से API key प्राप्त करें।

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3-max-thinking",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="qwen3-max-thinking",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Qwen3 Max Thinking API का पूरा संदर्भ

Qwen3 Max Thinking API के पैरामीटर

EmpirioLabs पर Qwen3 Max Thinking API द्वारा समर्थित request पैरामीटर। फ़ील्ड छोड़ने पर डिफ़ॉल्ट मान लागू होते हैं।

पैरामीटरप्रकारडिफॉल्टरेंज / मानविवरण
temperaturenumber0.70 से 2नमूना तापमान। 0 = नियतात्मक, 2 = अधिकतम यादृच्छिकता।
top_pnumber0.90 से 1नाभिक नमूनाकरण संभाव्यता द्रव्यमान। निचला = अधिक केंद्रित।
max_tokensnumber40961 से 65536प्रतिक्रिया में अधिकतम टोकन।
stopstring--4 स्ट्रिंग्स तक जहां मॉडल आगे टोकन उत्पन्न करना बंद कर देगा।
enable_thinkingbooleantrue-विस्तारित सोच मोड सक्षम करें। धीमा लेकिन तर्क-भारी कार्यों में सुधार करता है।
tool_web_searchbooleanfalse-जरूरत पड़ने पर मॉडल को वेब खोज करने की अनुमति दें।
web_search_modeenumstandardstandard, thoroughमानक = एकल खोज, पूरी तरह से = कई गहरी खोजें।
tool_code_interpreterbooleantrue-डेटा की गणना/विश्लेषण करने के लिए मॉडल को सैंडबॉक्स में पायथन कोड निष्पादित करने की अनुमति दें।
tool_web_extractorbooleantrue-मॉडल को अपने द्वारा खोजे गए URL से सामग्री लाने और पढ़ने की अनुमति दें.
response_formatenum--आउटपुट को वैध JSON ऑब्जेक्ट (JSON मोड) के रूप में लौटाएं। अपने प्रॉम्प्ट में उन फ़ील्ड का वर्णन करें जिन्हें आप चाहते हैं।
disable_formattingbooleanfalse-EmpirioLabs मार्कडाउन स्वरूपण (उद्धरण [[N]](url) पुनर्लेखन + संदर्भ ब्लॉक जब वेब खोज/उपकरण का उपयोग किया गया था) को छोड़ दें। सादे [N] उद्धरणों के साथ कच्चा...

जानने योग्य

वेब खोज मोड: मानक (कुशल) या थोरफ (comprehensive, सोच की आवश्यकता)।

Per-tool billing (usage.tool_usage)

When this model invokes tools (web search, code interpreter, etc.) inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts. The example below shows the shape — exact field names, units, and which tools appear can vary slightly per provider:

"usage": {
  "prompt_tokens": 123,
  "completion_tokens": 456,
  "cost_usd": 0.0042,
  "tool_usage": {"web_search": 3, "code_interpreter": 1}
}

The tool counts are already factored into cost_usd — they are surfaced for transparency so you can audit per-tool billing. The field is omitted when no tools were invoked.

Qwen3 Max Thinking API: आम सवाल

Qwen3 Max Thinking API की कीमत कितनी है?

EmpirioLabs पर Qwen3 Max Thinking का बिल उपयोग के अनुसार बनता है। इस पेज की लाइव दर तालिका हमेशा API की वास्तविक बिलिंग से मेल खाती है।

Qwen3 Max Thinking की context window कितनी है?

Qwen3 Max Thinking 256K टोकन की context window समर्थित करता है, प्रति उत्तर अधिकतम 65,536 आउटपुट टोकन के साथ।

क्या Qwen3 Max Thinking API OpenAI-संगत है?

हां। Qwen3 Max Thinking OpenAI-संगत Chat Completions API देता है, इसलिए मौजूदा OpenAI SDKs base_url को https://api.empiriolabs.ai/v1 पर सेट करके और model id qwen3-max-thinking रखकर काम करते हैं।

क्या मैं इंटीग्रेट करने से पहले ब्राउज़र में Qwen3 Max Thinking आज़मा सकता हूं?

हां। EmpirioLabs playground ब्राउज़र में Qwen3 Max Thinking को उन्हीं पैरामीटरों के साथ चलाता है जो API देता है, ताकि आप कोड लिखने से पहले prompt आज़मा सकें।

Qwen3 Max Thinking की API key कैसे मिलेगी?

EmpirioLabs खाता बनाएं, फिर डैशबोर्ड में API Keys में key जनरेट करें। बिलिंग pay-as-you-go क्रेडिट से होती है, इसलिए आप सिर्फ अपनी requests का भुगतान करते हैं।

बेहतर समापन बिंदुओं का उपयोग करने के लिए तैयार हैं?

हमारे मूल्य निर्धारण की जाँच करें या यदि आप चाहते हैं कि आपका अपना मॉडल हमारे स्टैक पर तैनात किया जाए, तो पहुंचें।