Qwen3 Max Thinking API

Argumentationsmodell mit adaptivem Werkzeugeinsatz (Such-, Speicher-, Code-Interpreter) und Testzeit-Skalierung für höhere Genauigkeit bei komplexen Aufgaben.

Alibaba CloudTextgenerierung256K KontextVeröffentlicht 23. Sept. 2025SingaporeProprietärer Endpoint

Über Qwen3 Max Thinking

Argumentationsmodell mit adaptivem Werkzeugeinsatz (Such-, Speicher-, Code-Interpreter) und Testzeit-Skalierung für höhere Genauigkeit bei komplexen Aufgaben.

Auch bekannt als Alibaba Cloud Qwen3 Max Thinking, Qwen3-Max-Thinking

reasoningcode interpreterweb searchthinking

Qwen3 Max Thinking Spezifikationen

Modell-ID
qwen3-max-thinking
Anbieter
Alibaba Cloud
Kategorie
Textgenerierung
Veröffentlicht
23. Sept. 2025
Kontextfenster
256K Token
Max. Ausgabe
65.536 Token
Eingabe
Text
Ausgabe
Text
Strukturierte Ausgabe
JSON-Modus
Region
Singapore
Endpoints
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/qwen3-max-thinking:generateContent

Qwen3 Max Thinking API-PreiseSpare bis zu 10%

Live Pay-as-you-go-Preise aus dem EmpirioLabs-Katalog. Du zahlst nur für das, was du nutzt, ohne monatliches Minimum.

Typ
Spezifikation
Preis
Eingabe
pro 1M prompte Token
$1.20<=32K $1.08$2.4032K-128K $2.16$3.00128K-256K $2.70
Ausgabe
pro 1M generierte Token
$6.00<=32K $5.52$12.0032K-128K $11.04$15.00128K-256K $13.80
Web-Suche
je Antrag
$0.015
Auf der vollständigen Preisseite vergleichen

So rufst du die Qwen3 Max Thinking API auf

Qwen3 Max Thinking bedient die OpenAI-kompatible Chat Completions API. Richte ein beliebiges OpenAI SDK mit deinem EmpirioLabs API-Schlüssel auf https://api.empiriolabs.ai/v1 und verwende die Modell-ID qwen3-max-thinking. Hol dir einen API-Schlüssel im EmpirioLabs Dashboard.

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3-max-thinking",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="qwen3-max-thinking",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Vollständige Qwen3 Max Thinking API-Referenz

Qwen3 Max Thinking API-Parameter

Request-Parameter, die die Qwen3 Max Thinking API auf EmpirioLabs unterstützt. Standardwerte gelten, wenn ein Feld weggelassen wird.

ParameterTypStandardBereich / WerteBeschreibung
temperaturenumber0.70 bis 2Temperatur wird geprochen. 0 = deterministisch, 2 = maximale Zufälligkeit.
top_pnumber0.90 bis 1Kernprobenwahrscheinlichkeitsmasse. Niedriger = fokussierter.
max_tokensnumber40961 bis 65536Maximale Token in der Antwort.
stopstring--Bis zu 4 Zeichenketten, bei denen das Modell aufhört, weitere Token zu generieren.
enable_thinkingbooleantrue-Aktivieren Sie den erweiterten Denkmodus. Langsamere, aber verbesserte Aufgaben mit viel Schlussfolgerung.
tool_web_searchbooleanfalse-Erlauben Sie dem Modell, bei Bedarf Websuchen durchzuführen.
web_search_modeenumstandardstandard, thoroughStandard = einzelne Suche, gründlich = mehrere tiefere Suchanfragen.
tool_code_interpreterbooleantrue-Erlaube dem Modell, Python-Code in einer Sandbox auszuführen, um Daten zu berechnen und zu analysieren.
tool_web_extractorbooleantrue-Erlaube dem Modell, Inhalte von den URLs, die es entdeckt, abzurufen und zu lesen.
response_formatenum--Geben Sie die Ausgabe als gültiges JSON-Objekt (JSON-Modus) zurück. Beschreibe die Felder, die du in deinem Prompt verwenden möchtest.
disable_formattingbooleanfalse-Überspringe die EmpirioLabs Markdown-Formatierung (Zitation [[N]](URL) Umschreiben + Referenzblock, wenn Websuche / Tools verwendet wurden). Die rohe...

Gut zu wissen

Web-Suchmodi: Standard (effizient) oder gründlich (umfassend, erfordert Denken).

Per-tool billing (usage.tool_usage)

When this model invokes tools (web search, code interpreter, etc.) inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts. The example below shows the shape — exact field names, units, and which tools appear can vary slightly per provider:

"usage": {
  "prompt_tokens": 123,
  "completion_tokens": 456,
  "cost_usd": 0.0042,
  "tool_usage": {"web_search": 3, "code_interpreter": 1}
}

The tool counts are already factored into cost_usd — they are surfaced for transparency so you can audit per-tool billing. The field is omitted when no tools were invoked.

Qwen3 Max Thinking API: häufige Fragen

Wie viel kostet die Qwen3 Max Thinking API?

Auf EmpirioLabs wird Qwen3 Max Thinking nach Verbrauch abgerechnet. Die Live-Preistabelle auf dieser Seite entspricht immer dem, was die API berechnet.

Wie groß ist das Kontextfenster von Qwen3 Max Thinking?

Qwen3 Max Thinking unterstützt ein Kontextfenster von 256K Token mit bis zu 65.536 Ausgabe-Token pro Antwort.

Ist die Qwen3 Max Thinking API OpenAI-kompatibel?

Ja. Qwen3 Max Thinking bedient die OpenAI-kompatible Chat Completions API. Bestehende OpenAI SDKs funktionieren, indem du base_url auf https://api.empiriolabs.ai/v1 setzt und als Modell-ID qwen3-max-thinking verwendest.

Kann ich Qwen3 Max Thinking im Browser testen, bevor ich integriere?

Ja. Der EmpirioLabs Playground führt Qwen3 Max Thinking im Browser mit denselben Parametern aus, die die API bietet. So kannst du Prompts testen, bevor du Code schreibst.

Wie bekomme ich einen Qwen3 Max Thinking API-Schlüssel?

Erstelle ein EmpirioLabs-Konto und generiere dann einen Schlüssel unter API Keys im Dashboard. Die Abrechnung erfolgt über Pay-as-you-go-Guthaben, du zahlst also nur für deine Requests.

Bereit, bessere Endpunkte zu nutzen?

Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.