Qwen3.8 Max 0902 ist der verbesserte Snapshot von Alibabas Flaggschiff Qwen3.8 Max, das am 2. September 2026 veröffentlicht wurde. Es behält das, wofür das Flaggschiff bekannt ist: einen 1-Millionen-Token-Kontext, Text-, Bild- und Video-Verständnis, tiefes Denken, das standardmäßig aktiviert ist, und fünf eingebaute Werkzeuge und schärft die Teile, die für die echte Arbeit wichtig sind: Programmieren für ingenieurtechnische Projekte, langfristige autonome Entwicklung, stetigere Multitool-Agentenorchestrierung sowie zuverlässigeres Diagrammdenken und Dokumentenparsing.
Qwen3.8 Max 0902 ist heute über eine OpenAI-kompatible API auf EmpirioLabs verfügbar, mit Funktionsaufrufen, strikt JSON-Schema-strukturierter Ausgabe, Streaming und bis zu 128K Ausgabetoken. Probieren Sie es aus spielplatz oder rufen Sie es von einem OpenAI-kompatiblen Client auf. Die volle Spec und aktuelle Preise leben auf der Qwen3.8 Max 0902 Modellseite und die API-Doku.
Preisgestaltung
Die Abrechnung basiert auf der Nutzung mit einem festen Eingabe- und einem festen Ausgabesatz bei jeder Eingabegröße, den gleichen Tarifen wie bei Qwen3.8 Max, und es gibt keine separate Cache-Schicht. Websuche, text-to-image Suche und image-to-image Suche fügen eine kleine Gebühr pro Anruf hinzu, die nur gilt, wenn ein Anruf tatsächlich läuft; der Web-Extractor und der Code-Interpreter laufen ohne zusätzliche Kosten. Thinking Tokens rechnen als Ausgabe-Tokens ab. Aktuelle Tarife liegen immer auf dem modellblatt und die preisseite, die synchron mit dem bleiben, was ihnen aufgeladen wird.
Quickstart
Zeigen Sie ein OpenAI SDK auf die EmpirioLabs-Basis-URL und übergeben Sie qwen3-8-max-0902 als modell:
von openai-import OpenAI-Client = OpenAI(base_url="https://api.empiriolabs.ai/v1", api_key="YOUR_EMPIRIOLABS_API_KEY",) resp = client.chat.completions.create(model="qwen3-8-max-0902", messages=[ {"role": "user", "content": [ {"type": "text", "text": "Fassen Sie den Trend in diesem Diagramm zusammen und markieren Sie alles Ungewöhnliche."}, {"type": "image_url", "image_url": {"url": "https://example.com/chart.png"}}, ]}, ], extra_body={"enable_thinking": True, "thinking_budget": 8192},) print(resp.choices[0].message.content)
Dasselbe Modell, auf dem ID funktioniert, /v1/responses, die anthropische Form /v1/messages, und die Google-kompatiblen /v1beta/models/qwen3-8-max-0902:generateContent Route. Die alternativen IDs qwen3.8-max-0902 und qwen3.8-max-2026-09-02 Entscheide dich auf dasselbe Modell.
Denken
Deep Thinking ist standardmäßig aktiviert und wird als folgt zurückgesendet reasoning content neben der Antwort. Kontrolliere es mit enable thinking und thinking_budget (bis zu 262.144 Token), oder senden reasoning effort und die Plattform legt es auf ein für das Modell zugeschnittenes Budget zu. Thinking-Tokens werden als Ausgabe-Tokens abgestellt, also deaktivieren Sie das Denken oder legen Sie ein kleines Budget für kurze, latenzempfindliche Züge fest.
Eingebaute Werkzeuge
Fünf eingebaute Werkzeuge fahren dahinter tool_* Schalter und sind standardmäßig alle ausgeschaltet: tool_web_search, tool_web_extractor, tool_code_interpreter, tool_web_search_image, und tool_image_search. Der Web-Extractor erfordert eine Websuche, und sowohl der Extractor als auch der Code-Interpreter laufen nur, wenn das Denken aktiviert ist. Wenn Werkzeuge laufen, ist die Reaktion usage.tool_usage MAP zeigt genau an, wie viele Anrufe getätigt wurden, sodass Sie die Rechnung pro Tool überprüfen können.
Strukturierte Ausgabe
Für eine exakte Antwortform passieren Sie response_format mit {"type": "json_schema",...} und "Streng": Wahr: Das Modell liefert genau die Schlüssel des Schemas zurück, ohne Extras. Einfacher JSON-Modus mit {"type": "json_object"} wird ebenfalls unterstützt.
Dinge, die es wert sind, vor Ihrem ersten Anruf zu wissen
- Stecke die datierte Identität fest, wenn sich das Verhalten unter dir nicht ändern darf.
qwen3-8-maxfolgt dem aktuellen Standard-Qwen3.8 Max-Build von Alibaba, währendqwen3-8-max-0902bleibt auf diesem Snapshot. Verwenden Sie die datierte ID für Bewertungen und Produktionspipelines, die reproduzierbare Ausgaben benötigen. tool_choice: "erforderlich"funktioniert nicht, solange das Denken an ist. Die Anfrage wird mit einem klaren Fehler abgelehnt. Keeptool_choice: "Auto"mit aktiviertem Denken oder festgelegtenable_thinking: falschWenn du einen Funktionsaufruf erzwingen musst.- Im JSON-Modus muss das Wort "JSON" in deinen Nachrichten verwendet werden. A
{"type": "json_object"}Die Anfrage wird abgelehnt, es sei denn, das Wort taucht irgendwo im Gespräch auf. JSON-Schema-Anfragen haben keine solche Anforderung.
Qwen3.8 Max 0902 ist jetzt erhältlich im spielplatz und durch die EmpirioLabs API.



