Zuhause Blog

Wie man die Qwen3.8 Max 0902 API verwendet

Qwen3.8 Max 0902 via API

Sep 2, 2026

EmpirioLabs AI

Qwen3.8 Max 0902 ist der verbesserte Snapshot von Alibabas Flaggschiff Qwen3.8 Max, das am 2. September 2026 veröffentlicht wurde. Es behält das, wofür das Flaggschiff bekannt ist: einen 1-Millionen-Token-Kontext, Text-, Bild- und Video-Verständnis, tiefes Denken, das standardmäßig aktiviert ist, und fünf eingebaute Werkzeuge und schärft die Teile, die für die echte Arbeit wichtig sind: Programmieren für ingenieurtechnische Projekte, langfristige autonome Entwicklung, stetigere Multitool-Agentenorchestrierung sowie zuverlässigeres Diagrammdenken und Dokumentenparsing.

Qwen3.8 Max 0902 ist heute über eine OpenAI-kompatible API auf EmpirioLabs verfügbar, mit Funktionsaufrufen, strikt JSON-Schema-strukturierter Ausgabe, Streaming und bis zu 128K Ausgabetoken. Probieren Sie es aus spielplatz oder rufen Sie es von einem OpenAI-kompatiblen Client auf. Die volle Spec und aktuelle Preise leben auf der Qwen3.8 Max 0902 Modellseite und die API-Doku.

Preisgestaltung

Die Abrechnung basiert auf der Nutzung mit einem festen Eingabe- und einem festen Ausgabesatz bei jeder Eingabegröße, den gleichen Tarifen wie bei Qwen3.8 Max, und es gibt keine separate Cache-Schicht. Websuche, text-to-image Suche und image-to-image Suche fügen eine kleine Gebühr pro Anruf hinzu, die nur gilt, wenn ein Anruf tatsächlich läuft; der Web-Extractor und der Code-Interpreter laufen ohne zusätzliche Kosten. Thinking Tokens rechnen als Ausgabe-Tokens ab. Aktuelle Tarife liegen immer auf dem modellblatt und die preisseite, die synchron mit dem bleiben, was ihnen aufgeladen wird.

Quickstart

Zeigen Sie ein OpenAI SDK auf die EmpirioLabs-Basis-URL und übergeben Sie qwen3-8-max-0902 als modell:

von openai-import OpenAI-Client = OpenAI(base_url="https://api.empiriolabs.ai/v1", api_key="YOUR_EMPIRIOLABS_API_KEY",) resp = client.chat.completions.create(model="qwen3-8-max-0902", messages=[ {"role": "user", "content": [ {"type": "text", "text": "Fassen Sie den Trend in diesem Diagramm zusammen und markieren Sie alles Ungewöhnliche."}, {"type": "image_url", "image_url": {"url": "https://example.com/chart.png"}}, ]}, ], extra_body={"enable_thinking": True, "thinking_budget": 8192},) print(resp.choices[0].message.content)

Dasselbe Modell, auf dem ID funktioniert, /v1/responses, die anthropische Form /v1/messages, und die Google-kompatiblen /v1beta/models/qwen3-8-max-0902:generateContent Route. Die alternativen IDs qwen3.8-max-0902 und qwen3.8-max-2026-09-02 Entscheide dich auf dasselbe Modell.

Denken

Deep Thinking ist standardmäßig aktiviert und wird als folgt zurückgesendet reasoning content neben der Antwort. Kontrolliere es mit enable thinking und thinking_budget (bis zu 262.144 Token), oder senden reasoning effort und die Plattform legt es auf ein für das Modell zugeschnittenes Budget zu. Thinking-Tokens werden als Ausgabe-Tokens abgestellt, also deaktivieren Sie das Denken oder legen Sie ein kleines Budget für kurze, latenzempfindliche Züge fest.

Eingebaute Werkzeuge

Fünf eingebaute Werkzeuge fahren dahinter tool_* Schalter und sind standardmäßig alle ausgeschaltet: tool_web_search, tool_web_extractor, tool_code_interpreter, tool_web_search_image, und tool_image_search. Der Web-Extractor erfordert eine Websuche, und sowohl der Extractor als auch der Code-Interpreter laufen nur, wenn das Denken aktiviert ist. Wenn Werkzeuge laufen, ist die Reaktion usage.tool_usage MAP zeigt genau an, wie viele Anrufe getätigt wurden, sodass Sie die Rechnung pro Tool überprüfen können.

Strukturierte Ausgabe

Für eine exakte Antwortform passieren Sie response_format mit {"type": "json_schema",...} und "Streng": Wahr: Das Modell liefert genau die Schlüssel des Schemas zurück, ohne Extras. Einfacher JSON-Modus mit {"type": "json_object"} wird ebenfalls unterstützt.

Dinge, die es wert sind, vor Ihrem ersten Anruf zu wissen

  • Stecke die datierte Identität fest, wenn sich das Verhalten unter dir nicht ändern darf. qwen3-8-max folgt dem aktuellen Standard-Qwen3.8 Max-Build von Alibaba, während qwen3-8-max-0902 bleibt auf diesem Snapshot. Verwenden Sie die datierte ID für Bewertungen und Produktionspipelines, die reproduzierbare Ausgaben benötigen.
  • tool_choice: "erforderlich" funktioniert nicht, solange das Denken an ist. Die Anfrage wird mit einem klaren Fehler abgelehnt. Keep tool_choice: "Auto" mit aktiviertem Denken oder festgelegt enable_thinking: falsch Wenn du einen Funktionsaufruf erzwingen musst.
  • Im JSON-Modus muss das Wort "JSON" in deinen Nachrichten verwendet werden. A {"type": "json_object"} Die Anfrage wird abgelehnt, es sei denn, das Wort taucht irgendwo im Gespräch auf. JSON-Schema-Anfragen haben keine solche Anforderung.

Qwen3.8 Max 0902 ist jetzt erhältlich im spielplatz und durch die EmpirioLabs API.

Bereit, bessere Endpunkte zu nutzen?

Entdecken Sie unsere Modelle oder kontaktieren Sie uns bei Geschäftsanfragen, individuellen Deployments oder sonst etwas.