Qwen3.8 Max ist auf EmpirioLabs verfügbar. Es ist die Flaggschiff-Stufe der Qwen3.8-Serie von Alibaba, einem Billionenmaßstab mixture-of-experts Modell, das für Programmierung, langfristige Agentenarbeit und professionelle Aufgaben entwickelt wurde, mit einem 1-Millionen-Token-Kontextfenster, tiefem Denken sowie Text-, Bild- und Videoeingaben. Es läuft auf einer OpenAI-kompatiblen API, sodass man durch Änderung eines Feldes darauf wechseln kann.
Worin Qwen3.8 Max gut ist
Max ist die Capability-Stufe der Qwen3.8-Familie und eignet sich daher für Arbeit, bei denen Qualität wichtiger ist als die rohe Geschwindigkeit: Programmieren über ein großes Repository, langlaufende Agentenschleifen, Dokumenten- und Screenshot-Verständnis sowie Analysen, die viel Kontext gleichzeitig enthalten müssen. Es liest Bilder und Videos, ruft Werkzeuge mit Standardfunktionsaufrufen auf, liefert auf Anfrage streng schemakonformes JSON zurück und kann im Web suchen, Code ausführen, URLs lesen und über integrierte Tools nach Bildern suchen.
Wie man es nennt,
Senden Sie eine Standard-Chat-Komplettierung:
curl https://api.empiriolabs.ai/v1/chat/completions \ -H "Autorisierung: Träger $EMPIRIOLABS_API_KEY" \ -H "Inhaltstyp: application/json" \ -d '{ "model": "qwen3-8-max", "messages": [ {"role": "user", "content": "refactoring this module and explain the compromise."} ] }'
Dasselbe Modell funktioniert ebenfalls auf /v1/responses, auf der anthropischen Form /v1/messages, und auf der Google-kompatiblen /v1beta/models/qwen3-8-max:generateContent routen, sodass die meisten bestehenden SDK-Setups ohne Neuschreiben funktionieren.
Das Denken ist standardmäßig aktiviert
Qwen3.8 Max begründet, bevor es antwortet, es sei denn, du schaltest das aus. Set enable thinking zu falsch für kurze, latenzempfindliche Anrufe oder Raise thinking_budget Bis zu 262144 Tokens, wenn du willst, dass es ein Problem härter angeht. Reasoning-Tokens werden als Ausgabe-Token abgerechnet, daher ist ein großes Budget für eine einfache Eingabe der Hauptgrund, um bei diesem Modell zu viel auszugeben.
Ein praktisches Detail, das man vor der Portierung eines Agenten wissen sollte: Während das Denken aktiviert ist, akzeptiert das Modell tool_choice Nur als Auto. Erzwingen einer bestimmten Funktion mit tool_choice: "erforderlich" oder ein explizites Werkzeugobjekt wird abgelehnt. Wenn dein Agent einen ersten Tool Call erzwingt, lass die Wahl entweder automatisch bleiben oder schalte das Denken für diesen Schritt aus.
Eingebaute Werkzeuge stehen standardmäßig auf eingeschaltet
Fünf integrierte Werkzeuge sind mit dem Modell ausgeliefert: Websuche, Web-Extraktor, Code-Interpreter, text-to-image-Suche und image-to-image Suche. Sie sind alle standardmäßig aktiviert, was für Recherche-Prompts praktisch ist und für eine einfache Fertigstellung verschwenderisch ist, da die Werkzeugdefinitionen in jedem Prompt mitwirken. Schalten Sie die, die Sie nicht brauchen, mit dem tool_* Parameter:
{ "model": "qwen3-8-max", "messages": [{"role": "user", "content": "Was hat sich diese Woche im Spec geändert?"}], "tool_web_search": true, "tool_web_extractor": true, "tool_code_interpreter": false, "tool_web_search_image": false, "tool_image_search": false }
Zwei Abhängigkeiten werden stromaufwärts erzwungen: Web-Extractor läuft nur parallel zur Websuche, und sowohl Web-Extractor als auch Code-Interpreter erfordern Denken, um aktiviert zu werden. Websuche und die beiden Bildersuchwerkzeuge werden pro aufgerufenem Aufruf abgerechnet, und eine einzelne Anfrage kann ein Tool mehr als einmal aufrufen, sodass die Antwort genau angibt, was ausgeführt wurde usage.tool_usage.
Strukturierte Ausgabe
Qwen3.8 Max erzwingt ein striktes JSON-Schema, nicht nur einen JSON-Modus, sodass man nach einer exakten Antwortform fragen und sie ohne Reparaturschritt parsen kann:
{ "model": "qwen3-8-max", "messages": [{"role": "user", "content": "Extract the invoice fields."}], "response_format": { "type": "json_schema", "json_schema": { "name": "invoice", "strict": true, "schema": { "type": "object", "properties": { "vendor": {"type": "string"}, "total": {"type": "number"} }, "required": ["vendor", "total"], "additionalProperties": false } } } }
Bilder und Video
Fügen Sie Bilder oder Videos genauso an wie bei jedem OpenAI-kompatiblen Vision-Modell, indem Sie verwenden image_url oder video_url Content-Teile. Man kann mehrere Bilder in einer Nachricht senden und sie positionell betrachten. Für das Video, video_fps steuert, wie dichte Frames abgetastet werden, und vl_high_resolution_images Tauscht Details gegen Promptgröße bei der Bildeingabe.
Preisgestaltung
Qwen3.8 Max ist Pay-as-you-go, bepreist pro Eingabe- und Ausgabetoken sowie eine kleine Gebühr pro Anruf auf den Suchwerkzeugen, wenn sie tatsächlich laufen. Denk-Tokens zählen als Ausgabe-Tokens. Die aktuellen Zinssätze sind auf dem Qwen3.8 Max Modellseite und die preisseite, die immer die Live-Tarifkarte widerspiegeln.
Probier es mal
Öffne es in der EmpirioLabs Playground um Prompts, Anhänge und das Tool zu testen, ohne Code zu schreiben oder das zu lesen, API-Referenz für die vollständige Parameterliste.



