Qwen3.8 Max 0902 est l’instantané amélioré du modèle phare d’Alibaba, Qwen3.8 Max, sorti le 2 septembre 2026. Il conserve ce pour quoi le modèle phare est connu: un contexte de jetons 1M, une compréhension du texte, de l’image et de la vidéo, une réflexion approfondie activée par défaut, et cinq outils intégrés, et affine les éléments importants pour le travail réel: codage sur des projets à l’échelle de l’ingénierie, développement autonome à long terme, orchestration plus stable des agents multi-outils, et un raisonnement graphique et une analyse de documents plus fiables.
Qwen3.8 Max 0902 est disponible aujourd’hui sur EmpirioLabs via une API compatible OpenAI, avec appels de fonction, sortie structurée strictement JSON Schema, streaming et jusqu’à 128K jetons de sortie. Essayez dans le aire de jeux ou appelez-le d'un client compatible OpenAI. L'ensemble de la spec et les taux actuels vivent sur le Page modèle Qwen3.8 Max 0902 et les Docs API.
Prix
La facturation est basée sur l’utilisation avec un taux d’entrée et un taux de sortie fixe à chaque taille d’invite, les mêmes tarifs que Qwen3.8 Max, et il n’existe pas de niveau de cache séparé. La recherche web, la recherche text-to-image et image-to-image recherche ajoutent un petit frais par appel qui ne s’applique que lorsqu’un appel est effectivement lancé; l’extracteur web et l’interpréteur de code fonctionnent sans coût supplémentaire. Les jetons de pensée facturent comme des jetons de sortie. Les tarifs actuels sont toujours présents sur le page modèle et les page de prix, qui restent en phase avec ce qui vous est facturé.
Démarrer rapidement
Pointez n'importe quel SDK OpenAI à l'URL de base d'EmpirioLabs et passez qwen3-8-max-0902 comme modèle:
depuis openai import OpenAI client = OpenAI(base_url="https://api.empiriolabs.ai/v1", api_key="YOUR_EMPIRIOLABS_API_KEY »,) resp = client.chat.completions.create(model="qwen3-8-max-0902 », messages=[ {"role »: « user », « content »: [ {"type »: « text », « text »: « Résumez la tendance dans ce graphique et signalez tout ce qui est inhabituel."}, {"type »: « image_url », « image_url »: {"url »: « https://example.com/chart.png"}}, ]}, ], extra_body={"enable_thinking »: True, « thinking_budget »: 8192},) print(resp.choices[0].message.content)
Le même modèle d’ID fonctionne /v1/responses, la forme anthropique /v1/messages, et le modèle compatible Google /v1beta/models/qwen3-8-max-0902:générer du contenu itinéraire. Les identifiants alternatifs qwen3.8-max-0902 et qwen3.8-max-2026-09-02 Résous selon le même modèle.
Réflexion
La réflexion profonde est activée par défaut et revient en courant comme raisonnement contenu Avec la réponse. Contrôlez-le avec considérer et thinking_budget (jusqu’à 262 144 jetons), ou envoyer raisonnement effort et la plateforme l’associe à un budget adapté au modèle. Les jetons pensants facturent comme des jetons de sortie, donc désactivez la pensée ou fixez un petit budget pour des tours courts et sensibles à la latence.
Outils intégrés
Cinq outils intégrés roulent derrière tool_* et sont tous désactivés par défaut: tool_web_search, tool_web_extractor, tool_code_interpreter, tool_web_search_image, et tool_image_search. L’extracteur web nécessite une recherche web, et l’extracteur ainsi que l’interpréteur de code s’exécutent uniquement lorsque la réflexion est activée. Quand les outils s’exécutent, la réponse est usage.tool_usage MAP indique exactement combien d’appels ont été effectués, afin que vous puissiez auditer la facturation par outil.
Sortie structurée
Pour une forme de réponse exacte, passez response_format avec {"type »: « json_schema »,...} et « strict »: vrai: le modèle retourne exactement les clés du schéma sans supplémentaires. Mode JSON simple avec {"type »: « json_object"} est également pris en charge.
Des choses qui valent la peine d’être connues avant votre premier appel
- Fixez l’identité datée lorsque votre comportement ne doit pas changer sous votre autorité.
qwen3-8-maxsuit la version actuelle par défaut Qwen3.8 Max d’Alibaba, tandis queqwen3-8-max-0902Reste sur cet instantané. Utilisez l’identifiant daté pour les évaluations et les pipelines de production qui nécessitent une sortie reproductible. tool_choice: « obligatoire »ne fonctionne pas tant que la réflexion est activée. La demande est rejetée avec une erreur évidente. Gardetool_choice: « auto »avec pensée activée, ou définieenable_thinking: fauxQuand il faut forcer un appel de fonction.- Le mode JSON nécessite le mot « json » dans vos messages. A
{"type »: « json_object"}La demande est rejetée à moins que le mot n’apparaisse quelque part dans la conversation. Les requêtes de schéma JSON n’ont pas cette exigence.
Qwen3.8 Max 0902 est disponible dès maintenant dans le aire de jeux et à travers le EmpirioLabs API.



