Qwen3.8 Max 0902 es la instantánea mejorada del buque insignia de Alibaba, Qwen3.8 Max, lanzado el 2 de septiembre de 2026. Mantiene lo que caracteriza al buque insignia: un contexto de token, comprensión de texto, imagen y vídeo de 1M, pensamiento profundo activado por defecto y cinco herramientas integradas, y afina las partes que importan para el trabajo real: programación en proyectos a escala de ingeniería, desarrollo autónomo a largo plazo, orquestación de agentes multiherramienta más estable y razonamiento gráfico y análisis de documentos más fiables.
Qwen3.8 Max 0902 está disponible hoy en EmpirioLabs a través de una API compatible con OpenAI, con llamadas a funciones, salida estructurada estricta en esquema JSON, streaming y hasta 128K tokens de salida. Pruébalo en el parque infantil o llamarlo de cualquier cliente compatible con OpenAI. La especificaciones completas y las tasas actuales viven en Página del modelo Qwen3.8 Max 0902 y el API docs.
Precios
La facturación se basa en el uso con una tasa fija de entrada y una tasa fija de salida en cada tamaño de prompt, las mismas tarifas que Qwen3.8 Max, y no existe un nivel de caché separado. La búsqueda web, la búsqueda text-to-image y la búsqueda image-to-image añaden una pequeña tarifa por llamada que solo se aplica cuando una llamada realmente se ejecuta; el extractor web y el intérprete de código funcionan sin coste adicional. Los tokens de pensamiento facturan como tokens de salida. Las tarifas actuales siempre están en el página modelo y el página de precios, que se mantienen en sincronía con lo que se cobra.
Quickstart
Indique cualquier SDK OpenAI en la URL base EmpirioLabs y pase qwen3-8-max-0902 como modelo:
desde openai importar OpenAI client = OpenAI(base_url="https://api.empiriolabs.ai/v1", api_key="YOUR_EMPIRIOLABS_API_KEY",) resp = client.chat.completions.create(model="qwen3-8-max-0902", messages=[ {"role": "user", "content": [ {"type": "text", "text": "Resume la tendencia en este gráfico y marque cualquier cosa inusual."}, {"type": "image_url", "image_url": {"url": "https://example.com/chart.png"}}, ]}, ], extra_body={"enable_thinking": True, "thinking_budget": 8192},) print(resp.choices[0].message.content)
El mismo id de modelo funciona /v1/responses, el de forma antrópica /v1/messages, y el compatible con Google /v1beta/models/qwen3-8-max-0902:generateContent Ruta. Los IDs alternativos qwen3.8-max-0902 y qwen3.8-max-2026-09-02 resuelve al mismo modelo.
Pensamiento
El pensamiento profundo está activado por defecto y vuelve a fluir como reasoning content junto con la respuesta. Contrólalo con habilitar pensar y thinking_budget (hasta 262.144 fichas), o enviar reasoning effort y la plataforma lo asigna a un presupuesto adaptado al modelo. Los tokens de pensamiento se facturan como tokens de salida, así que desactiva el pensamiento o establece un presupuesto pequeño para turnos cortos y sensibles a la latencia.
Herramientas integradas
Cinco herramientas integradas van detrás tool_* Toggles y están todos desactivados por defecto: tool_web_search, tool_web_extractor, tool_code_interpreter, tool_web_search_image, y tool_image_search. El extractor web requiere búsqueda web, y tanto el extractor como el intérprete de código se ejecutan solo mientras el pensamiento está habilitado. Cuando las herramientas se ejecutan, la respuesta es usage.tool_usage MAP informa exactamente cuántas llamadas se han hecho, para poder auditar la facturación por herramienta.
Salida estructurada
Para una forma de respuesta exacta, pasa response_format con {"tipo": "json_schema",...} y "estricto": cierto: el modelo devuelve exactamente las claves del esquema sin añadidos. Modo JSON simple con {"tipo": "json_object"} también está soportado.
Cosas que merece la pena saber antes de tu primera llamada
- Coloca el ID con fecha cuando el comportamiento no debe cambiar bajo tu control.
qwen3-8-maxsigue la versión predeterminada actual de Alibaba Qwen3.8 Max, mientras queqwen3-8-max-0902Se queda en esta instantánea. Usa el id fechado para evaluaciones y pipelines de producción que necesitan salida reproducible. tool_choice: "obligatorio"No funciona mientras está pensando. La solicitud es rechazada con un error evidente. Mantenertool_choice: "auto"con el pensamiento activado o establecidoenable_thinking: falsoCuando necesitas forzar una llamada de función.- El modo JSON necesita la palabra "json" en tus mensajes. A
{"tipo": "json_object"}La solicitud se rechaza a menos que la palabra aparezca en algún momento de la conversación. Las solicitudes de esquema JSON no tienen tal requisito.
Qwen3.8 Max 0902 ya está disponible en el parque infantil y a través de la EmpirioLabs API.



