Inicio Blog

Cómo usar la API Qwen3.8 Max 0902

Qwen3.8 Max 0902 vía API

Sep 2, 2026

EmpirioLabs AI

Qwen3.8 Max 0902 es la instantánea mejorada del buque insignia de Alibaba, Qwen3.8 Max, lanzado el 2 de septiembre de 2026. Mantiene lo que caracteriza al buque insignia: un contexto de token, comprensión de texto, imagen y vídeo de 1M, pensamiento profundo activado por defecto y cinco herramientas integradas, y afina las partes que importan para el trabajo real: programación en proyectos a escala de ingeniería, desarrollo autónomo a largo plazo, orquestación de agentes multiherramienta más estable y razonamiento gráfico y análisis de documentos más fiables.

Qwen3.8 Max 0902 está disponible hoy en EmpirioLabs a través de una API compatible con OpenAI, con llamadas a funciones, salida estructurada estricta en esquema JSON, streaming y hasta 128K tokens de salida. Pruébalo en el parque infantil o llamarlo de cualquier cliente compatible con OpenAI. La especificaciones completas y las tasas actuales viven en Página del modelo Qwen3.8 Max 0902 y el API docs.

Precios

La facturación se basa en el uso con una tasa fija de entrada y una tasa fija de salida en cada tamaño de prompt, las mismas tarifas que Qwen3.8 Max, y no existe un nivel de caché separado. La búsqueda web, la búsqueda text-to-image y la búsqueda image-to-image añaden una pequeña tarifa por llamada que solo se aplica cuando una llamada realmente se ejecuta; el extractor web y el intérprete de código funcionan sin coste adicional. Los tokens de pensamiento facturan como tokens de salida. Las tarifas actuales siempre están en el página modelo y el página de precios, que se mantienen en sincronía con lo que se cobra.

Quickstart

Indique cualquier SDK OpenAI en la URL base EmpirioLabs y pase qwen3-8-max-0902 como modelo:

desde openai importar OpenAI client = OpenAI(base_url="https://api.empiriolabs.ai/v1", api_key="YOUR_EMPIRIOLABS_API_KEY",) resp = client.chat.completions.create(model="qwen3-8-max-0902", messages=[ {"role": "user", "content": [ {"type": "text", "text": "Resume la tendencia en este gráfico y marque cualquier cosa inusual."}, {"type": "image_url", "image_url": {"url": "https://example.com/chart.png"}}, ]}, ], extra_body={"enable_thinking": True, "thinking_budget": 8192},) print(resp.choices[0].message.content)

El mismo id de modelo funciona /v1/responses, el de forma antrópica /v1/messages, y el compatible con Google /v1beta/models/qwen3-8-max-0902:generateContent Ruta. Los IDs alternativos qwen3.8-max-0902 y qwen3.8-max-2026-09-02 resuelve al mismo modelo.

Pensamiento

El pensamiento profundo está activado por defecto y vuelve a fluir como reasoning content junto con la respuesta. Contrólalo con habilitar pensar y thinking_budget (hasta 262.144 fichas), o enviar reasoning effort y la plataforma lo asigna a un presupuesto adaptado al modelo. Los tokens de pensamiento se facturan como tokens de salida, así que desactiva el pensamiento o establece un presupuesto pequeño para turnos cortos y sensibles a la latencia.

Herramientas integradas

Cinco herramientas integradas van detrás tool_* Toggles y están todos desactivados por defecto: tool_web_search, tool_web_extractor, tool_code_interpreter, tool_web_search_image, y tool_image_search. El extractor web requiere búsqueda web, y tanto el extractor como el intérprete de código se ejecutan solo mientras el pensamiento está habilitado. Cuando las herramientas se ejecutan, la respuesta es usage.tool_usage MAP informa exactamente cuántas llamadas se han hecho, para poder auditar la facturación por herramienta.

Salida estructurada

Para una forma de respuesta exacta, pasa response_format con {"tipo": "json_schema",...} y "estricto": cierto: el modelo devuelve exactamente las claves del esquema sin añadidos. Modo JSON simple con {"tipo": "json_object"} también está soportado.

Cosas que merece la pena saber antes de tu primera llamada

  • Coloca el ID con fecha cuando el comportamiento no debe cambiar bajo tu control. qwen3-8-max sigue la versión predeterminada actual de Alibaba Qwen3.8 Max, mientras que qwen3-8-max-0902 Se queda en esta instantánea. Usa el id fechado para evaluaciones y pipelines de producción que necesitan salida reproducible.
  • tool_choice: "obligatorio" No funciona mientras está pensando. La solicitud es rechazada con un error evidente. Mantener tool_choice: "auto" con el pensamiento activado o establecido enable_thinking: falso Cuando necesitas forzar una llamada de función.
  • El modo JSON necesita la palabra "json" en tus mensajes. A {"tipo": "json_object"} La solicitud se rechaza a menos que la palabra aparezca en algún momento de la conversación. Las solicitudes de esquema JSON no tienen tal requisito.

Qwen3.8 Max 0902 ya está disponible en el parque infantil y a través de la EmpirioLabs API.

¿Listo para usar mejores endpoints?

Explora nuestros modelos o contáctanos para consultas empresariales, despliegues personalizados o cualquier otra cosa.