Inicio Blog

Cómo usar la API Qwen3.8 Max

Qwen3.8 Max vía API

Aug 3, 2026

EmpirioLabs AI

Qwen3.8 Max está disponible en EmpirioLabs. Es la gama insignia de la serie Qwen3.8 de Alibaba, un modelo de mixture-of-experts a escala de billones diseñado para programación, trabajo de agentes a largo plazo y tareas profesionales, con una ventana de contexto de 1 millón de tokens, pensamiento profundo y entrada de texto, imagen y vídeo. Funciona con una API compatible con OpenAI, así que puedes cambiar a ella cambiando un campo.

En qué es bueno Qwen3.8 Max

Max es el nivel de capacidades de la familia Qwen3.8, por lo que se adapta a trabajos donde la calidad importa más que la velocidad bruta: programación en un gran repositorio, bucles de agentes de larga duración, comprensión de documentos y capturas de pantalla, y análisis que debe contener mucho contexto a la vez. Lee imágenes y vídeos, llama a herramientas con funciones estándar, devuelve JSON estrictamente conforme al esquema bajo petición, y puede buscar en la web, ejecutar código, leer URLs y buscar imágenes mediante herramientas integradas.

Cómo llamarlo

Envía una finalización estándar de chat:

curl https://api.empiriolabs.ai/v1/chat/completions \ -H "Autorización: Portador $EMPIRIOLABS_API_KEY" \ -H "Tipo-Contenido: application/json" \ -d '{ "modelo": "qwen3-8-max", "mensajes": [ {"rol": "usuario", "contenido": "Refactorizar este módulo y explicar los sacrificios."} ] }'

El mismo id de modelo también funciona /v1/responses, en la de forma antrópica /v1/messages, y en el compatible con Google /v1beta/models/qwen3-8-max:generateContent Enrutar, así que la mayoría de las configuraciones de SDK existentes funcionan sin necesidad de reescribir.

El pensamiento está activado por defecto

Qwen3.8 Max razona antes de responder a menos que lo desactives. Set habilitar pensar a falso para abreviar, llamadas sensibles a la latencia, o raise thinking_budget Hasta 262144 tokens cuando quieras que resuelva un problema más duro. Los tokens de razonamiento se presentan como tokens de salida, por lo que un presupuesto grande para un prompt simple es la principal forma de gastar de más en este modelo.

Un detalle práctico que merece la pena conocer antes de portar un agente: mientras el pensamiento está habilitado, el modelo acepta tool_choice solo como Auto. Forzando una función específica con tool_choice: "obligatorio" o se rechaza un objeto herramienta explícito. Si tu agente obliga a una primera llamada de herramienta, deja que la elección siga siendo automática o desactiva el pensamiento en ese paso.

Las herramientas integradas por defecto están activadas

Cinco herramientas integradas vienen con el modelo: búsqueda web, extractor web, intérprete de código, búsqueda text-to-image y búsqueda image-to-image. Todos están activados por defecto, lo cual es cómodo para prompts de investigación y un desperdicio para una simple finalización, porque las definiciones de la herramienta van acompañadas en cada prompt. Apaga los que no necesitas con el tool_* Parámetros:

{ "modelo": "qwen3-8-max", "mensajes": [{"rol": "usuario", "contenido": "¿Qué ha cambiado en la especificación esta semana?"}], "tool_web_search": verdadero, "tool_web_extractor": verdadero, "tool_code_interpreter": falso, "tool_web_search_image": falso, "tool_image_search": falso }

Se aplican dos dependencias aguas arriba: el extractor web solo funciona junto con la búsqueda web, y tanto el extractor web como el intérprete de código requieren estar habilitados para pensar. La búsqueda web y las dos herramientas de búsqueda de imágenes se facturan por cada llamada invocada, y una sola solicitud puede invocar una herramienta más de una vez, por lo que la respuesta informa exactamente de lo que se ejecutó usage.tool_usage.

Salida estructurada

Qwen3.8 Max aplica un esquema JSON estricto, no solo modo JSON, así que puedes pedir una forma de respuesta exacta y analizarla sin necesidad de reparación:

{ "model": "qwen3-8-max", "mensajes": [{"rol": "usuario", "contenido": "Extraer los campos de factura."}], "response_format": { "tipo": "json_schema", "json_schema": { "nombre": "factura", "estricto": verdadero, "esquema": { "tipo": "objeto", "propiedades": { "proveedor": {"tipo": "cadena"}, "total": {"tipo": "número"} }, "requerido": ["proveedor", "total"], "adicionalProperties": false } } } }

Imágenes y vídeo

Adjunta imágenes o vídeo de la misma manera que harías con cualquier modelo de visión compatible con OpenAI, usando image_url o video_url partes de contenido. Puedes enviar varias imágenes en un solo mensaje y referirte a ellas en posición propia. Para vídeo, video_fps controla la densidad de los fotogramas muestreados, y vl_high_resolution_images Intercambia el detalle por el tamaño del prompt en la entrada de la imagen.

Precios

Qwen3.8 Max es de pago por uso, con precio por token de entrada y salida, más una pequeña comisión por llamada en las herramientas de búsqueda cuando se ejecutan realmente. Los tokens de pensamiento cuentan como tokens de salida. Las tarifas actuales están en el Página del modelo Qwen3.8 Max y el página de precios, que siempre reflejan la tarjeta de tarifas en vivo.

Pruébalo

Ábrela en el EmpirioLabs Playground para probar prompts, archivos adjuntos y la herramienta alterna sin escribir código, o leer el Referencia de API para la lista completa de parámetros.

¿Listo para usar mejores endpoints?

Explora nuestros modelos o contáctanos para consultas empresariales, despliegues personalizados o cualquier otra cosa.