Qwen3.5 APIs

Compara 8 modelos de generacion de texto de la familia Qwen3.5 y llama al que mejor se ajuste a tus necesidades de latencia, calidad y precio.

Alibaba CloudGeneracion de texto8 modelos

Acerca de las APIs de Qwen3.5

Qwen3.5 en EmpirioLabs reúne 8 APIs de modelos de generacion de texto de Alibaba Cloud, incluyendo Qwen3.5 Plus, Qwen3.5 122B-A10B, Qwen3.5 397B-A17B, Qwen3.5 35B-A3B. Cada modelo mantiene su propia página con precios en vivo, parámetros, documentación y acceso al playground.

Usa la misma clave de API y el mismo patrón de endpoint de EmpirioLabs en toda la familia, y cambia el comportamiento cambiando el id model en tu solicitud.

Modelos Qwen3.5 (8)

Precios de la API de Qwen3.5

Compara la familia de un vistazo y luego abre una página de modelo para ver la tabla de tarifas en vivo completa y los parámetros.

Endpoint
POST/v1/chat/completions
Precios
Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.40<=256K $0.36$1.20256K-1M $1.08
Producto
por 1M de tokens generados
$2.40<=256K $2.21$7.20256K-1M $6.62
Búsqueda web
por llamada cuando se invoca
$0.015
Búsqueda de texto a imagen
por llamada cuando se invoca
$0.012
Búsqueda imagen a imagen
por llamada cuando se invoca
$0.012
Extractor de telarañas
por llamada cuando se invoca
$0.00
Intérprete de código
por llamada cuando se invoca
$0.00
Ideal para
Modelo multimodal con arquitectura híbrida para un pensamiento profundo eficiente y una comprensión visual entre texto, imagen y vídeo en un contexto de 1M.
Endpoint
POST/v1/chat/completions
Precios
Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.40<=128K $0.115$0.40128K-256K $0.287
Producto
por 1M de tokens generados
$3.20<=128K $0.917$3.20128K-256K $2.294
Búsqueda web
por llamada cuando se invoca
$0.01
Ideal para
Qwen3.5 122B-A10B es un modelo de razonamiento multimodal con contexto de 256K, inferencia eficiente y escasa de MoE, y entrada de texto, imagen y vídeo.
Endpoint
POST/v1/chat/completions
Precios
Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.60<=128K $0.172$0.60128K-256K $0.43
Producto
por 1M de tokens generados
$3.60<=128K $1.032$3.60128K-256K $2.58
Búsqueda web
por llamada cuando se invoca
$0.01
Ideal para
Qwen3.5 397B-A17B es un modelo de razonamiento multimodal emblemático para lenguaje, código, agentes, tareas de interfaz gráfica y comprensión de imágenes y vídeos.
Endpoint
POST/v1/chat/completions
Precios
Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.25<=128K $0.057$0.25128K-256K $0.229
Producto
por 1M de tokens generados
$2.00<=128K $0.459$2.00128K-256K $1.835
Búsqueda web
por llamada cuando se invoca
$0.01
Ideal para
Qwen3.5 35B-A3B es un modelo nativo de visión y lenguaje eficiente con un enrutamiento MoE escaso, pensamiento profundo y entrada de texto, imagen y vídeo.
Endpoint
POST/v1/chat/completions
Precios
Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.30<=128K $0.086$0.30128K-256K $0.258
Producto
por 1M de tokens generados
$2.40<=128K $0.688$2.40128K-256K $2.064
Búsqueda web
por llamada cuando se invoca
$0.01
Ideal para
Qwen3.5 27B es un modelo de razonamiento multimodal denso con respuestas rápidas, contexto 256K y comprensión de texto, imagen y vídeo.
Endpoint
POST/v1/chat/completions
Precios
Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.10$0.09
Producto
por 1M de tokens generados
$0.15$0.13
Caché implícita
por fichas de entrada en caché de 1M
$0.045
Búsqueda web (Linkup)
por llamada cuando se invoca
$0.013
Ideal para
Qwen3.5 9B es un modelo de razonamiento multimodal compacto con 256K de contexto, entrada de imagen y vídeo, herramientas funcionales y salida estructurada.
Endpoint
POST/v1/chat/completions
Precios
Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.04
Producto
por 1M de tokens generados
$0.07
Caché implícita
por fichas de entrada en caché de 1M
$0.02
Búsqueda web (Linkup)
por llamada cuando se invoca
$0.013
Ideal para
Qwen3.5 4B es un modelo de razonamiento multimodal de bajo coste con 256K de contexto, entrada de imagen y vídeo, herramientas funcionales y salida estructurada.
Endpoint
POST/v1/chat/completions
Precios
Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.10$0.090
Producto
por 1M de tokens generados
$0.40$0.368
Búsqueda web
por llamada cuando se invoca
$0.015
Búsqueda de texto a imagen
por llamada cuando se invoca
$0.012
Búsqueda imagen a imagen
por llamada cuando se invoca
$0.012
Extractor de telarañas
por llamada cuando se invoca
$0.00
Intérprete de código
por llamada cuando se invoca
$0.00
Ideal para
Modelo de visión y lenguaje con atención lineal híbrida más MoE escaso, contexto 1M y rápida inferencia multimodal de text/image/vídeo.
Compara todos los modelos en la página de precios completa

Cómo llamar a los modelos Qwen3.5

Qwen3.5 Plus sirve la API de Chat Completions compatible con OpenAI. Apunta cualquier SDK de OpenAI a https://api.empiriolabs.ai/v1 con tu clave de API de EmpirioLabs y usa el id de modelo qwen3-5-plus. Para esta familia, cambia el valor model por cualquier id compatible: qwen3-5-plus qwen3-5-122b-a10b qwen3-5-397b-a17b qwen3-5-35b-a3b qwen3-5-27b qwen3-5-9b qwen3-5-4b qwen3-5-flash. Consigue una clave de API en el panel de EmpirioLabs.

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3-5-plus",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'

Ejemplos y comparativas de Qwen3.5

Mira pruebas de prompts, notas de resultados y comparativas que mencionan esta familia de modelos.

APIs de Qwen3.5: preguntas frecuentes

¿Qué es la API de Qwen3.5?

Qwen3.5 en EmpirioLabs es una familia de 8 APIs de modelos de Generacion de texto de Alibaba Cloud: Qwen3.5 Plus, Qwen3.5 122B-A10B, Qwen3.5 397B-A17B, Qwen3.5 35B-A3B, Qwen3.5 27B, Qwen3.5 9B, Qwen3.5 4B, Qwen3.5 Flash. Usas una clave de API de EmpirioLabs y eliges el id de modelo que mejor se ajusta a la solicitud.

¿Qué modelo de Qwen3.5 debería usar?

Empieza con el modelo cuya página coincida con tus necesidades de velocidad, calidad y precio, y pruébalo en el playground de EmpirioLabs. Las tarjetas de comparación de arriba enlazan a la tabla de tarifas en vivo y al quickstart de cada modelo.

¿Puedo cambiar entre modelos de Qwen3.5 sin reconstruir mi integración?

Sí. La familia sigue el mismo patrón de API de EmpirioLabs, así que la mayoría de las integraciones cambian modificando el valor model. Revisa la página del modelo antes de publicar si dependes de un parámetro específico del modelo.

¿Cómo se muestran los precios de Qwen3.5?

Los precios son de pago por uso. Las tarjetas de esta página muestran un resumen corto del catálogo en vivo, y cada página de modelo muestra la tabla de tarifas completa que coincide con la facturación de la API.

¿Puedo probar Qwen3.5 en el navegador?

Sí. Abre cualquier página de modelo de esta familia y usa su enlace al playground para probar prompts y parámetros en el navegador antes de integrar la API.

¿Listo para usar mejores endpoints?

Consulta nuestros precios o contacta con nosotros si quieres que tu propio modelo se implemente en nuestra pila.