Qwen3.5 APIs

Compare 8 modelos de geração de texto da família Qwen3.5 e chame o que melhor atende suas necessidades de latência, qualidade e preço.

Alibaba CloudGeração de Texto8 modelos

Sobre as APIs Qwen3.5

Qwen3.5 na EmpirioLabs reúne 8 APIs de modelos de geração de texto da Alibaba Cloud, incluindo Qwen3.5 Plus, Qwen3.5 122B-A10B, Qwen3.5 397B-A17B, Qwen3.5 35B-A3B. Cada modelo mantém sua própria página com preços ao vivo, parâmetros, docs e acesso ao playground.

Use a mesma chave de API e o mesmo padrão de endpoint da EmpirioLabs em toda a família e mude o comportamento trocando o id model na sua requisição.

Modelos Qwen3.5 (8)

Preços da API Qwen3.5

Compare a família de relance e depois abra uma página de modelo para a tabela de tarifas ao vivo completa e os parâmetros.

Endpoint
POST/v1/chat/completions
Preços
Tipo
Especificação
Tarifa
Entrada
por 1M de tokens de prompt
$0.40<=256K $0.36$1.20256K-1M $1.08
Saída
por 1M de tokens gerados
$2.40<=256K $2.21$7.20256K-1M $6.62
Pesquisa Web
por chamada quando invocada
$0.015
Busca texto para imagem
por chamada quando invocada
$0.012
Busca imagem a imagem
por chamada quando invocada
$0.012
Extrator de teia
por chamada quando invocada
$0.00
Interpretador de código
por chamada quando invocada
$0.00
Ideal para
Modelo multimodal com arquitetura híbrida para pensamento profundo eficiente e compreensão visual em texto, imagem e vídeo em um contexto de 1M.
Endpoint
POST/v1/chat/completions
Preços
Tipo
Especificação
Tarifa
Entrada
por 1M de tokens de prompt
$0.40<=128K $0.115$0.40128K-256K $0.287
Saída
por 1M de tokens gerados
$3.20<=128K $0.917$3.20128K-256K $2.294
Pesquisa Web
por chamada quando invocada
$0.01
Ideal para
Qwen3.5 122B-A10B é um modelo de raciocínio multimodal com contexto de 256K, inferência eficiente e esparsa de MoE, e entrada de texto, imagem e vídeo.
Endpoint
POST/v1/chat/completions
Preços
Tipo
Especificação
Tarifa
Entrada
por 1M de tokens de prompt
$0.60<=128K $0.172$0.60128K-256K $0.43
Saída
por 1M de tokens gerados
$3.60<=128K $1.032$3.60128K-256K $2.58
Pesquisa Web
por chamada quando invocada
$0.01
Ideal para
Qwen3.5 397B-A17B é um modelo multimodal de raciocínio de referência para linguagem, código, agentes, tarefas de interface gráfica e compreensão de imagem e vídeo.
Endpoint
POST/v1/chat/completions
Preços
Tipo
Especificação
Tarifa
Entrada
por 1M de tokens de prompt
$0.25<=128K $0.057$0.25128K-256K $0.229
Saída
por 1M de tokens gerados
$2.00<=128K $0.459$2.00128K-256K $1.835
Pesquisa Web
por chamada quando invocada
$0.01
Ideal para
Qwen3.5 35B-A3B é um modelo eficiente nativo de visão-linguagem com roteamento MoE esparso, pensamento profundo e entrada de texto, imagem e vídeo.
Endpoint
POST/v1/chat/completions
Preços
Tipo
Especificação
Tarifa
Entrada
por 1M de tokens de prompt
$0.30<=128K $0.086$0.30128K-256K $0.258
Saída
por 1M de tokens gerados
$2.40<=128K $0.688$2.40128K-256K $2.064
Pesquisa Web
por chamada quando invocada
$0.01
Ideal para
Qwen3.5 27B é um modelo de raciocínio multimodal denso, com respostas rápidas, contexto 256K e compreensão de texto, imagem e vídeo.
Endpoint
POST/v1/chat/completions
Preços
Tipo
Especificação
Tarifa
Entrada
por 1M de tokens de prompt
$0.10$0.09
Saída
por 1M de tokens gerados
$0.15$0.13
Leitura implícita do cache
por 1M de tokens de entrada cacheados
$0.045
Busca na Web (Linkup)
por chamada quando invocada
$0.013
Ideal para
Qwen3.5 9B é um modelo multimodal compacto de raciocínio com 256K de contexto, entrada de imagem e vídeo, ferramentas funcionais e saída estruturada.
Endpoint
POST/v1/chat/completions
Preços
Tipo
Especificação
Tarifa
Entrada
por 1M de tokens de prompt
$0.04
Saída
por 1M de tokens gerados
$0.07
Leitura implícita do cache
por 1M de tokens de entrada cacheados
$0.02
Busca na Web (Linkup)
por chamada quando invocada
$0.013
Ideal para
Qwen3.5 4B é um modelo multimodal de raciocínio de baixo custo com 256K de contexto, entrada de imagem e vídeo, ferramentas funcionais e saída estruturada.
Endpoint
POST/v1/chat/completions
Preços
Tipo
Especificação
Tarifa
Entrada
por 1M de tokens de prompt
$0.10$0.090
Saída
por 1M de tokens gerados
$0.40$0.368
Pesquisa Web
por chamada quando invocada
$0.015
Busca texto para imagem
por chamada quando invocada
$0.012
Busca imagem a imagem
por chamada quando invocada
$0.012
Extrator de teia
por chamada quando invocada
$0.00
Interpretador de código
por chamada quando invocada
$0.00
Ideal para
Modelo de visão-linguagem com atenção linear híbrida mais MoE esparso, contexto 1M e inferência rápida multimodal de text/image/vídeo.
Compare todos os modelos na página de preços completa

Como chamar os modelos Qwen3.5

Qwen3.5 Plus atende a API Chat Completions compatível com OpenAI. Aponte qualquer SDK OpenAI para https://api.empiriolabs.ai/v1 com sua chave de API EmpirioLabs e use o id de modelo qwen3-5-plus. Para esta família, troque o valor model por qualquer id suportado: qwen3-5-plus qwen3-5-122b-a10b qwen3-5-397b-a17b qwen3-5-35b-a3b qwen3-5-27b qwen3-5-9b qwen3-5-4b qwen3-5-flash. Obtenha uma chave de API no painel EmpirioLabs.

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3-5-plus",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'

Exemplos e comparações de Qwen3.5

Veja testes de prompts, notas de resultados e comparações que mencionam esta família de modelos.

APIs Qwen3.5: perguntas frequentes

O que é a API Qwen3.5?

Qwen3.5 na EmpirioLabs é uma família de 8 APIs de modelos de Geração de Texto da Alibaba Cloud: Qwen3.5 Plus, Qwen3.5 122B-A10B, Qwen3.5 397B-A17B, Qwen3.5 35B-A3B, Qwen3.5 27B, Qwen3.5 9B, Qwen3.5 4B, Qwen3.5 Flash. Você usa uma chave de API EmpirioLabs e escolhe o id de modelo que combina com a requisição.

Qual modelo Qwen3.5 devo usar?

Comece pelo modelo cuja página combina com suas necessidades de velocidade, qualidade e preço, e teste no playground da EmpirioLabs. Os cards de comparação acima levam à tabela de tarifas ao vivo e ao quickstart de cada modelo.

Posso alternar entre modelos Qwen3.5 sem reconstruir minha integração?

Sim. A família segue o mesmo padrão de API da EmpirioLabs, então a maioria das integrações alterna só mudando o valor model. Confira a página do modelo antes de publicar se você depende de um parâmetro específico do modelo.

Como os preços de Qwen3.5 são mostrados?

A cobrança é por uso. Os cards desta página mostram um resumo curto do catálogo ao vivo, e cada página de modelo mostra a tabela de tarifas completa que corresponde à cobrança da API.

Posso testar Qwen3.5 no navegador?

Sim. Abra qualquer página de modelo desta família e use o link do playground para testar prompts e parâmetros no navegador antes de integrar a API.

Pronto para usar endpoints melhores?

Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.