Casa Blog

Como Usar a API Qwen3.8 Max 0902

Qwen3.8 Max 0902 via API

Sep 2, 2026

EmpirioLabs AI

Qwen3.8 Max 0902 é o snapshot atualizado do topo de linha Qwen3.8 Max do Alibaba, lançado em 2 de setembro de 2026. Mantém o que o topo de linha é conhecido pelo que é conhecido: um contexto de token de 1M, entendimento de texto, imagem e vídeo, pensamento profundo ativado por padrão, e cinco ferramentas integradas, além de aprimorar as partes que importam para o trabalho real: programação em projetos em escala de engenharia, desenvolvimento autônomo a longo prazo, orquestração mais estável de agentes multi-ferramenta e raciocínio de gráficos e análise de documentos mais confiáveis.

Qwen3.8 Max 0902 está disponível no EmpirioLabs hoje por meio de uma API compatível com OpenAI, com chamada de funções, saída estruturada estrita em esquema JSON, streaming e até 128K tokens de saída. Experimente no playground ou chamá-lo de qualquer cliente compatível com o OpenAI. A especificação completa e as taxas atuais vivem no Página do modelo Qwen3.8 Max 0902 e o Documentos de API.

Preços

A faturação é baseada no uso, com uma taxa fixa de entrada e uma taxa fixa de saída em cada tamanho de prompt, as mesmas taxas do Qwen3.8 Max, e não há um nível de cache separado. Busca na web, busca text-to-image e busca image-to-image adicionam uma pequena taxa por chamada que se aplica apenas quando uma chamada realmente está em execução; o extrator web e o interpretador de código rodam sem custo adicional. Tokens pensantes faturam como tokens de saída. As taxas atuais sempre estão disponíveis no página do modelo e o página de preços, que permanecem em sincronia com o que você é cobrado.

Início rápido

Aponte qualquer SDK OpenAI na URL base EmpirioLabs e passe qwen3-8-max-0902 como modelo:

from openai import OpenAI client = OpenAI(base_url="https://api.empiriolabs.ai/v1", api_key="YOUR_EMPIRIOLABS_API_KEY",) resp = client.chat.completions.create(model="qwen3-8-max-0902", messages=[ {"role": "user", "content": [ {"type": "text", "text": "Resume a tendência neste gráfico e sinalize qualquer coisa incomum."}, {"type": "image_url", "image_url": {"url": "https://example.com/chart.png"}}, ]}, ], extra_body={"enable_thinking": True, "thinking_budget": 8192},) print(resp.choices[0].message.content)

O mesmo modelo id funciona /v1/responses, a Antrópica /v1/messages, e o compatível com o Google /v1beta/models/qwen3-8-max-0902:gerar conteúdo rota. Os IDs alternativos qwen3.8-max-0902 e qwen3.8-max-2026-09-02 Resolve para o mesmo modelo.

Pensamento

O pensamento profundo está ativado por padrão e retorna como raciocinar conteúdo junto com a resposta. Controle-o com activar pensar e thinking_budget (até 262.144 tokens), ou enviar raciocinação esforço e a plataforma mapeia para um orçamento adequado ao modelo. Tokens de pensamento faturam como tokens de saída, então desative o pensamento ou defina um orçamento pequeno para turnos curtos e sensíveis à latência.

Ferramentas integradas

Cinco ferramentas embutidas acompanham atrás tool_* e todos estão desligados por padrão: tool_web_search, tool_web_extractor, tool_code_interpreter, tool_web_search_image, e tool_image_search. O extrator web requer busca na web, e tanto o extrator quanto o interpretador de código rodam apenas enquanto o pensamento está ativado. Quando as ferramentas rodam, a resposta é usage.tool_usage O MAP informa exatamente quantas chamadas foram feitas, para que você possa auditar a faturação por ferramenta.

Saída estruturada

Para uma forma de resposta exata, passe response_format com {"tipo": "json_schema",...} e "rígido": verdade: o modelo retorna exatamente as chaves do esquema sem extras. Modo JSON simples com {"tipo": "json_object"} também é suportado.

Coisas que valem a pena saber antes da primeira ligação

  • Coloque a identidade datada quando o comportamento não deve mudar sob seu controle. qwen3-8-max segue a versão padrão atual do Alibaba para Qwen3.8 Max, enquanto qwen3-8-max-0902 permanece nesse instantâneo. Use o ID datado para avaliações e pipelines de produção que precisam de saída reproduzível.
  • tool_choice: "obrigatório" não funciona enquanto o pensamento está ativo. O pedido é rejeitado com um erro claro. Fique tool_choice: "auto" com o pensamento ativado, ou definido enable_thinking: falso Quando você precisa forçar uma chamada de função.
  • O modo JSON precisa da palavra "json" nas suas mensagens. A {"tipo": "json_object"} O pedido é rejeitado, a menos que a palavra apareça em algum momento da conversa. Solicitações de esquema JSON não possuem tal requisito.

Qwen3.8 Max 0902 já está disponível no playground e através do EmpirioLabs API.

Pronto para usar endpoints melhores?

Explore nossos modelos ou entre em contato conosco para consultas de negócios, implantações personalizadas ou qualquer outra coisa.