Casa Blog

Como Usar a API Qwen3.8 Max

Qwen3.8 Max via API

Aug 3, 2026

EmpirioLabs AI

O Qwen3.8 Max está disponível no EmpirioLabs. É o nível principal da série Qwen3.8 da Alibaba, um modelo de mixture-of-experts em escala de trilhões construído para programação, trabalho de agentes de longo prazo e tarefas profissionais, com uma janela de contexto de token de 1 milhão, pensamento profundo e entrada de texto, imagem e vídeo. Ele roda em uma API compatível com OpenAI, então você pode mudar para ela mudando um campo.

No que o Qwen3.8 Max é bom

Max é o nível de capacidade da família Qwen3.8, então ele se adequa a trabalhos onde a qualidade importa mais do que a velocidade bruta: programação em um grande repositório, loops de agentes de longa duração, compreensão de documentos e capturas de tela, e análise que precisa conter muito contexto ao mesmo tempo. Ele lê imagens e vídeos, chama ferramentas com chamadas padrão de função, retorna JSON estritamente compatível com o esquema mediante solicitação e pode pesquisar na web, rodar código, ler URLs e buscar imagens por meio de ferramentas integradas.

Como chamar isso

Envie uma conclusão padrão do chat:

curl https://api.empiriolabs.ai/v1/chat/completions \ -H "Autorização: Portador $EMPIRIOLABS_API_KEY" \ -H "Tipo-de-Conteúdo: application/json" \ -d '{ "modelo": "qwen3-8-max", "mensagens": [ {"Função": "Usuário", "Conteúdo": "Refatorem este módulo e expliquem as compensações."} ] }'

O mesmo id de modelo também funciona em /v1/responses, na Antrópica /v1/messages, e no Google compatível /v1beta/models/qwen3-8-max:gerar conteúdo Route, então a maioria das configurações existentes de SDK funciona sem reescrita.

O pensamento está ligado por padrão

Qwen3.8 Max raciocina antes de responder, a menos que você desligue isso. Cenário activar pensar para falso para abreviar, chamadas sensíveis à latência, ou raise thinking_budget Até 262144 tokens quando quiser que resolva um problema com mais força. Tokens de raciocínio são anunciados como tokens de saída, então um grande orçamento em um prompt simples é a principal forma de gastar demais nesse modelo.

Um detalhe prático que vale a pena saber antes de portar um agente: enquanto o pensamento está ativado, o modelo aceita tool_choice apenas como Auto. Forçando uma função específica com tool_choice: "obrigatório" ou um objeto ferramenta explícito é rejeitado. Se seu agente forçar uma primeira chamada de ferramenta, deixe a escolha automática ou desative o pensamento nessa etapa.

Ferramentas integradas como padrão ativadas

Cinco ferramentas integradas acompanham o modelo: busca web, extrator web, interpretador de código, busca text-to-image e busca image-to-image. Todos eles são ativados por padrão, o que é conveniente para prompts no estilo pesquisa e desperdício para uma conclusão simples, porque as definições das ferramentas acompanham cada prompt. Desligue os que você não precisa com o tool_* Parâmetros:

{ "modelo": "qwen3-8-max", "mensagens": [{"papel": "usuário", "conteúdo": "O que mudou na especificação esta semana?"}], "tool_web_search": verdadeiro, "tool_web_extractor": verdadeiro, "tool_code_interpreter": falso, "tool_web_search_image": falso, "tool_image_search": falso }

Duas dependências são impostas a montante: o web extractor só roda junto com a busca web, e tanto o web extractor quanto o interpretador de código exigem que o raciocínio seja ativado. A busca na web e as duas ferramentas de busca de imagens são cobradas por chamada invocada, e uma única solicitação pode invocar uma ferramenta mais de uma vez, então a resposta reporta exatamente o que foi executado usage.tool_usage.

Saída estruturada

O Qwen3.8 Max impõe um esquema JSON rigoroso, não apenas modo JSON, então você pode pedir uma forma de resposta exata e analisá-la sem precisar um passo de reparo:

{ "modelo": "qwen3-8-max", "mensagens": [{"função": "usuário", "conteúdo": "Extrair os campos da fatura."}], "response_format": { "tipo": "json_schema", "json_schema": { "nome": "fatura", "restrito": verdadeiro, "esquema": { "tipo": "objeto", "propriedades": { "fornecedor": {"tipo": "string"}, "total": {"tipo": "número"} }, "obrigado": ["fornecedor", "total"], "adicionalProperties": false } } } } }

Imagens e vídeo

Anexe imagens ou vídeos da mesma forma que faria com qualquer modelo de visão compatível com OpenAI, usando image_url ou video_url partes do conteúdo. Você pode enviar várias imagens em uma mensagem e consultá-las posicionalmente. Para vídeo, video_fps controla a densidade dos quadros que são amostrados, e vl_high_resolution_images Troca detalhes pelo tamanho do prompt na entrada da imagem.

Preços

Qwen3.8 Max é pay as you go, com preço por token de entrada e saída, mais uma pequena taxa por chamada nas ferramentas de busca quando elas realmente rodam. Tokens de pensamento contam como tokens de saída. As taxas atuais estão no Página do modelo Qwen3.8 Max e o página de preços, que sempre refletem o cartão de taxas ao vivo.

Experimente

Abra no EmpirioLabs Playground para testar prompts, anexos e a ferramenta alterna sem escrever código, ou ler o Referência de API para a lista completa de parâmetros.

Pronto para usar endpoints melhores?

Explore nossos modelos ou entre em contato conosco para consultas de negócios, implantações personalizadas ou qualquer outra coisa.