
Modelo de raciocínio com uso de ferramenta adaptativa (pesquisa, memória, intérprete de código) e escala de tempo de teste para maior precisão em tarefas complexas.
Modelo de raciocínio com uso de ferramenta adaptativa (pesquisa, memória, intérprete de código) e escala de tempo de teste para maior precisão em tarefas complexas.
Também conhecido como Alibaba Cloud Qwen3 Max Thinking, Qwen3-Max-Thinking
qwen3-max-thinking/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/qwen3-max-thinking:generateContentTarifas pay-as-you-go ao vivo do catálogo EmpirioLabs. Você paga só pelo que usa, sem mínimo mensal.
Qwen3 Max Thinking atende a API Chat Completions compatível com OpenAI. Aponte qualquer SDK OpenAI para https://api.empiriolabs.ai/v1 com sua chave de API EmpirioLabs e use o id de modelo qwen3-max-thinking. Obtenha uma chave de API no painel EmpirioLabs.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3-max-thinking",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="qwen3-max-thinking",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)Parâmetros de requisição suportados pela API Qwen3 Max Thinking na EmpirioLabs. Os padrões valem quando um campo é omitido.
| Parâmetro | Tipo | Padrão | Intervalo / valores | Descrição |
|---|---|---|---|---|
| temperature | number | 0.7 | 0 a 2 | Temperatura de amostragem. 0 = determinística, 2 = aleatoriedade máxima. |
| top_p | number | 0.9 | 0 a 1 | Amostragem do núcleo com a probabilidade de massa. Menor = mais focado. |
| max_tokens | number | 4096 | 1 a 65536 | Fichas máximas na resposta. |
| stop | string | - | - | Até 4 strings em que o modelo para de gerar mais tokens. |
| enable_thinking | boolean | true | - | Ative o modo de pensamento estendido. Mais lento, mas melhora tarefas que exigem muito raciocínio. |
| tool_web_search | boolean | false | - | Permita que o modelo realize buscas na web quando necessário. |
| web_search_mode | enum | standard | standard, thorough | padrão = busca única, minuciosa = múltiplas buscas mais profundas. |
| tool_code_interpreter | boolean | true | - | Permita que o modelo execute código Python em um sandbox para computar/analisar dados. |
| tool_web_extractor | boolean | true | - | Permita que o modelo busque e leia conteúdo das URLs que descobrir. |
| response_format | enum | - | - | Devolva a saída como um objeto JSON válido (modo JSON). Descreva as áreas que você quer no seu prompt. |
| disable_formatting | boolean | false | - | Pule a EmpirioLabs formatação Markdown (citação [[N]](url) reescrita + bloco de referências quando busca/ferramentas na web foram usadas). A resposta bruta a... |
Modos de pesquisa na Web: Padrão (eficiente) ou Total (compreensivo, requer pensamento).
When this model invokes tools (web search, code interpreter, etc.) inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts. The example below shows the shape — exact field names, units, and which tools appear can vary slightly per provider:
"usage": {
"prompt_tokens": 123,
"completion_tokens": 456,
"cost_usd": 0.0042,
"tool_usage": {"web_search": 3, "code_interpreter": 1}
}The tool counts are already factored into cost_usd — they are surfaced for transparency so you can audit per-tool billing. The field is omitted when no tools were invoked.
Na EmpirioLabs, Qwen3 Max Thinking é cobrado por uso. A tabela de tarifas ao vivo desta página sempre corresponde ao que a API cobra.
Qwen3 Max Thinking suporta uma janela de contexto de 256K tokens com até 65.536 tokens de saída por resposta.
Sim. Qwen3 Max Thinking atende a API Chat Completions compatível com OpenAI, então SDKs OpenAI existentes funcionam apontando base_url para https://api.empiriolabs.ai/v1 e definindo o id de modelo qwen3-max-thinking.
Sim. O playground da EmpirioLabs executa Qwen3 Max Thinking no navegador com os mesmos parâmetros que a API expõe, para você testar prompts antes de escrever código.
Crie uma conta EmpirioLabs e gere uma chave em API Keys no painel. A cobrança usa créditos pay-as-you-go, então você paga apenas pelas requisições que faz.
Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.