
Raciocínio e modelo de codificação com um contexto de token 1M, saída 128K, esforço de raciocínio ajustável, busca nativa web e chamada de ferramenta.
Raciocínio e modelo de codificação com um contexto de token 1M, saída 128K, esforço de raciocínio ajustável, busca nativa web e chamada de ferramenta.
Notas: - Janela de contexto: tokens 1M - Saída máxima: tokens 128K - Esforço de raciocínio ajustável do mínimo ao máximo (máximo recomendado para codificação complexa) - Built-in web search adds $0.033 por solicitação quando usado - Suporta chamada de função, saída estruturada e streaming - Executar saída estruturada com pensamento desativado
Também conhecido como Z.ai GLM 5.2, GLM-5.2, glm-5-2
glm-5-2/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/glm-5-2:generateContentglm-5.2zai/glm-5.2zhipu/glm-5.2Tarifas pay-as-you-go ao vivo do catálogo EmpirioLabs. Você paga só pelo que usa, sem mínimo mensal.
GLM 5.2 atende a API Chat Completions compatível com OpenAI. Aponte qualquer SDK OpenAI para https://api.empiriolabs.ai/v1 com sua chave de API EmpirioLabs e use o id de modelo glm-5-2. Obtenha uma chave de API no painel EmpirioLabs.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5-2",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="glm-5-2",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)Parâmetros de requisição suportados pela API GLM 5.2 na EmpirioLabs. Os padrões valem quando um campo é omitido.
| Parâmetro | Tipo | Padrão | Intervalo / valores | Descrição |
|---|---|---|---|---|
| max_tokens | integer | 65536 | 1 a 131072 | Número máximo de tokens de saída a serem gerados. |
| temperature | number | 1 | 0 a 1 | Controla a aleatoriedade. Valores mais baixos tornam as respostas mais determinísticas. |
| top_p | number | 0.95 | 0.01 a 1 | Corte de amostragem do núcleo. |
| reasoning_effort | enum | max | none, minimal, low, medium, high, xhigh, max | Esforço de raciocínio GLM-5.2. nenhum impede o pensamento; Mínimo até Max define o quanto o modelo raciocina antes de responder. O Max é recomendado para codificação... |
| enable_thinking | boolean | true | - | Permita que o modelo raciocine antes de responder. Desligue para respostas com menor latência ou saída estruturada estrita. |
| do_sample | boolean | true | - | Ative a amostragem. Desligue para saída determinística gulosa (temperatura e top_p são ignoradas). |
| tool_web_search | boolean | false | - | Ative a busca web embutida. Adiciona $0.033 por requisição quando usado. |
| search_recency_filter | enum | noLimit | oneDay, oneWeek, oneMonth, oneYear, noLimit | Limite os resultados da busca na web a uma janela de recência. |
| count | integer | 10 | 1 a 50 | Número de resultados de busca na web para recuperar quando a busca na web está ativada. |
| search_domain_filter | string | - | - | Restringa a busca na web a um domínio específico. |
| search_prompt | string | - | - | Prompt opcional usado para resumir os resultados de busca web recuperados. |
| search_result | boolean | true | - | Retorne os metadados dos resultados da busca web na resposta quando a busca na web estiver habilitada. |
| tool_stream | boolean | false | - | Transmita argumentos de chamada de função de forma incremental ao transmitir. |
| tools | array | [] | - | Definições de ferramentas de chamada de função compatíveis com OpenAI. |
Variantes são versões alternativas de GLM 5.2 com id de modelo próprio. Dependendo da variante, podem diferir em região de serviço, preços ou parâmetros suportados; todo o resto funciona igual.
glm-5-2:variant1Na EmpirioLabs, GLM 5.2 é cobrado por uso: Entrada $1.40 por fichas de alerta de 1M; Saída $4.40 por tokens gerados 1M; Pesquisa Web $0.033 por pedido. A tabela de tarifas ao vivo desta página sempre corresponde ao que a API cobra.
GLM 5.2 suporta uma janela de contexto de 1M tokens com até 131.072 tokens de saída por resposta.
Sim. GLM 5.2 atende a API Chat Completions compatível com OpenAI, então SDKs OpenAI existentes funcionam apontando base_url para https://api.empiriolabs.ai/v1 e definindo o id de modelo glm-5-2.
GLM 5.2 está disponível como 2 ids de modelo: o padrão glm-5-2 mais glm-5-2:variant1 (Germany). Variantes podem diferir em região de serviço, preços ou parâmetros suportados; as tabelas de tarifas de cada uma estão nesta página.
Sim. O playground da EmpirioLabs executa GLM 5.2 no navegador com os mesmos parâmetros que a API expõe, para você testar prompts antes de escrever código.
Crie uma conta EmpirioLabs e gere uma chave em API Keys no painel. A cobrança usa créditos pay-as-you-go, então você paga apenas pelas requisições que faz.
Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.