
Modelo de raciocínio Zhipu AI de contexto longo com contexto 202K, saída 128K, chamada de ferramentas, saída estruturada e suporte a cache.
Modelo de raciocínio Zhipu AI de contexto longo com contexto 202K, saída 128K, chamada de ferramentas, saída estruturada e suporte a cache.
Notas: - Servido pelo Alibaba Cloud Model Studio no modo de implantação da China - Janela de contexto: tokens 202K - Saída máxima: tokens 128K - Suporta chamada de função, saída estruturada e cache de contexto - Saída estruturada deve ser executada com enable thinking=false - Não suporta pesquisa web, lotes, continuação de prefixo, ou ajuste fino
Também conhecido como Z.ai GLM 5.1, GLM-5.1, glm-5-1
glm-5-1/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/glm-5-1:generateContentTarifas pay-as-you-go ao vivo do catálogo EmpirioLabs. Você paga só pelo que usa, sem mínimo mensal.
GLM 5.1 atende a API Chat Completions compatível com OpenAI. Aponte qualquer SDK OpenAI para https://api.empiriolabs.ai/v1 com sua chave de API EmpirioLabs e use o id de modelo glm-5-1. Obtenha uma chave de API no painel EmpirioLabs.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5-1",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="glm-5-1",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)Parâmetros de requisição suportados pela API GLM 5.1 na EmpirioLabs. Os padrões valem quando um campo é omitido.
| Parâmetro | Tipo | Padrão | Intervalo / valores | Descrição |
|---|---|---|---|---|
| max_tokens | integer | 4096 | 1 a 128000 | Número máximo de tokens de saída a serem gerados. |
| temperature | number | 1 | 0 a 2 | Controla a aleatoriedade. Valores mais baixos tornam as respostas mais determinísticas. |
| top_p | number | 0.95 | 0 a 1 | Corte de amostragem do núcleo. |
| top_k | integer | 20 | 1 a 100 | Limita a amostragem aos K tokens principais. |
| repetition_penalty | number | 1 | 0.1 a 2 | Penaliza tokens repetidos. |
| reasoning_effort | enum | medium | none, low, medium, high, max | Nível de esforço de raciocínio. Nenhum impede o pensamento. orçamentos limitados de pensamento de conjuntos baixos, médios, altos e máximos, dimensionados para o... |
| enable_thinking | boolean | true | - | Permita que o modelo raciocine antes de responder. Desative isso para saída estruturada estritamente. |
| thinking_budget | integer | 32768 | 1 a 38912 | Tokens máximos disponíveis para conteúdo de raciocínio quando o pensamento está ativado. |
| tool_stream | boolean | false | - | Transmita argumentos de chamada de função de forma incremental ao transmitir. |
| tools | array | [] | - | Definições de ferramentas de chamada de função compatíveis com OpenAI. |
| tool_choice | object | - | - | Controle de escolha de ferramentas compatível com OpenAI. |
| parallel_tool_calls | boolean | true | - | Permita múltiplas chamadas de ferramenta em um único turno de assistente quando suportado. |
| stop | array | - | - | Sequências opcionais de paradas. |
| response_format | enum | - | - | Restringa a saída a JSON. Use o modo JSON para qualquer objeto JSON válido, ou esquema JSON para forçar a saída que corresponda a um esquema que você fornece. |
Na EmpirioLabs, GLM 5.1 é cobrado por uso. A tabela de tarifas ao vivo desta página sempre corresponde ao que a API cobra.
GLM 5.1 suporta uma janela de contexto de 202K tokens.
Sim. GLM 5.1 atende a API Chat Completions compatível com OpenAI, então SDKs OpenAI existentes funcionam apontando base_url para https://api.empiriolabs.ai/v1 e definindo o id de modelo glm-5-1.
Sim. O playground da EmpirioLabs executa GLM 5.1 no navegador com os mesmos parâmetros que a API expõe, para você testar prompts antes de escrever código.
Crie uma conta EmpirioLabs e gere uma chave em API Keys no painel. A cobrança usa créditos pay-as-you-go, então você paga apenas pelas requisições que faz.
Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.