GLM 5.1 API

Modelo de raciocínio Zhipu AI de contexto longo com contexto 202K, saída 128K, chamada de ferramentas, saída estruturada e suporte a cache.

Z.aiGeração de Texto202K contextoLançado 7 de abr. de 2026ChinaEndpoint proprietário

Sobre GLM 5.1

Modelo de raciocínio Zhipu AI de contexto longo com contexto 202K, saída 128K, chamada de ferramentas, saída estruturada e suporte a cache.

Notas: - Servido pelo Alibaba Cloud Model Studio no modo de implantação da China - Janela de contexto: tokens 202K - Saída máxima: tokens 128K - Suporta chamada de função, saída estruturada e cache de contexto - Saída estruturada deve ser executada com enable thinking=false - Não suporta pesquisa web, lotes, continuação de prefixo, ou ajuste fino

Também conhecido como Z.ai GLM 5.1, GLM-5.1, glm-5-1

reasoningfunction callingcache

Especificações de GLM 5.1

ID do modelo
glm-5-1
Provedor
Z.ai
Categoria
Geração de Texto
Lançado
7 de abr. de 2026
Janela de contexto
202K tokens
Entrada
Texto
Saída
Texto
Saída estruturada
JSON Schema
Região
China
Endpoints
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/glm-5-1:generateContent

Preços da API GLM 5.1Economize até 41%

Tarifas pay-as-you-go ao vivo do catálogo EmpirioLabs. Você paga só pelo que usa, sem mínimo mensal.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$1.40<=32K $0.825$1.4032K-200K $1.10
Saída
por tokens gerados 1M
$4.40<=32K $3.301$4.4032K-200K $3.851
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
$0.26<=32K $0.165$0.2632K-200K $0.22
Web Search (Linkup)
per call when invoked
$0.013
Comparar na página completa de preços

Como chamar a API GLM 5.1

GLM 5.1 atende a API Chat Completions compatível com OpenAI. Aponte qualquer SDK OpenAI para https://api.empiriolabs.ai/v1 com sua chave de API EmpirioLabs e use o id de modelo glm-5-1. Obtenha uma chave de API no painel EmpirioLabs.

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5-1",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="glm-5-1",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Referência completa da API GLM 5.1

Parâmetros da API GLM 5.1

Parâmetros de requisição suportados pela API GLM 5.1 na EmpirioLabs. Os padrões valem quando um campo é omitido.

ParâmetroTipoPadrãoIntervalo / valoresDescrição
max_tokensinteger40961 a 128000Número máximo de tokens de saída a serem gerados.
temperaturenumber10 a 2Controla a aleatoriedade. Valores mais baixos tornam as respostas mais determinísticas.
top_pnumber0.950 a 1Corte de amostragem do núcleo.
top_kinteger201 a 100Limita a amostragem aos K tokens principais.
repetition_penaltynumber10.1 a 2Penaliza tokens repetidos.
reasoning_effortenummediumnone, low, medium, high, maxNível de esforço de raciocínio. Nenhum impede o pensamento. orçamentos limitados de pensamento de conjuntos baixos, médios, altos e máximos, dimensionados para o...
enable_thinkingbooleantrue-Permita que o modelo raciocine antes de responder. Desative isso para saída estruturada estritamente.
thinking_budgetinteger327681 a 38912Tokens máximos disponíveis para conteúdo de raciocínio quando o pensamento está ativado.
tool_streambooleanfalse-Transmita argumentos de chamada de função de forma incremental ao transmitir.
toolsarray[]-Definições de ferramentas de chamada de função compatíveis com OpenAI.
tool_choiceobject--Controle de escolha de ferramentas compatível com OpenAI.
parallel_tool_callsbooleantrue-Permita múltiplas chamadas de ferramenta em um único turno de assistente quando suportado.
stoparray--Sequências opcionais de paradas.
response_formatenum--Restringa a saída a JSON. Use o modo JSON para qualquer objeto JSON válido, ou esquema JSON para forçar a saída que corresponda a um esquema que você fornece.
2 parâmetros a mais na documentação

API GLM 5.1: perguntas frequentes

Quanto custa a API GLM 5.1?

Na EmpirioLabs, GLM 5.1 é cobrado por uso. A tabela de tarifas ao vivo desta página sempre corresponde ao que a API cobra.

Qual é a janela de contexto de GLM 5.1?

GLM 5.1 suporta uma janela de contexto de 202K tokens.

A API GLM 5.1 é compatível com OpenAI?

Sim. GLM 5.1 atende a API Chat Completions compatível com OpenAI, então SDKs OpenAI existentes funcionam apontando base_url para https://api.empiriolabs.ai/v1 e definindo o id de modelo glm-5-1.

Posso testar GLM 5.1 no navegador antes de integrar?

Sim. O playground da EmpirioLabs executa GLM 5.1 no navegador com os mesmos parâmetros que a API expõe, para você testar prompts antes de escrever código.

Como consigo uma chave de API GLM 5.1?

Crie uma conta EmpirioLabs e gere uma chave em API Keys no painel. A cobrança usa créditos pay-as-you-go, então você paga apenas pelas requisições que faz.

Pronto para usar endpoints melhores?

Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.