GLM 5.1 API

Modelo de razonamiento de IA Zhipu de largo contexto con contexto 202K, salida 128K, llamada a herramientas, salida estructurada y soporte para caché.

Z.aiGeneracion de texto202K contextoLanzado 7 abr 2026ChinaEndpoint propietario

Acerca de GLM 5.1

Modelo de razonamiento de IA Zhipu de largo contexto con contexto 202K, salida 128K, llamada a herramientas, salida estructurada y soporte para caché.

Notas: - Servido por Alibaba Cloud Model Studio en el modo de despliegue de China - Ventana de contexto: 202K tokens - Salida máxima: 128K tokens - Soporta llamada a funciones, salida estructurada y caché de contexto - La salida estructurada debe ejecutarse con enable_thinking=false - No soporta búsqueda web, lotes, continuación de prefijos ni ajuste fino

También conocido como Z.ai GLM 5.1, GLM-5.1, glm-5-1

reasoningfunction callingcache

Especificaciones de GLM 5.1

ID del modelo
glm-5-1
Proveedor
Z.ai
Categoría
Generacion de texto
Lanzado
7 abr 2026
Ventana de contexto
202K tokens
Entrada
Texto
Salida
Texto
Salida estructurada
JSON Schema
Región
China
Endpoints
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/glm-5-1:generateContent

Precios de la API de GLM 5.1Ahorra hasta 41%

Tarifas de pago por uso en vivo del catálogo de EmpirioLabs. Solo pagas por lo que usas, sin mínimo mensual.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$1.40<=32K $0.825$1.4032K-200K $1.10
Producto
por 1M de tokens generados
$4.40<=32K $3.301$4.4032K-200K $3.851
Caché implícita
por fichas de entrada en caché de 1M
$0.26<=32K $0.165$0.2632K-200K $0.22
Web Search (Linkup)
per call when invoked
$0.013
Comparar en la página completa de precios

Cómo llamar a la API de GLM 5.1

GLM 5.1 sirve la API de Chat Completions compatible con OpenAI. Apunta cualquier SDK de OpenAI a https://api.empiriolabs.ai/v1 con tu clave de API de EmpirioLabs y usa el id de modelo glm-5-1. Consigue una clave de API en el panel de EmpirioLabs.

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5-1",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="glm-5-1",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Referencia completa de la API de GLM 5.1

Parámetros de la API de GLM 5.1

Parámetros de solicitud compatibles con la API de GLM 5.1 en EmpirioLabs. Los valores por defecto se aplican cuando se omite un campo.

ParámetroTipoPredeterminadoRango / valoresDescripción
max_tokensinteger40961 a 128000Número máximo de tokens de salida a generar.
temperaturenumber10 a 2Controla la aleatoriedad. Valores más bajos hacen que las respuestas sean más deterministas.
top_pnumber0.950 a 1Corte de muestreo del núcleo.
top_kinteger201 a 100Limita el muestreo a los K tokens superiores.
repetition_penaltynumber10.1 a 2Penaliza fichas repetidas.
reasoning_effortenummediumnone, low, medium, high, maxNivel de esfuerzo de razonamiento. Ninguno impide pensar. Presupuestos limitados de pensamiento de conjunto bajos, medios, altos y máximos, adaptados al modelo...
enable_thinkingbooleantrue-Permite que el modelo razone antes de responder. Desactiva esto para una salida estrictamente estructurada.
thinking_budgetinteger327681 a 38912Tokens máximos disponibles para contenido de razonamiento cuando el pensamiento está habilitado.
tool_streambooleanfalse-Transmite los argumentos de la llamada de función de forma incremental al hacer streaming.
toolsarray[]-Definiciones de herramientas de llamada a funciones compatibles con OpenAI.
tool_choiceobject--Control de elección de herramientas compatible con OpenAI.
parallel_tool_callsbooleantrue-Permite varias llamadas a herramientas en un solo turno de asistente cuando sea compatible.
stoparray--Secuencias de paradas opcionales.
response_formatenum--Limita la salida a JSON. Usa el modo JSON para cualquier objeto JSON válido, o un esquema JSON para forzar una salida que coincida con un esquema que proporciones.
2 parámetros más en la documentación

API de GLM 5.1: preguntas frecuentes

¿Cuánto cuesta la API de GLM 5.1?

En EmpirioLabs, GLM 5.1 se factura por uso. La tabla de tarifas en vivo de esta página siempre coincide con lo que cobra la API.

¿Cuál es la ventana de contexto de GLM 5.1?

GLM 5.1 admite una ventana de contexto de 202K tokens.

¿La API de GLM 5.1 es compatible con OpenAI?

Sí. GLM 5.1 sirve la API de Chat Completions compatible con OpenAI, así que los SDKs de OpenAI existentes funcionan apuntando base_url a https://api.empiriolabs.ai/v1 y usando el id de modelo glm-5-1.

¿Puedo probar GLM 5.1 en el navegador antes de integrar?

Sí. El playground de EmpirioLabs ejecuta GLM 5.1 en el navegador con los mismos parámetros que expone la API, para que pruebes prompts antes de escribir código.

¿Cómo consigo una clave de API de GLM 5.1?

Crea una cuenta de EmpirioLabs y genera una clave en API Keys en el panel. La facturación es con créditos de pago por uso, así que solo pagas por las solicitudes que haces.

¿Listo para usar mejores endpoints?

Consulta nuestros precios o contacta con nosotros si quieres que tu propio modelo se implemente en nuestra pila.