GLM 5.1 API

Modèle de raisonnement IA Zhipu à long contexte avec contexte 202K, sortie 128K, appel d’outils, sortie structurée et support du cache.

Z.aiGénération de texte202K contextePublié 7 avr. 2026ChinaEndpoint propriétaire

À propos de GLM 5.1

Modèle de raisonnement IA Zhipu à long contexte avec contexte 202K, sortie 128K, appel d’outils, sortie structurée et support du cache.

Notes: - Servi par Alibaba Cloud Model Studio en mode de déploiement en Chine - Fenêtre de contexte: 202K jetons - Sortie maximale: 128K jetons - Prend en charge l’appel de fonctions, la sortie structurée et le cache contextuel - La sortie structurée doit fonctionner avec enable_thinking=faux - Ne supporte pas la recherche web, les batches, la continuation du préfixe ou le réglage fin

Aussi connu sous le nom Z.ai GLM 5.1, GLM-5.1, glm-5-1

reasoningfunction callingcache

Caractéristiques de GLM 5.1

ID du modèle
glm-5-1
Fournisseur
Z.ai
Catégorie
Génération de texte
Publié
7 avr. 2026
Fenêtre de contexte
202K tokens
Entrée
Texte
Sortie
Texte
Sortie structurée
JSON Schema
Région
China
Endpoints
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/glm-5-1:generateContent

Tarifs de l'API GLM 5.1Économisez jusqu'à 41%

Tarifs à l'usage en direct du catalogue EmpirioLabs. Vous ne payez que ce que vous utilisez, sans minimum mensuel.

Type
Spéc.
Tarif
Entrée
par jetons 1M
$1.40<=32K $0.825$1.4032K-200K $1.10
Produit
par jeton généré 1M
$4.40<=32K $3.301$4.4032K-200K $3.851
cache implicite lu
par jetons d'entrée en cache 1M
$0.26<=32K $0.165$0.2632K-200K $0.22
Web Search (Linkup)
per call when invoked
$0.013
Comparer sur la page complète des tarifs

Comment appeler l'API GLM 5.1

GLM 5.1 sert l'API Chat Completions compatible OpenAI. Pointez n'importe quel SDK OpenAI vers https://api.empiriolabs.ai/v1 avec votre clé API EmpirioLabs et utilisez l'id de modèle glm-5-1. Obtenez une clé API depuis le tableau de bord EmpirioLabs.

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5-1",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="glm-5-1",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Référence complète de l'API GLM 5.1

Paramètres de l'API GLM 5.1

Paramètres de requête pris en charge par l'API GLM 5.1 sur EmpirioLabs. Les valeurs par défaut s'appliquent quand un champ est omis.

ParamètreTypePar défautPlage / valeursDescription
max_tokensinteger40961 à 128000Nombre maximal de jetons de sortie à générer.
temperaturenumber10 à 2Contrôle l’aléatoire. Des valeurs plus basses rendent les réponses plus déterministes.
top_pnumber0.950 à 1Coupure d’échantillonnage du noyau.
top_kinteger201 à 100Limite l’échantillonnage aux K premiers jetons.
repetition_penaltynumber10.1 à 2Penalise les jetons répétés.
reasoning_effortenummediumnone, low, medium, high, maxNiveau d’effort de raisonnement. Aucun ne décourage la pensée. budgets de pensée limités faible, moyen, élevé et maximal adaptés au modèle sélectionné. Envoyé sous...
enable_thinkingbooleantrue-Laissez le modèle raisonner avant de répondre. Désactivez cela pour une sortie strictement structurée.
thinking_budgetinteger327681 à 38912Maximum de jetons disponibles pour le contenu de raisonnement lorsque la réflexion est activée.
tool_streambooleanfalse-Diffusez progressivement les arguments d’appel de fonction lors du streaming.
toolsarray[]-Définitions d’outils d’appel de fonction compatibles OpenAI.
tool_choiceobject--Contrôle du choix d’outils compatible OpenAI.
parallel_tool_callsbooleantrue-Autoriser plusieurs appels d’outils en un seul tour d’assistant quand cela est supporté.
stoparray--Séquences d’arrêts optionnelles.
response_formatenum--Limitez la sortie au JSON. Utilisez le mode JSON pour tout objet JSON valide, ou un schéma JSON pour forcer une sortie correspondant à un schéma que vous fournissez.
2 paramètres de plus dans la doc

API GLM 5.1 : questions fréquentes

Combien coûte l'API GLM 5.1 ?

Sur EmpirioLabs, GLM 5.1 est facturé à l'usage. La grille tarifaire en direct de cette page correspond toujours à ce que l'API facture.

Quelle est la fenêtre de contexte de GLM 5.1 ?

GLM 5.1 prend en charge une fenêtre de contexte de 202K tokens.

L'API GLM 5.1 est-elle compatible OpenAI ?

Oui. GLM 5.1 sert l'API Chat Completions compatible OpenAI : les SDKs OpenAI existants fonctionnent en pointant base_url vers https://api.empiriolabs.ai/v1 et en utilisant l'id de modèle glm-5-1.

Puis-je essayer GLM 5.1 dans le navigateur avant d'intégrer ?

Oui. Le playground EmpirioLabs exécute GLM 5.1 dans le navigateur avec les mêmes paramètres que l'API expose, pour tester vos prompts avant d'écrire du code.

Comment obtenir une clé API GLM 5.1 ?

Créez un compte EmpirioLabs, puis générez une clé sous API Keys dans le tableau de bord. La facturation utilise des crédits à l'usage : vous ne payez que vos requêtes.

Prêt à utiliser de meilleurs points de terminaison ?

Consultez nos tarifs ou contactez-nous si vous souhaitez que votre propre modèle soit déployé sur notre stack.