GLM 5.1 API

Langkontext-Zhipu AI-Abwägungsmodell mit 202K-Kontext, 128K-Ausgabe, Werkzeugaufruf, strukturierter Ausgabe und Cache-Unterstützung.

Z.aiTextgenerierung202K KontextVeröffentlicht 7. Apr. 2026ChinaProprietärer Endpoint

Über GLM 5.1

Langkontext-Zhipu AI-Abwägungsmodell mit 202K-Kontext, 128K-Ausgabe, Werkzeugaufruf, strukturierter Ausgabe und Cache-Unterstützung.

Notizen: - Serviert von Alibaba Cloud Model Studio im chinesischen Bereitstellungsmodus - Kontextfenster: 202K-Token - Maximale Ausgabe: 128K-Token - Unterstützt Funktionsaufrufe, strukturierte Ausgabe und Kontextcache - Strukturierte Ausgabe sollte mit enable thinking=false ausgeführt werden - Unterstützt keine Websuche, Batches, Präfixfortsetzung oder Feinabstimmung

Auch bekannt als Z.ai GLM 5.1, GLM-5.1, glm-5-1

reasoningfunction callingcache

GLM 5.1 Spezifikationen

Modell-ID
glm-5-1
Anbieter
Z.ai
Kategorie
Textgenerierung
Veröffentlicht
7. Apr. 2026
Kontextfenster
202K Token
Eingabe
Text
Ausgabe
Text
Strukturierte Ausgabe
JSON Schema
Region
China
Endpoints
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/glm-5-1:generateContent

GLM 5.1 API-PreiseSpare bis zu 41%

Live Pay-as-you-go-Preise aus dem EmpirioLabs-Katalog. Du zahlst nur für das, was du nutzt, ohne monatliches Minimum.

Typ
Spezifikation
Preis
Eingabe
pro 1M prompte Token
$1.40<=32K $0.825$1.4032K-200K $1.10
Ausgabe
pro 1M generierte Token
$4.40<=32K $3.301$4.4032K-200K $3.851
Impliziter Cache Read
pro 1M zwischengespeicherte Eingangstoken
$0.26<=32K $0.165$0.2632K-200K $0.22
Web Search (Linkup)
per call when invoked
$0.013
Auf der vollständigen Preisseite vergleichen

So rufst du die GLM 5.1 API auf

GLM 5.1 bedient die OpenAI-kompatible Chat Completions API. Richte ein beliebiges OpenAI SDK mit deinem EmpirioLabs API-Schlüssel auf https://api.empiriolabs.ai/v1 und verwende die Modell-ID glm-5-1. Hol dir einen API-Schlüssel im EmpirioLabs Dashboard.

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5-1",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="glm-5-1",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Vollständige GLM 5.1 API-Referenz

GLM 5.1 API-Parameter

Request-Parameter, die die GLM 5.1 API auf EmpirioLabs unterstützt. Standardwerte gelten, wenn ein Feld weggelassen wird.

ParameterTypStandardBereich / WerteBeschreibung
max_tokensinteger40961 bis 128000Maximale Anzahl der zu generierenden Ausgabetoken.
temperaturenumber10 bis 2Kontrolliert Zufall. Niedrigere Werte machen die Antworten deterministischer.
top_pnumber0.950 bis 1Kernproben-Cutoff.
top_kinteger201 bis 100Begrenzt das Sampling auf die höchsten K Token.
repetition_penaltynumber10.1 bis 2Wiederholte Tokens werden bestraft.
reasoning_effortenummediumnone, low, medium, high, maxDer Aufwand des Schlussfolgerungsaufwands. Keiner verhindert das Denken. Niedrige, mittlere, hohe und maximale begrenzte Denkbudgets, die auf das gewählte Modell...
enable_thinkingbooleantrue-Lass das Modell überlegen, bevor du antwortest. Deaktivieren Sie dies für streng strukturierte Ausgaben.
thinking_budgetinteger327681 bis 38912Maximal verfügbare Tokens zum Denken von Inhalten beim Denken sind aktiviert.
tool_streambooleanfalse-Streame Funktionsaufruf-Argumente inkrementell, wenn du streamst.
toolsarray[]-OpenAI-kompatible Funktionsaufruf-Werkzeugdefinitionen.
tool_choiceobject--OpenAI-kompatible Werkzeugwahlsteuerung.
parallel_tool_callsbooleantrue-Erlauben Sie mehrere Werkzeugaufrufe in einem einzigen Assistentenzug, wenn dies unterstützt wird.
stoparray--Optionale Stop-Sequenzen.
response_formatenum--Beschränke die Ausgabe auf JSON. Verwenden Sie den JSON-Modus für jedes gültige JSON-Objekt oder ein JSON-Schema, um eine Ausgabe zu erzwingen, die mit einem von...
2 weitere Parameter in den Docs

GLM 5.1 API: häufige Fragen

Wie viel kostet die GLM 5.1 API?

Auf EmpirioLabs wird GLM 5.1 nach Verbrauch abgerechnet. Die Live-Preistabelle auf dieser Seite entspricht immer dem, was die API berechnet.

Wie groß ist das Kontextfenster von GLM 5.1?

GLM 5.1 unterstützt ein Kontextfenster von 202K Token.

Ist die GLM 5.1 API OpenAI-kompatibel?

Ja. GLM 5.1 bedient die OpenAI-kompatible Chat Completions API. Bestehende OpenAI SDKs funktionieren, indem du base_url auf https://api.empiriolabs.ai/v1 setzt und als Modell-ID glm-5-1 verwendest.

Kann ich GLM 5.1 im Browser testen, bevor ich integriere?

Ja. Der EmpirioLabs Playground führt GLM 5.1 im Browser mit denselben Parametern aus, die die API bietet. So kannst du Prompts testen, bevor du Code schreibst.

Wie bekomme ich einen GLM 5.1 API-Schlüssel?

Erstelle ein EmpirioLabs-Konto und generiere dann einen Schlüssel unter API Keys im Dashboard. Die Abrechnung erfolgt über Pay-as-you-go-Guthaben, du zahlst also nur für deine Requests.

Bereit, bessere Endpunkte zu nutzen?

Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.