GLM 5.2 API

Logik- und Codierungsmodell mit einem 1M Token-Kontext, 128K-Ausgabe, anpassbarem Schlussfolgerungsaufwand, nativer Websuche und Werkzeugaufrufen.

Z.aiTextgenerierung1M KontextVeröffentlicht 16. Juni 2026SingaporeProprietärer Endpoint

Über GLM 5.2

Logik- und Codierungsmodell mit einem 1M Token-Kontext, 128K-Ausgabe, anpassbarem Schlussfolgerungsaufwand, nativer Websuche und Werkzeugaufrufen.

Anmerkungen: - Kontextfenster: 1 Mio. Token - Maximaler Ausgang: 128.000 Token - Anpassungsfähiger Schlussaufwand von minimal zu maximal (maximal empfohlen für komplexes Codieren) - Eingebaute Websuche fügt bei Verwendung $0.033 pro Anfrage hinzu - Unterstützt Funktionsaufrufe, strukturierte Ausgabe und Streaming - Führt strukturierte Ausgabe mit deaktiviertem Denken aus

Auch bekannt als Z.ai GLM 5.2

reasoningfunction callingweb search

GLM 5.2 Spezifikationen

Modell-ID
glm-5-2
Autor
Z.ai
Kategorie
Textgenerierung
Veröffentlicht
16. Juni 2026
Kontextfenster
1M Token
Max. Ausgabe
131.072 Token
Eingabe
Text
Ausgabe
Text
Strukturierte Ausgabe
JSON-Modus
Region
Singapore
Endpoints
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/glm-5-2:generateContent
Alternative Modell-IDs
glm-5.2zai/glm-5.2zhipu/glm-5.2

GLM 5.2 API-Preise

Live Pay-as-you-go-Preise aus dem EmpirioLabs-Katalog. Du zahlst nur für das, was du nutzt, ohne monatliches Minimum.

Typ
Spezifikation
Preis
Eingabe
pro 1M Prompt-Token
$1.40
Ausgabe
pro 1 Million generierter Token
$4.40
Web-Suche
auf Wunsch
$0.033
Auf der vollständigen Preisseite vergleichen

So rufst du die GLM 5.2 API auf

GLM 5.2 bedient die OpenAI-kompatible Chat Completions API. Richte ein beliebiges OpenAI SDK mit deinem EmpirioLabs API-Schlüssel auf https://api.empiriolabs.ai/v1 und verwende die Modell-ID glm-5-2. Hol dir einen API-Schlüssel im EmpirioLabs Dashboard.

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5-2",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="glm-5-2",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Vollständige GLM 5.2 API-Referenz

GLM 5.2 API-Parameter

Request-Parameter, die die GLM 5.2 API auf EmpirioLabs unterstützt. Standardwerte gelten, wenn ein Feld weggelassen wird.

ParameterTypStandardBereich / WerteBeschreibung
max_tokensinteger655361 bis 131072Maximale Anzahl der zu generierenden Ausgabetoken.
temperaturenumber10 bis 1Kontrolliert Zufall. Niedrigere Werte machen die Antworten deterministischer.
top_pnumber0.950.01 bis 1Kernproben-Cutoff.
reasoning_effortenummaxnone, minimal, low, medium, high, xhigh, maxGLM-5.2 Schlussfolgerung. keines verhindert das Denken; Minimal bis maximal geben Sie an, wie stark das Modell argumentiert, bevor Sie antworten. Max wird für...
enable_thinkingbooleantrue-Lass das Modell überlegen, bevor du antwortest. Schalten Sie sie für Antworten mit niedrigster Latenz oder streng strukturierte Ausgaben aus.
do_samplebooleantrue-Aktivieren Sie das Sampling. Schalten Sie es für gierige deterministische Ausgaben aus (Temperatur und top_p werden ignoriert).
tool_web_searchbooleanfalse-Aktivieren Sie die integrierte Websuche. Fügt $0.033 pro Anfrage hinzu, wenn man es nutzt.
search_recency_filterenumnoLimitoneDay, oneWeek, oneMonth, oneYear, noLimitBeschränke die Websuchergebnisse auf ein aktuelles Fenster.
countinteger101 bis 50Anzahl der Websuchergebnisse, die abgerufen werden müssen, wenn die Websuche aktiviert ist.
search_domain_filterstring--Beschränke die Websuche auf eine bestimmte Domäne.
search_promptstring--Optionaler Prompt, der verwendet wird, um abgerufene Websuchergebnisse zusammenzufassen.
search_resultbooleantrue-Geben Sie die Metadaten der Websuchergebnisse in der Antwort zurück, wenn die Websuche aktiviert ist.
tool_streambooleanfalse-Streame Funktionsaufruf-Argumente inkrementell, wenn du streamst.
toolsarray[]-OpenAI-kompatible Funktionsaufruf-Werkzeugdefinitionen.
3 weitere Parameter in den Docs

GLM 5.2 Varianten

Varianten sind alternative Versionen von GLM 5.2 mit eigener Modell-ID. Je nach Variante können sich Serving-Region, Preise oder unterstützte Parameter unterscheiden; alles andere funktioniert gleich.

GLM 5.2 :variant1Spare bis zu 21%

Modell-ID
glm-5-2:variant1
Region
Germany
Kontextfenster
1M Token
Strukturierte Ausgabe
JSON Schema
Typ
Spezifikation
Preis
Eingabe
pro 1M Prompt-Token
$1.40$1.10
Ausgabe
pro 1 Million generierter Token
$4.40$3.851
Implizite Cache-Leseart
pro 1M zwischengespeicherten Eingabetoken
$0.275
Websuche (Linkup)
pro Aufruf beim Aufruf
$0.013
:variant1 im Playground testen

GLM 5.2 :variant2

Modell-ID
glm-5-2:variant2
Region
United States
Kontextfenster
1M Token
Strukturierte Ausgabe
JSON Schema
Typ
Spezifikation
Preis
Eingabe
pro 1M Prompt-Token
$1.40
Ausgabe
pro 1 Million generierter Token
$4.40
Websuche (Linkup)
pro Aufruf beim Aufruf
$0.013
:variant2 im Playground testen

GLM 5.2 API: häufige Fragen

Wie viel kostet die GLM 5.2 API?

Auf EmpirioLabs wird GLM 5.2 nach Verbrauch abgerechnet: Eingabe $1.40 pro 1M Prompt-Token; Output $4.40 pro 1 Million generierter Token; Web-Suche $0.033 auf Wunsch. Die Live-Preistabelle auf dieser Seite entspricht immer dem, was die API berechnet.

Wie groß ist das Kontextfenster von GLM 5.2?

GLM 5.2 unterstützt ein Kontextfenster von 1M Token mit bis zu 131.072 Ausgabe-Token pro Antwort.

Ist die GLM 5.2 API OpenAI-kompatibel?

Ja. GLM 5.2 bedient die OpenAI-kompatible Chat Completions API. Bestehende OpenAI SDKs funktionieren, indem du base_url auf https://api.empiriolabs.ai/v1 setzt und als Modell-ID glm-5-2 verwendest.

Welche GLM 5.2 Varianten sind verfügbar?

GLM 5.2 ist als 3 Modell-IDs verfügbar: der Standard glm-5-2 plus glm-5-2:variant1 (Germany), glm-5-2:variant2 (United States). Varianten können sich in Serving-Region, Preisen oder unterstützten Parametern unterscheiden; die Preistabellen stehen auf dieser Seite.

Kann ich GLM 5.2 im Browser testen, bevor ich integriere?

Ja. Der EmpirioLabs Playground führt GLM 5.2 im Browser mit denselben Parametern aus, die die API bietet. So kannst du Prompts testen, bevor du Code schreibst.

Wie bekomme ich einen GLM 5.2 API-Schlüssel?

Erstelle ein EmpirioLabs-Konto und generiere dann einen Schlüssel unter API Keys im Dashboard. Die Abrechnung erfolgt über Pay-as-you-go-Guthaben, du zahlst also nur für deine Requests.

Bereit, bessere Endpunkte zu nutzen?

Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.