
Kostenloses multimodales GLM-4.6V Modell für Bild-, Video-, Datei- und Textverständnis mit nativem Funktionsaufruf.
Kostenloses multimodales GLM-4.6V Modell für Bild-, Video-, Datei- und Textverständnis mit nativem Funktionsaufruf.
Base Token Nutzung ist kostenlos. Die integrierte Websuche ist optional über tool_web_search und fügt $0.033 pro Anforderung hinzu, wenn sie aktiviert ist. Unterstützt Text-, Bild-, Video- und Dateieingabe sowie Funktionstools, tool choice auto, JSON response format, think control, tool stream, temperature, top p, do sample, max tokens, stop und streaming.
Auch bekannt als Z.ai GLM 4.6V Flash, GLM-4.6V-Flash, glm-4-6v-flash
glm-4-6v-flash/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/glm-4-6v-flash:generateContentglm-4.6v-flashzai/glm-4.6v-flashzhipu/glm-4.6v-flashLive Pay-as-you-go-Preise aus dem EmpirioLabs-Katalog. Du zahlst nur für das, was du nutzt, ohne monatliches Minimum.
GLM 4.6V Flash bedient die OpenAI-kompatible Chat Completions API. Richte ein beliebiges OpenAI SDK mit deinem EmpirioLabs API-Schlüssel auf https://api.empiriolabs.ai/v1 und verwende die Modell-ID glm-4-6v-flash. Hol dir einen API-Schlüssel im EmpirioLabs Dashboard.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-4-6v-flash",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="glm-4-6v-flash",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)Request-Parameter, die die GLM 4.6V Flash API auf EmpirioLabs unterstützt. Standardwerte gelten, wenn ein Feld weggelassen wird.
| Parameter | Typ | Standard | Bereich / Werte | Beschreibung |
|---|---|---|---|---|
| temperature | number | 1 | 0 bis 1 | Temperatur wird geprochen. Niedrigere Werte sind deterministischer. GLM-4.7-Flash und GLM-4.6V-Flash sind standardmäßig auf 1.0 eingestellt; GLM-4.5-Flash steht... |
| top_p | number | 0.95 | 0.01 bis 1 | Kernprobenwahrscheinlichkeitsmasse. Z.AI dokumentiert einen Standard von 0,95 für die GLM-4.7-, GLM-4.6- und GLM-4.5-Serien. |
| max_tokens | number | 4096 | 1 bis 32768 | Maximale Ausgabetoken für GLM-4,6V-Flash: 32768. |
| stop | array | - | - | Hör auf mit der Wortliste. Z.AI unterstützt derzeit eine Ein-Stopp-String in Array-Form. |
| do_sample | boolean | true | - | Aktivieren Sie das Sampling. Wenn falsch, beeinflussen Temperatur und top_p die Erzeugung nicht. |
| enable_thinking | boolean | true | - | Kontrolliert Z.AI Denkmodus. Aktiviert ist der Standard; GLM-4.6V-Flash entscheidet automatisch, ob es denkt, wenn es aktiviert ist. |
| thinking | object | - | - | Fortschrittliches Denkobjekt. Verwenden Sie {"type":"enabled"} oder {"type":"disabled"}. GLM-4.6V-Flash entscheidet automatisch, ob es denkt, wenn es aktiviert ist. |
| tools | array | - | - | Funktionswerkzeuge und das integrierte web_search-Tool werden unterstützt. |
| tool_choice | enum | auto | auto | Kontrolliert, ob das Modell Werkzeuge verwenden darf. Z.AI Dokumente automatische Werkzeugauswahl; Weglassen Sie Werkzeuge, um die Werkzeugnutzung zu deaktivieren. |
| tool_stream | boolean | false | - | Das Stream-Funktionsaufruf-Tool gibt aus, wenn der Stream true ist. Z.AI Dokumente tool_stream für GLM-4.6 und neuere Modelle. |
| tool_web_search | boolean | false | - | Aktivieren Sie die integrierte Websuche. Fügt $0.033 pro Anfrage hinzu, wenn sie aktiviert ist. |
| search_result | boolean | true | - | Geben Sie strukturierte Websuchergebnismetadaten zurück, wenn die Websuche aktiviert ist. |
| search_prompt | string | - | - | Optionale Anleitung zur Zusammenfassung der abgerufenen Websuchergebnisse. |
| count | number | 10 | 1 bis 50 | Anzahl der zu abrufenden Websuchergebnisse. |
Base Token Nutzung ist kostenlos. Die integrierte Websuche ist optional über tool_web_search und fügt $0.033 pro Anforderung hinzu, wenn sie aktiviert ist.
Auf EmpirioLabs wird GLM 4.6V Flash nach Verbrauch abgerechnet. Die Live-Preistabelle auf dieser Seite entspricht immer dem, was die API berechnet.
GLM 4.6V Flash unterstützt ein Kontextfenster von 128K Token mit bis zu 32.768 Ausgabe-Token pro Antwort.
Ja. GLM 4.6V Flash bedient die OpenAI-kompatible Chat Completions API. Bestehende OpenAI SDKs funktionieren, indem du base_url auf https://api.empiriolabs.ai/v1 setzt und als Modell-ID glm-4-6v-flash verwendest.
Ja. Der EmpirioLabs Playground führt GLM 4.6V Flash im Browser mit denselben Parametern aus, die die API bietet. So kannst du Prompts testen, bevor du Code schreibst.
Erstelle ein EmpirioLabs-Konto und generiere dann einen Schlüssel unter API Keys im Dashboard. Die Abrechnung erfolgt über Pay-as-you-go-Guthaben, du zahlst also nur für deine Requests.
Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.