GLM 5.1 एपीआई

202K संदर्भ, 128K आउटपुट, टूल कॉलिंग, संरचित आउटपुट और कैश समर्थन के साथ लंबे संदर्भ वाला Zhipu AI रीजनिंग मॉडल।

Z.aiपाठ निर्माण202K कॉन्टेक्स्टरिलीज 7 अप्रैल 2026Chinaस्वामित्व वाला एंडपॉइंट

GLM 5.1 के बारे में

202K संदर्भ, 128K आउटपुट, टूल कॉलिंग, संरचित आउटपुट और कैश समर्थन के साथ लंबे संदर्भ वाला Zhipu AI रीजनिंग मॉडल।

टिप्पणियाँ: - चीन परिनियोजन मोड में अलीबाबा क्लाउड मॉडल स्टूडियो द्वारा सेवा की जाती है - संदर्भ विंडो: 202K टोकन - अधिकतम आउटपुट: 128K टोकन - फ़ंक्शन कॉलिंग, संरचित आउटपुट और संदर्भ कैश का समर्थन करता है - संरचित आउटपुट enable_thinking=false के साथ चलना चाहिए - वेब खोज, बैच, उपसर्ग निरंतरता या फाइन-ट्यूनिंग का समर्थन नहीं करता है

इस नाम से भी जाना जाता है Z.ai GLM 5.1

reasoningfunction callingcache

GLM 5.1 की विशेषताएं

मॉडल ID
glm-5-1
निर्माता
Z.ai
श्रेणी
पाठ निर्माण
रिलीज
7 अप्रैल 2026
कॉन्टेक्स्ट विंडो
202K टोकन
इनपुट
टेक्स्ट
आउटपुट
टेक्स्ट
संरचित आउटपुट
JSON Schema
रीजन
China
एंडपॉइंट
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/glm-5-1:generateContent

GLM 5.1 API की कीमतें41% तक बचाएं

EmpirioLabs कैटलॉग से लाइव pay-as-you-go दरें। आप सिर्फ उतना ही भुगतान करते हैं जितना उपयोग करते हैं, कोई मासिक न्यूनतम नहीं।

प्रकार
स्पेक
दर
इनपुट
प्रति 1M प्रॉम्प्ट टोकन
$1.40<=32K $0.825$1.4032K-200K $1.10
उत्पादन
प्रति 1M जेनरेट किए गए टोकन
$4.40<=32K $3.301$4.4032K-200K $3.851
अंतर्निहित कैश पढ़ा गया
प्रति 1M कैश्ड इनपुट टोकन
$0.26<=32K $0.165$0.2632K-200K $0.22
वेब खोज (लिंकअप)
प्रति कॉल जब लागू किया जाता है
$0.013
पूरे कीमत पेज पर तुलना करें

GLM 5.1 API को कैसे कॉल करें

GLM 5.1 OpenAI-संगत Chat Completions API देता है। किसी भी OpenAI SDK को अपनी EmpirioLabs API key के साथ https://api.empiriolabs.ai/v1 पर सेट करें और model id glm-5-1 उपयोग करें। EmpirioLabs डैशबोर्ड से API key प्राप्त करें।

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5-1",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="glm-5-1",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
GLM 5.1 API का पूरा संदर्भ

GLM 5.1 API के पैरामीटर

EmpirioLabs पर GLM 5.1 API द्वारा समर्थित request पैरामीटर। फ़ील्ड छोड़ने पर डिफ़ॉल्ट मान लागू होते हैं।

पैरामीटरप्रकारडिफॉल्टरेंज / मानविवरण
max_tokensinteger40961 से 128000उत्पन्न करने के लिए आउटपुट टोकन की अधिकतम संख्या।
temperaturenumber10 से 2यादृच्छिकता को नियंत्रित करता है। कम मान प्रतिक्रियाओं को अधिक नियतात्मक बनाते हैं।
top_pnumber0.950 से 1न्यूक्लियस सैंपलिंग कटऑफ।
top_kinteger201 से 100शीर्ष K टोकन तक नमूनाकरण सीमित करता है।
repetition_penaltynumber10.1 से 2बार-बार टोकन को दंडित करता है।
reasoning_effortenummediumnone, low, medium, high, maxतर्क प्रयास स्तर। कोई भी सोच को अक्षम नहीं करता है। निम्न, मध्यम, उच्च और अधिकतम सेट चयनित मॉडल के आकार के बाउंड थिंकिंग बजट। OpenAI-शैली reasoning_effort फ़ील्ड के...
enable_thinkingbooleantrue-जवाब देने से पहले मॉडल को तर्क करने दें। सख्त संरचित आउटपुट के लिए इसे अक्षम करें।
thinking_budgetinteger327681 से 38912सोच सक्षम होने पर तर्क सामग्री के लिए अधिकतम टोकन उपलब्ध होते हैं।
tool_streambooleanfalse-स्ट्रीमिंग करते समय फ़ंक्शन-कॉल तर्कों को वृद्धिशील रूप से स्ट्रीम करें।
toolsarray[]-OpenAI-संगत फ़ंक्शन कॉलिंग टूल परिभाषाएँ।
tool_choiceobject--OpenAI-संगत उपकरण विकल्प नियंत्रण।
parallel_tool_callsbooleantrue-समर्थित होने पर एक ही सहायक मोड़ में कई टूल कॉल की अनुमति दें।
stoparray--वैकल्पिक स्टॉप अनुक्रम।
response_formatenum--आउटपुट को JSON पर सीमित करें। किसी भी मान्य JSON ऑब्जेक्ट के लिए JSON मोड का उपयोग करें, या आपके द्वारा प्रदान की गई स्कीमा से मेल खाने वाले आउटपुट को बाध्य करने के...
डॉक्स में 2 और पैरामीटर

GLM 5.1 API: आम सवाल

GLM 5.1 API की कीमत कितनी है?

EmpirioLabs पर GLM 5.1 का बिल उपयोग के अनुसार बनता है। इस पेज की लाइव दर तालिका हमेशा API की वास्तविक बिलिंग से मेल खाती है।

GLM 5.1 की context window कितनी है?

GLM 5.1 202K टोकन की context window समर्थित करता है।

क्या GLM 5.1 API OpenAI-संगत है?

हां। GLM 5.1 OpenAI-संगत Chat Completions API देता है, इसलिए मौजूदा OpenAI SDKs base_url को https://api.empiriolabs.ai/v1 पर सेट करके और model id glm-5-1 रखकर काम करते हैं।

क्या मैं इंटीग्रेट करने से पहले ब्राउज़र में GLM 5.1 आज़मा सकता हूं?

हां। EmpirioLabs playground ब्राउज़र में GLM 5.1 को उन्हीं पैरामीटरों के साथ चलाता है जो API देता है, ताकि आप कोड लिखने से पहले prompt आज़मा सकें।

GLM 5.1 की API key कैसे मिलेगी?

EmpirioLabs खाता बनाएं, फिर डैशबोर्ड में API Keys में key जनरेट करें। बिलिंग pay-as-you-go क्रेडिट से होती है, इसलिए आप सिर्फ अपनी requests का भुगतान करते हैं।

बेहतर समापन बिंदुओं का उपयोग करने के लिए तैयार हैं?

हमारे मूल्य निर्धारण की जाँच करें या यदि आप चाहते हैं कि आपका अपना मॉडल हमारे स्टैक पर तैनात किया जाए, तो पहुंचें।