
मूल फ़ंक्शन कॉलिंग के साथ छवि, वीडियो, फ़ाइल और पाठ समझ के लिए मुफ्त मल्टीमॉडल GLM-4.6V मॉडल।
मूल फ़ंक्शन कॉलिंग के साथ छवि, वीडियो, फ़ाइल और पाठ समझ के लिए मुफ्त मल्टीमॉडल GLM-4.6V मॉडल।
बेस टोकन का उपयोग निःशुल्क है। अंतर्निहित वेब खोज tool_web_search के माध्यम से वैकल्पिक है और सक्षम होने पर प्रति अनुरोध $0.033 जोड़ती है। टेक्स्ट, छवि, वीडियो और फ़ाइल इनपुट प्लस फ़ंक्शन टूल, tool_choice ऑटो, JSON response_format, सोच नियंत्रण, tool_stream, तापमान, top_p, do_sample, max_tokens, स्टॉप और स्ट्रीमिंग का समर्थन करता है।
इस नाम से भी जाना जाता है Z.ai GLM 4.6V Flash
glm-4-6v-flash/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/glm-4-6v-flash:generateContentglm-4.6v-flashzai/glm-4.6v-flashzhipu/glm-4.6v-flashEmpirioLabs कैटलॉग से लाइव pay-as-you-go दरें। आप सिर्फ उतना ही भुगतान करते हैं जितना उपयोग करते हैं, कोई मासिक न्यूनतम नहीं।
GLM 4.6V Flash OpenAI-संगत Chat Completions API देता है। किसी भी OpenAI SDK को अपनी EmpirioLabs API key के साथ https://api.empiriolabs.ai/v1 पर सेट करें और model id glm-4-6v-flash उपयोग करें। EmpirioLabs डैशबोर्ड से API key प्राप्त करें।
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-4-6v-flash",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="glm-4-6v-flash",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)EmpirioLabs पर GLM 4.6V Flash API द्वारा समर्थित request पैरामीटर। फ़ील्ड छोड़ने पर डिफ़ॉल्ट मान लागू होते हैं।
| पैरामीटर | प्रकार | डिफॉल्ट | रेंज / मान | विवरण |
|---|---|---|---|---|
| temperature | number | 1 | 0 से 1 | नमूना तापमान। कम मान अधिक नियतात्मक होते हैं। GLM-4.7-Flash र GLM-4.6V-Flash डिफॉल्टमा 1.0; GLM-4.5-फ्लैश डिफ़ॉल्ट रूप से 0.6 है। |
| top_p | number | 0.95 | 0.01 से 1 | नाभिक नमूनाकरण संभाव्यता द्रव्यमान। Z.AI GLM-4.7, GLM-4.6 और GLM-4.5 श्रृंखला के लिए 0.95 डिफ़ॉल्ट दस्तावेज़ करता है। |
| max_tokens | number | 4096 | 1 से 32768 | GLM-4.6V-Flash के लिए अधिकतम आउटपुट टोकन: 32768। |
| stop | array | - | - | शब्द सूची रोकें। Z.AI वर्तमान में सरणी रूप में एक स्टॉप स्ट्रिंग का समर्थन करता है। |
| do_sample | boolean | true | - | नमूनाकरण सक्षम करें। गलत होने पर, तापमान और top_p पीढ़ी को प्रभावित नहीं करते हैं। |
| enable_thinking | boolean | true | - | सोच मोड Z.AI नियंत्रित करता है। सक्षम डिफ़ॉल्ट है; GLM-4.6V-Flash स्वचालित रूपमा निर्णय लिन्छ कि सक्षम हुँदा सोच्नु छ वा छैन। |
| thinking | object | - | - | उन्नत सोच वस्तु। {"type":"enabled"} या {"type":"disabled"} का उपयोग करें। GLM-4.6V-Flash स्वचालित रूपमा निर्णय लिन्छ कि सक्षम हुँदा सोच्नु छ वा छैन। |
| tools | array | - | - | फ़ंक्शन टूल और बिल्ट-इन web_search टूल समर्थित हैं। |
| tool_choice | enum | auto | auto | नियंत्रित करता है कि मॉडल टूल का उपयोग कर सकता है या नहीं। Z.AI दस्तावेज़ ऑटो टूल चयन; टूल का उपयोग अक्षम करने के लिए टूल को छोड़ दें। |
| tool_stream | boolean | false | - | स्ट्रीम फ़ंक्शन-कॉल टूल आउटपुट जब स्ट्रीम सत्य हो। Z.AI दस्तावेज़ GLM-4.6 और नए मॉडल के लिए tool_stream हैं। |
| tool_web_search | boolean | false | - | अंतर्निहित वेब खोज सक्षम करें। सक्षम होने पर प्रति अनुरोध $0.033 जोड़ता है। |
| search_result | boolean | true | - | वेब खोज सक्षम होने पर संरचित वेब खोज परिणाम मेटाडेटा लौटाएँ. |
| search_prompt | string | - | - | पुनर्प्राप्त वेब खोज परिणामों को सारांशित करने के लिए वैकल्पिक निर्देश। |
| count | number | 10 | 1 से 50 | पुनर्प्राप्त करने के लिए वेब खोज परिणामों की संख्या। |
बेस टोकन का उपयोग निःशुल्क है। अंतर्निहित वेब खोज tool_web_search के माध्यम से वैकल्पिक है और सक्षम होने पर प्रति अनुरोध $0.033 जोड़ती है।
EmpirioLabs पर GLM 4.6V Flash का बिल उपयोग के अनुसार बनता है। इस पेज की लाइव दर तालिका हमेशा API की वास्तविक बिलिंग से मेल खाती है।
GLM 4.6V Flash 128K टोकन की context window समर्थित करता है, प्रति उत्तर अधिकतम 32,768 आउटपुट टोकन के साथ।
हां। GLM 4.6V Flash OpenAI-संगत Chat Completions API देता है, इसलिए मौजूदा OpenAI SDKs base_url को https://api.empiriolabs.ai/v1 पर सेट करके और model id glm-4-6v-flash रखकर काम करते हैं।
हां। EmpirioLabs playground ब्राउज़र में GLM 4.6V Flash को उन्हीं पैरामीटरों के साथ चलाता है जो API देता है, ताकि आप कोड लिखने से पहले prompt आज़मा सकें।
EmpirioLabs खाता बनाएं, फिर डैशबोर्ड में API Keys में key जनरेट करें। बिलिंग pay-as-you-go क्रेडिट से होती है, इसलिए आप सिर्फ अपनी requests का भुगतान करते हैं।
हमारे मूल्य निर्धारण की जाँच करें या यदि आप चाहते हैं कि आपका अपना मॉडल हमारे स्टैक पर तैनात किया जाए, तो पहुंचें।