GLM 4.6V Flash एपीआई

मूल फंक्शन कॉलिंग के साथ छवि, वीडियो, फ़ाइल और टेक्स्ट समझ के लिए मुफ्त मल्टीमॉडल GLM-4.6V मॉडल।

Z.aiटेक्स्ट जनरेशन128K कॉन्टेक्स्टरिलीज 8 दिस॰ 2025Singaporeस्वामित्व वाला एंडपॉइंट

GLM 4.6V Flash के बारे में

मूल फंक्शन कॉलिंग के साथ छवि, वीडियो, फ़ाइल और टेक्स्ट समझ के लिए मुफ्त मल्टीमॉडल GLM-4.6V मॉडल।

बेस टोकन का उपयोग मुफ्त है। अंतर्निहित वेब खोज tool_web_search पाठ, छवि, वीडियो और फ़ाइल इनपुट प्लस फ़ंक्शन टूल, टूल चोइस ऑटो, JSON उत्तर format, सोच नियंत्रण, टूल stream, तापमान, top p, do sample, max tokens, स्टॉप और स्ट्रीमिंग का समर्थन करता है।

इस नाम से भी जाना जाता है Z.ai GLM 4.6V Flash, GLM-4.6V-Flash, glm-4-6v-flash

visionvideo understandingdocument understandingfunction callingweb searchreasoning

GLM 4.6V Flash की विशेषताएं

मॉडल ID
glm-4-6v-flash
प्रदाता
Z.ai
श्रेणी
टेक्स्ट जनरेशन
रिलीज
8 दिस॰ 2025
कॉन्टेक्स्ट विंडो
128K टोकन
अधिकतम आउटपुट
32,768 टोकन
इनपुट
टेक्स्टइमेजवीडियोफ़ाइल
आउटपुट
टेक्स्ट
संरचित आउटपुट
JSON मोड
रीजन
Singapore
एंडपॉइंट
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/glm-4-6v-flash:generateContent
वैकल्पिक मॉडल ID
glm-4.6v-flashzai/glm-4.6v-flashzhipu/glm-4.6v-flash

GLM 4.6V Flash API की कीमतें

EmpirioLabs कैटलॉग से लाइव pay-as-you-go दरें। आप सिर्फ उतना ही भुगतान करते हैं जितना उपयोग करते हैं, कोई मासिक न्यूनतम नहीं।

प्रकार
स्पेक
दर
इनपुट
प्रति 1M शीघ्र टोकन
मुफ्त
उत्पादन
प्रति 1M उत्पन्न टोकन
मुफ्त
Implicit कैश पढ़ा
प्रति 1M कैश इनपुट टोकन
मुफ्त
वेब खोज
जब सक्षम
$0.033
पूरे कीमत पेज पर तुलना करें

GLM 4.6V Flash API को कैसे कॉल करें

GLM 4.6V Flash OpenAI-संगत Chat Completions API देता है। किसी भी OpenAI SDK को अपनी EmpirioLabs API key के साथ https://api.empiriolabs.ai/v1 पर सेट करें और model id glm-4-6v-flash उपयोग करें। EmpirioLabs डैशबोर्ड से API key प्राप्त करें।

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-4-6v-flash",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="glm-4-6v-flash",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
GLM 4.6V Flash API का पूरा संदर्भ

GLM 4.6V Flash API के पैरामीटर

EmpirioLabs पर GLM 4.6V Flash API द्वारा समर्थित request पैरामीटर। फ़ील्ड छोड़ने पर डिफ़ॉल्ट मान लागू होते हैं।

पैरामीटरप्रकारडिफॉल्टरेंज / मानविवरण
temperaturenumber10 से 1नमूना तापमान। कम मान अधिक नियतात्मक होते हैं। GLM-4.7-Flash र GLM-4.6V-Flash डिफॉल्टमा 1.0; GLM-4.5-फ्लैश डिफ़ॉल्ट रूप से 0.6 है।
top_pnumber0.950.01 से 1नाभिक नमूनाकरण संभाव्यता द्रव्यमान। Z.AI GLM-4.7, GLM-4.6 और GLM-4.5 श्रृंखला के लिए 0.95 डिफ़ॉल्ट दस्तावेज़ करता है।
max_tokensnumber40961 से 32768GLM-4.6V-Flash के लिए अधिकतम आउटपुट टोकन: 32768।
stoparray--शब्द सूची रोकें। Z.AI वर्तमान में सरणी रूप में एक स्टॉप स्ट्रिंग का समर्थन करता है।
do_samplebooleantrue-नमूनाकरण सक्षम करें। गलत होने पर, तापमान और top_p पीढ़ी को प्रभावित नहीं करते हैं।
enable_thinkingbooleantrue-सोच मोड Z.AI नियंत्रित करता है। सक्षम डिफ़ॉल्ट है; GLM-4.6V-Flash स्वचालित रूपमा निर्णय लिन्छ कि सक्षम हुँदा सोच्नु छ वा छैन।
thinkingobject--उन्नत सोच वस्तु। {"type":"enabled"} या {"type":"disabled"} का उपयोग करें। GLM-4.6V-Flash स्वचालित रूपमा निर्णय लिन्छ कि सक्षम हुँदा सोच्नु छ वा छैन।
toolsarray--फ़ंक्शन टूल और बिल्ट-इन web_search टूल समर्थित हैं।
tool_choiceenumautoautoनियंत्रित करता है कि मॉडल टूल का उपयोग कर सकता है या नहीं। Z.AI दस्तावेज़ ऑटो टूल चयन; टूल का उपयोग अक्षम करने के लिए टूल को छोड़ दें।
tool_streambooleanfalse-स्ट्रीम फ़ंक्शन-कॉल टूल आउटपुट जब स्ट्रीम सत्य हो। Z.AI दस्तावेज़ GLM-4.6 और नए मॉडल के लिए tool_stream हैं।
tool_web_searchbooleanfalse-अंतर्निहित वेब खोज सक्षम करें। सक्षम होने पर प्रति अनुरोध $0.033 जोड़ता है।
search_resultbooleantrue-वेब खोज सक्षम होने पर संरचित वेब खोज परिणाम मेटाडेटा लौटाएँ.
search_promptstring--पुनर्प्राप्त वेब खोज परिणामों को सारांशित करने के लिए वैकल्पिक निर्देश।
countnumber101 से 50पुनर्प्राप्त करने के लिए वेब खोज परिणामों की संख्या।
डॉक्स में 3 और पैरामीटर

जानने योग्य

बेस टोकन का उपयोग मुफ्त है। अंतर्निहित वेब खोज tool_web_search

GLM 4.6V Flash API: आम सवाल

GLM 4.6V Flash API की कीमत कितनी है?

EmpirioLabs पर GLM 4.6V Flash का बिल उपयोग के अनुसार बनता है। इस पेज की लाइव दर तालिका हमेशा API की वास्तविक बिलिंग से मेल खाती है।

GLM 4.6V Flash की context window कितनी है?

GLM 4.6V Flash 128K टोकन की context window समर्थित करता है, प्रति उत्तर अधिकतम 32,768 आउटपुट टोकन के साथ।

क्या GLM 4.6V Flash API OpenAI-संगत है?

हां। GLM 4.6V Flash OpenAI-संगत Chat Completions API देता है, इसलिए मौजूदा OpenAI SDKs base_url को https://api.empiriolabs.ai/v1 पर सेट करके और model id glm-4-6v-flash रखकर काम करते हैं।

क्या मैं इंटीग्रेट करने से पहले ब्राउज़र में GLM 4.6V Flash आज़मा सकता हूं?

हां। EmpirioLabs playground ब्राउज़र में GLM 4.6V Flash को उन्हीं पैरामीटरों के साथ चलाता है जो API देता है, ताकि आप कोड लिखने से पहले prompt आज़मा सकें।

GLM 4.6V Flash की API key कैसे मिलेगी?

EmpirioLabs खाता बनाएं, फिर डैशबोर्ड में API Keys में key जनरेट करें। बिलिंग pay-as-you-go क्रेडिट से होती है, इसलिए आप सिर्फ अपनी requests का भुगतान करते हैं।

बेहतर समापन बिंदुओं का उपयोग करने के लिए तैयार हैं?

हमारे मूल्य निर्धारण की जाँच करें या यदि आप चाहते हैं कि आपका अपना मॉडल हमारे स्टैक पर तैनात किया जाए, तो पहुंचें।