
Kimi K3 मूनशॉट का प्रमुख रीजनिंग मॉडल है जिसमें 1M टोकन संदर्भ, हमेशा चालू रहने वाली सोच, मूल वेब खोज और टेक्स्ट, छवि और वीडियो इनपुट हैं।
Kimi K3 मूनशॉट का प्रमुख रीजनिंग मॉडल है जिसमें 1M टोकन संदर्भ, हमेशा चालू रहने वाली सोच, मूल वेब खोज और टेक्स्ट, छवि और वीडियो इनपुट हैं।
टेक्स्ट, छवि और वीडियो इनपुट, फ़ंक्शन कॉलिंग, JSON स्कीमा संरचित आउटपुट, और अंतर्निहित वेब खोज का समर्थन करता है जिसे प्रति कॉल $0.015 पर बिल किया जाता है। ट्यून करने योग्य reasoning_effort नियंत्रण (अधिकतम अनुशंसित) के साथ सोच हमेशा चालू रहती है; रीजनिंग टोकन को आउटपुट टोकन के रूप में बिल किया जाता है। तापमान और अन्य सैंपलिंग ओवरराइड मॉडल सेवा द्वारा तय किए जाते हैं। मल्टी-स्टेप फ़ंक्शन कॉलिंग को सहायक संदेश को उसके reasoning_content फ़ील्ड के साथ फिर से चलाना चाहिए। स्पष्ट कैश नियंत्रण, बैच और फाइन-ट्यूनिंग समर्थित नहीं हैं।
इस नाम से भी जाना जाता है Moonshot AI Kimi K3
kimi-k3/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/kimi-k3:generateContentmoonshotai/kimi-k3EmpirioLabs कैटलॉग से लाइव pay-as-you-go दरें। आप सिर्फ उतना ही भुगतान करते हैं जितना उपयोग करते हैं, कोई मासिक न्यूनतम नहीं।
Kimi K3 OpenAI-संगत Chat Completions API देता है। किसी भी OpenAI SDK को अपनी EmpirioLabs API key के साथ https://api.empiriolabs.ai/v1 पर सेट करें और model id kimi-k3 उपयोग करें। EmpirioLabs डैशबोर्ड से API key प्राप्त करें।
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "kimi-k3",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="kimi-k3",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)EmpirioLabs पर Kimi K3 API द्वारा समर्थित request पैरामीटर। फ़ील्ड छोड़ने पर डिफ़ॉल्ट मान लागू होते हैं।
| पैरामीटर | प्रकार | डिफॉल्ट | रेंज / मान | विवरण |
|---|---|---|---|---|
| max_tokens | number | 32768 | 1 से 1048576 | अधिकतम आउटपुट टोकन। रीजनिंग टोकन इस सीमा की ओर गिने जाते हैं। |
| stop | string | - | - | 4 स्ट्रिंग्स तक जहां मॉडल आगे टोकन उत्पन्न करना बंद कर देगा। |
| reasoning_effort | enum | max | low, high, max | Kimi K3 तर्क प्रयास। सोच हमेशा चालू रहती है। उच्च प्रयास उत्तर देने से पहले अधिक तर्क टोकन खर्च करता है। अधिकतम की सिफारिश की जाती है और डिफ़ॉल्ट। |
| tool_web_search | boolean | false | - | वास्तविक समय की जानकारी के लिए वेब पर खोजें। प्रत्येक आह्वान किए गए वेब खोज कॉल के लिए अनुरोध लागत में $0.015 जोड़ता है. |
| response_format | enum | - | - | आउटपुट को JSON पर सीमित करें। किसी भी मान्य JSON ऑब्जेक्ट के लिए JSON मोड का उपयोग करें, या आपके द्वारा प्रदान की गई स्कीमा से मेल खाने वाले आउटपुट को बाध्य करने के... |
1M टोकन संदर्भ, फ़ंक्शन कॉलिंग, JSON स्कीमा संरचित आउटपुट और $0.015 प्रति आह्वान कॉल पर अंतर्निहित वेब खोज के साथ टेक्स्ट, छवि और वीडियो इनपुट का समर्थन करता है। सोच हमेशा चालू रहती है; रीजनिंग डेप्थ reasoning_effort कंट्रोल (अधिकतम की सिफारिश की जाती है) के साथ ट्यून करने योग्य है और रीजनिंग टोकन को आउटपुट टोकन के रूप में बिल किया जाता है। तापमान और अन्य नमूना सेटिंग्स मॉडल सेवा द्वारा तय की जाती हैं। एपीआई के माध्यम से कॉल करने वाले मल्टी-स्टेप फ़ंक्शन को सहायक संदेश को उसके reasoning_content फ़ील्ड के साथ फिर से चलाना चाहिए।
When this model invokes built-in tools inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts. Tool counts are already factored into cost_usd and are surfaced for transparency.
EmpirioLabs पर Kimi K3 का बिल उपयोग के अनुसार बनता है: इनपुट $3.00 प्रति 1M प्रॉम्प्ट टोकन; उत्पादन $15.00 प्रति 1M जेनरेट किए गए टोकन; वेब खोज $0.015 प्रति कॉल जब लागू किया जाता है। इस पेज की लाइव दर तालिका हमेशा API की वास्तविक बिलिंग से मेल खाती है।
Kimi K3 1M टोकन की context window समर्थित करता है, प्रति उत्तर अधिकतम 1,31,072 आउटपुट टोकन के साथ।
हां। Kimi K3 OpenAI-संगत Chat Completions API देता है, इसलिए मौजूदा OpenAI SDKs base_url को https://api.empiriolabs.ai/v1 पर सेट करके और model id kimi-k3 रखकर काम करते हैं।
हां। EmpirioLabs playground ब्राउज़र में Kimi K3 को उन्हीं पैरामीटरों के साथ चलाता है जो API देता है, ताकि आप कोड लिखने से पहले prompt आज़मा सकें।
EmpirioLabs खाता बनाएं, फिर डैशबोर्ड में API Keys में key जनरेट करें। बिलिंग pay-as-you-go क्रेडिट से होती है, इसलिए आप सिर्फ अपनी requests का भुगतान करते हैं।
हमारे मूल्य निर्धारण की जाँच करें या यदि आप चाहते हैं कि आपका अपना मॉडल हमारे स्टैक पर तैनात किया जाए, तो पहुंचें।