Kimi K3 एपीआई

Kimi K3 मूनशॉट का प्रमुख रीजनिंग मॉडल है जिसमें 1M टोकन संदर्भ, हमेशा चालू रहने वाली सोच, मूल वेब खोज और टेक्स्ट, छवि और वीडियो इनपुट हैं।

Moonshot AIपाठ निर्माण1M कॉन्टेक्स्टरिलीज 15 जुल॰ 2026Internationalस्वामित्व वाला एंडपॉइंटनया

Kimi K3 के बारे में

Kimi K3 मूनशॉट का प्रमुख रीजनिंग मॉडल है जिसमें 1M टोकन संदर्भ, हमेशा चालू रहने वाली सोच, मूल वेब खोज और टेक्स्ट, छवि और वीडियो इनपुट हैं।

टेक्स्ट, छवि और वीडियो इनपुट, फ़ंक्शन कॉलिंग, JSON स्कीमा संरचित आउटपुट, और अंतर्निहित वेब खोज का समर्थन करता है जिसे प्रति कॉल $0.015 पर बिल किया जाता है। ट्यून करने योग्य reasoning_effort नियंत्रण (अधिकतम अनुशंसित) के साथ सोच हमेशा चालू रहती है; रीजनिंग टोकन को आउटपुट टोकन के रूप में बिल किया जाता है। तापमान और अन्य सैंपलिंग ओवरराइड मॉडल सेवा द्वारा तय किए जाते हैं। मल्टी-स्टेप फ़ंक्शन कॉलिंग को सहायक संदेश को उसके reasoning_content फ़ील्ड के साथ फिर से चलाना चाहिए। स्पष्ट कैश नियंत्रण, बैच और फाइन-ट्यूनिंग समर्थित नहीं हैं।

इस नाम से भी जाना जाता है Moonshot AI Kimi K3

reasoningfunction callingmultimodalagentic codingweb search

Kimi K3 की विशेषताएं

मॉडल ID
kimi-k3
प्रदाता
Moonshot AI
श्रेणी
पाठ निर्माण
रिलीज
15 जुल॰ 2026
कॉन्टेक्स्ट विंडो
1M टोकन
अधिकतम आउटपुट
1,31,072 टोकन
इनपुट
टेक्स्टइमेजवीडियो
आउटपुट
टेक्स्ट
संरचित आउटपुट
JSON Schema
रीजन
International
एंडपॉइंट
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/kimi-k3:generateContent
वैकल्पिक मॉडल ID
moonshotai/kimi-k3

Kimi K3 API की कीमतें

EmpirioLabs कैटलॉग से लाइव pay-as-you-go दरें। आप सिर्फ उतना ही भुगतान करते हैं जितना उपयोग करते हैं, कोई मासिक न्यूनतम नहीं।

प्रकार
स्पेक
दर
इनपुट
प्रति 1M प्रॉम्प्ट टोकन
$3.00
उत्पादन
प्रति 1M जेनरेट किए गए टोकन
$15.00
वेब खोज
प्रति कॉल जब लागू किया जाता है
$0.015
पूरे कीमत पेज पर तुलना करें

Kimi K3 API को कैसे कॉल करें

Kimi K3 OpenAI-संगत Chat Completions API देता है। किसी भी OpenAI SDK को अपनी EmpirioLabs API key के साथ https://api.empiriolabs.ai/v1 पर सेट करें और model id kimi-k3 उपयोग करें। EmpirioLabs डैशबोर्ड से API key प्राप्त करें।

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "kimi-k3",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="kimi-k3",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Kimi K3 API का पूरा संदर्भ

Kimi K3 API के पैरामीटर

EmpirioLabs पर Kimi K3 API द्वारा समर्थित request पैरामीटर। फ़ील्ड छोड़ने पर डिफ़ॉल्ट मान लागू होते हैं।

पैरामीटरप्रकारडिफॉल्टरेंज / मानविवरण
max_tokensnumber327681 से 1048576अधिकतम आउटपुट टोकन। रीजनिंग टोकन इस सीमा की ओर गिने जाते हैं।
stopstring--4 स्ट्रिंग्स तक जहां मॉडल आगे टोकन उत्पन्न करना बंद कर देगा।
reasoning_effortenummaxlow, high, maxKimi K3 तर्क प्रयास। सोच हमेशा चालू रहती है। उच्च प्रयास उत्तर देने से पहले अधिक तर्क टोकन खर्च करता है। अधिकतम की सिफारिश की जाती है और डिफ़ॉल्ट।
tool_web_searchbooleanfalse-वास्तविक समय की जानकारी के लिए वेब पर खोजें। प्रत्येक आह्वान किए गए वेब खोज कॉल के लिए अनुरोध लागत में $0.015 जोड़ता है.
response_formatenum--आउटपुट को JSON पर सीमित करें। किसी भी मान्य JSON ऑब्जेक्ट के लिए JSON मोड का उपयोग करें, या आपके द्वारा प्रदान की गई स्कीमा से मेल खाने वाले आउटपुट को बाध्य करने के...

जानने योग्य

1M टोकन संदर्भ, फ़ंक्शन कॉलिंग, JSON स्कीमा संरचित आउटपुट और $0.015 प्रति आह्वान कॉल पर अंतर्निहित वेब खोज के साथ टेक्स्ट, छवि और वीडियो इनपुट का समर्थन करता है। सोच हमेशा चालू रहती है; रीजनिंग डेप्थ reasoning_effort कंट्रोल (अधिकतम की सिफारिश की जाती है) के साथ ट्यून करने योग्य है और रीजनिंग टोकन को आउटपुट टोकन के रूप में बिल किया जाता है। तापमान और अन्य नमूना सेटिंग्स मॉडल सेवा द्वारा तय की जाती हैं। एपीआई के माध्यम से कॉल करने वाले मल्टी-स्टेप फ़ंक्शन को सहायक संदेश को उसके reasoning_content फ़ील्ड के साथ फिर से चलाना चाहिए।

Per-tool billing (usage.tool_usage)

When this model invokes built-in tools inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts. Tool counts are already factored into cost_usd and are surfaced for transparency.

Kimi K3 API: आम सवाल

Kimi K3 API की कीमत कितनी है?

EmpirioLabs पर Kimi K3 का बिल उपयोग के अनुसार बनता है: इनपुट $3.00 प्रति 1M प्रॉम्प्ट टोकन; उत्पादन $15.00 प्रति 1M जेनरेट किए गए टोकन; वेब खोज $0.015 प्रति कॉल जब लागू किया जाता है। इस पेज की लाइव दर तालिका हमेशा API की वास्तविक बिलिंग से मेल खाती है।

Kimi K3 की context window कितनी है?

Kimi K3 1M टोकन की context window समर्थित करता है, प्रति उत्तर अधिकतम 1,31,072 आउटपुट टोकन के साथ।

क्या Kimi K3 API OpenAI-संगत है?

हां। Kimi K3 OpenAI-संगत Chat Completions API देता है, इसलिए मौजूदा OpenAI SDKs base_url को https://api.empiriolabs.ai/v1 पर सेट करके और model id kimi-k3 रखकर काम करते हैं।

क्या मैं इंटीग्रेट करने से पहले ब्राउज़र में Kimi K3 आज़मा सकता हूं?

हां। EmpirioLabs playground ब्राउज़र में Kimi K3 को उन्हीं पैरामीटरों के साथ चलाता है जो API देता है, ताकि आप कोड लिखने से पहले prompt आज़मा सकें।

Kimi K3 की API key कैसे मिलेगी?

EmpirioLabs खाता बनाएं, फिर डैशबोर्ड में API Keys में key जनरेट करें। बिलिंग pay-as-you-go क्रेडिट से होती है, इसलिए आप सिर्फ अपनी requests का भुगतान करते हैं।

बेहतर समापन बिंदुओं का उपयोग करने के लिए तैयार हैं?

हमारे मूल्य निर्धारण की जाँच करें या यदि आप चाहते हैं कि आपका अपना मॉडल हमारे स्टैक पर तैनात किया जाए, तो पहुंचें।