
Kimi K3 ist Moonshots Flaggschiff-Logikmodell mit einem 1-Millionen-Token-Kontext, ständigem Denken, nativer Websuche sowie Text-, Bild- und Videoeingaben.
Kimi K3 ist Moonshots Flaggschiff-Logikmodell mit einem 1-Millionen-Token-Kontext, ständigem Denken, nativer Websuche sowie Text-, Bild- und Videoeingaben.
Unterstützt Text-, Bild- und Videoeingaben, Funktionsaufrufe, JSON-Schema-strukturierte Ausgabe und integrierte Websuche, die pro aufgerufenem Aufruf $0.015 berechnet wird. Das Denken ist immer aktiviert mit einer verstellbaren reasoning_effort Steuerung (maximal empfohlen); Reasoning Tokens werden als Ausgabetoken abgerechnet. Temperatur- und andere Probenahme-Übersteuerungen werden vom Modellservice festgelegt. Mehrschrittige Funktionsaufrufe müssen die Assistentennachricht mit ihrem reasoning_content Feld erneut abspielen. Explizite Cache-Steuerungen, Batches und Feinabstimmungen werden nicht unterstützt.
Auch bekannt als Moonshot AI Kimi K3
kimi-k3/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/kimi-k3:generateContentmoonshotai/kimi-k3Live Pay-as-you-go-Preise aus dem EmpirioLabs-Katalog. Du zahlst nur für das, was du nutzt, ohne monatliches Minimum.
Kimi K3 bedient die OpenAI-kompatible Chat Completions API. Richte ein beliebiges OpenAI SDK mit deinem EmpirioLabs API-Schlüssel auf https://api.empiriolabs.ai/v1 und verwende die Modell-ID kimi-k3. Hol dir einen API-Schlüssel im EmpirioLabs Dashboard.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "kimi-k3",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="kimi-k3",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)Request-Parameter, die die Kimi K3 API auf EmpirioLabs unterstützt. Standardwerte gelten, wenn ein Feld weggelassen wird.
| Parameter | Typ | Standard | Bereich / Werte | Beschreibung |
|---|---|---|---|---|
| max_tokens | number | 32768 | 1 bis 1048576 | Maximale Ausgabe-Token. Reasoning-Tokens zählen zu diesem Limit. |
| stop | string | - | - | Bis zu 4 Zeichenketten, bei denen das Modell aufhört, weitere Token zu generieren. |
| reasoning_effort | enum | max | low, high, max | Kimi K3 Argumentationsarbeit. Denken ist immer an. Höherer Einsatz gibt mehr Argumentationstoken aus, bevor man antwortet. Max wird empfohlen und ist der Standard. |
| tool_web_search | boolean | false | - | Suchen Sie im Internet nach Echtzeitinformationen. Fügt $0.015 die Anfragekosten für jeden aufgerufenen Websuchaufruf hinzu. |
| response_format | enum | - | - | Beschränke die Ausgabe auf JSON. Verwenden Sie den JSON-Modus für jedes gültige JSON-Objekt oder ein JSON-Schema, um eine Ausgabe zu erzwingen, die mit einem von... |
Unterstützt Text-, Bild- und Videoeingaben mit einem 1M Token-Kontext, Funktionsaufrufe, JSON-Schema-strukturierte Ausgabe und integrierte Websuche bei $0.015 pro aufgerufenem Aufruf. Das Denken ist immer an; Die Rationalisierungstiefe ist mit der reasoning_effort-Steuerung (maximal empfohlen) einstellbar und Reasoning-Tokens werden als Ausgabe-Token abgerechnet. Temperatur- und andere Probenahmeeinstellungen werden vom Modellservice festgelegt. Mehrschrittige Funktionsaufrufe über die API müssen die Assistant-Nachricht mit ihrem reasoning_content Feld erneut abspielen.
When this model invokes built-in tools inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts. Tool counts are already factored into cost_usd and are surfaced for transparency.
Auf EmpirioLabs wird Kimi K3 nach Verbrauch abgerechnet: Eingabe $3.00 pro 1M Prompt-Token; Output $15.00 pro 1 Million generierter Token; Web-Suche $0.015 pro Aufruf beim Aufruf. Die Live-Preistabelle auf dieser Seite entspricht immer dem, was die API berechnet.
Kimi K3 unterstützt ein Kontextfenster von 1M Token mit bis zu 131.072 Ausgabe-Token pro Antwort.
Ja. Kimi K3 bedient die OpenAI-kompatible Chat Completions API. Bestehende OpenAI SDKs funktionieren, indem du base_url auf https://api.empiriolabs.ai/v1 setzt und als Modell-ID kimi-k3 verwendest.
Ja. Der EmpirioLabs Playground führt Kimi K3 im Browser mit denselben Parametern aus, die die API bietet. So kannst du Prompts testen, bevor du Code schreibst.
Erstelle ein EmpirioLabs-Konto und generiere dann einen Schlüssel unter API Keys im Dashboard. Die Abrechnung erfolgt über Pay-as-you-go-Guthaben, du zahlst also nur für deine Requests.
Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.