Kimi K3 API

Kimi K3 ist Moonshots Flaggschiff-Logikmodell mit einem 1-Millionen-Token-Kontext, ständigem Denken, nativer Websuche sowie Text-, Bild- und Videoeingaben.

Moonshot AITextgenerierung1M KontextVeröffentlicht 15. Juli 2026InternationalProprietärer EndpointNeu

Über Kimi K3

Kimi K3 ist Moonshots Flaggschiff-Logikmodell mit einem 1-Millionen-Token-Kontext, ständigem Denken, nativer Websuche sowie Text-, Bild- und Videoeingaben.

Unterstützt Text-, Bild- und Videoeingaben, Funktionsaufrufe, JSON-Schema-strukturierte Ausgabe und integrierte Websuche, die pro aufgerufenem Aufruf $0.015 berechnet wird. Das Denken ist immer aktiviert mit einer verstellbaren reasoning_effort Steuerung (maximal empfohlen); Reasoning Tokens werden als Ausgabetoken abgerechnet. Temperatur- und andere Probenahme-Übersteuerungen werden vom Modellservice festgelegt. Mehrschrittige Funktionsaufrufe müssen die Assistentennachricht mit ihrem reasoning_content Feld erneut abspielen. Explizite Cache-Steuerungen, Batches und Feinabstimmungen werden nicht unterstützt.

Auch bekannt als Moonshot AI Kimi K3

reasoningfunction callingmultimodalagentic codingweb search

Kimi K3 Spezifikationen

Modell-ID
kimi-k3
Anbieter
Moonshot AI
Kategorie
Textgenerierung
Veröffentlicht
15. Juli 2026
Kontextfenster
1M Token
Max. Ausgabe
131.072 Token
Eingabe
TextBildVideo
Ausgabe
Text
Strukturierte Ausgabe
JSON Schema
Region
International
Endpoints
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/kimi-k3:generateContent
Alternative Modell-IDs
moonshotai/kimi-k3

Kimi K3 API-Preise

Live Pay-as-you-go-Preise aus dem EmpirioLabs-Katalog. Du zahlst nur für das, was du nutzt, ohne monatliches Minimum.

Typ
Spezifikation
Preis
Eingabe
pro 1M Prompt-Token
$3.00
Ausgabe
pro 1 Million generierter Token
$15.00
Web-Suche
pro Aufruf beim Aufruf
$0.015
Auf der vollständigen Preisseite vergleichen

So rufst du die Kimi K3 API auf

Kimi K3 bedient die OpenAI-kompatible Chat Completions API. Richte ein beliebiges OpenAI SDK mit deinem EmpirioLabs API-Schlüssel auf https://api.empiriolabs.ai/v1 und verwende die Modell-ID kimi-k3. Hol dir einen API-Schlüssel im EmpirioLabs Dashboard.

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "kimi-k3",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="kimi-k3",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Vollständige Kimi K3 API-Referenz

Kimi K3 API-Parameter

Request-Parameter, die die Kimi K3 API auf EmpirioLabs unterstützt. Standardwerte gelten, wenn ein Feld weggelassen wird.

ParameterTypStandardBereich / WerteBeschreibung
max_tokensnumber327681 bis 1048576Maximale Ausgabe-Token. Reasoning-Tokens zählen zu diesem Limit.
stopstring--Bis zu 4 Zeichenketten, bei denen das Modell aufhört, weitere Token zu generieren.
reasoning_effortenummaxlow, high, maxKimi K3 Argumentationsarbeit. Denken ist immer an. Höherer Einsatz gibt mehr Argumentationstoken aus, bevor man antwortet. Max wird empfohlen und ist der Standard.
tool_web_searchbooleanfalse-Suchen Sie im Internet nach Echtzeitinformationen. Fügt $0.015 die Anfragekosten für jeden aufgerufenen Websuchaufruf hinzu.
response_formatenum--Beschränke die Ausgabe auf JSON. Verwenden Sie den JSON-Modus für jedes gültige JSON-Objekt oder ein JSON-Schema, um eine Ausgabe zu erzwingen, die mit einem von...

Gut zu wissen

Unterstützt Text-, Bild- und Videoeingaben mit einem 1M Token-Kontext, Funktionsaufrufe, JSON-Schema-strukturierte Ausgabe und integrierte Websuche bei $0.015 pro aufgerufenem Aufruf. Das Denken ist immer an; Die Rationalisierungstiefe ist mit der reasoning_effort-Steuerung (maximal empfohlen) einstellbar und Reasoning-Tokens werden als Ausgabe-Token abgerechnet. Temperatur- und andere Probenahmeeinstellungen werden vom Modellservice festgelegt. Mehrschrittige Funktionsaufrufe über die API müssen die Assistant-Nachricht mit ihrem reasoning_content Feld erneut abspielen.

Per-tool billing (usage.tool_usage)

When this model invokes built-in tools inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts. Tool counts are already factored into cost_usd and are surfaced for transparency.

Kimi K3 API: häufige Fragen

Wie viel kostet die Kimi K3 API?

Auf EmpirioLabs wird Kimi K3 nach Verbrauch abgerechnet: Eingabe $3.00 pro 1M Prompt-Token; Output $15.00 pro 1 Million generierter Token; Web-Suche $0.015 pro Aufruf beim Aufruf. Die Live-Preistabelle auf dieser Seite entspricht immer dem, was die API berechnet.

Wie groß ist das Kontextfenster von Kimi K3?

Kimi K3 unterstützt ein Kontextfenster von 1M Token mit bis zu 131.072 Ausgabe-Token pro Antwort.

Ist die Kimi K3 API OpenAI-kompatibel?

Ja. Kimi K3 bedient die OpenAI-kompatible Chat Completions API. Bestehende OpenAI SDKs funktionieren, indem du base_url auf https://api.empiriolabs.ai/v1 setzt und als Modell-ID kimi-k3 verwendest.

Kann ich Kimi K3 im Browser testen, bevor ich integriere?

Ja. Der EmpirioLabs Playground führt Kimi K3 im Browser mit denselben Parametern aus, die die API bietet. So kannst du Prompts testen, bevor du Code schreibst.

Wie bekomme ich einen Kimi K3 API-Schlüssel?

Erstelle ein EmpirioLabs-Konto und generiere dann einen Schlüssel unter API Keys im Dashboard. Die Abrechnung erfolgt über Pay-as-you-go-Guthaben, du zahlst also nur für deine Requests.

Bereit, bessere Endpunkte zu nutzen?

Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.