
Kimi K2.7 Code Highspeed ist die schnellere Stufe des agentischen Codingmodells von Moonshot, mit 256K-Kontext, ständiger Logik sowie Bild- und Videoeingaben.
Kimi K2.7 Code Highspeed ist die schnellere Stufe des agentischen Codingmodells von Moonshot, mit 256K-Kontext, ständiger Logik sowie Bild- und Videoeingaben.
Die schnellere Stufe des Kimi K2.7 Code. Unterstützt Text-, Bild- und Videoeingaben, Funktionsaufrufe, strukturierte Ausgabe im JSON-Modus sowie integrierte Websuche, die für $0.015 pro aufgerufenem Aufruf berechnet wird. Das Denken ist immer aktiviert und Reasoning-Tokens werden als Output-Tokens abgerechnet. Temperatur- und andere Stichprobenüberschreibungen werden ignoriert, da der Modelldienst feste Abtasteinstellungen verwendet. Mehrschrittige Funktionsaufrufe müssen die Assistentennachricht mit ihrem reasoning_content Feld erneut abspielen. Explizite Cache-Steuerungen, Batches und Feinabstimmungen werden nicht unterstützt.
Auch bekannt als Moonshot AI Kimi K2.7 Code Highspeed
kimi-k2-7-code-highspeed/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/kimi-k2-7-code-highspeed:generateContentkimi-k2.7-code-highspeedmoonshotai/kimi-k2-7-code-highspeedmoonshotai/kimi-k2.7-code-highspeedLive Pay-as-you-go-Preise aus dem EmpirioLabs-Katalog. Du zahlst nur für das, was du nutzt, ohne monatliches Minimum.
Kimi K2.7 Code Highspeed bedient die OpenAI-kompatible Chat Completions API. Richte ein beliebiges OpenAI SDK mit deinem EmpirioLabs API-Schlüssel auf https://api.empiriolabs.ai/v1 und verwende die Modell-ID kimi-k2-7-code-highspeed. Hol dir einen API-Schlüssel im EmpirioLabs Dashboard.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "kimi-k2-7-code-highspeed",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="kimi-k2-7-code-highspeed",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)Request-Parameter, die die Kimi K2.7 Code Highspeed API auf EmpirioLabs unterstützt. Standardwerte gelten, wenn ein Feld weggelassen wird.
| Parameter | Typ | Standard | Bereich / Werte | Beschreibung |
|---|---|---|---|---|
| max_tokens | number | 16384 | 1 bis 131072 | Maximale Ausgabe-Token. Reasoning-Tokens zählen zu diesem Limit. |
| stop | string | - | - | Bis zu 4 Zeichenketten, bei denen das Modell aufhört, weitere Token zu generieren. |
| tool_web_search | boolean | false | - | Suchen Sie im Internet nach Echtzeitinformationen. Fügt $0.015 die Anfragekosten für jeden aufgerufenen Websuchaufruf hinzu. |
| response_format | enum | - | - | Beschränke die Ausgabe auf JSON. Verwenden Sie den JSON-Modus für jedes gültige JSON-Objekt oder ein JSON-Schema, um eine Ausgabe zu erzwingen, die mit einem von... |
Die schnellere Stufe des Kimi K2.7 Code. Unterstützt Text-, Bild- und Videoeingaben mit 256K-Kontext, Funktionsaufruf, strukturierter Ausgabe im JSON-Modus und integrierte Websuche bei $0.015 pro aufgerufenem Aufruf. Das Denken ist immer aktiviert und kann nicht deaktiviert werden; Reasoning Tokens werden als Ausgabetoken abgerechnet. Temperatur- und andere Stichprobenüberschreibungen werden ignoriert, da der Modelldienst feste Abtasteinstellungen verwendet. Mehrschrittige Funktionsaufrufe über die API müssen die Assistant-Nachricht mit ihrem reasoning_content Feld erneut abspielen.
When this model invokes built-in tools inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts. Tool counts are already factored into cost_usd and are surfaced for transparency.
Auf EmpirioLabs wird Kimi K2.7 Code Highspeed nach Verbrauch abgerechnet: Eingabe $1.90 pro 1M Prompt-Token; Output $8.00 pro 1 Million generierter Token; Web-Suche $0.015 pro Aufruf beim Aufruf. Die Live-Preistabelle auf dieser Seite entspricht immer dem, was die API berechnet.
Kimi K2.7 Code Highspeed unterstützt ein Kontextfenster von 256K Token mit bis zu 131.072 Ausgabe-Token pro Antwort.
Ja. Kimi K2.7 Code Highspeed bedient die OpenAI-kompatible Chat Completions API. Bestehende OpenAI SDKs funktionieren, indem du base_url auf https://api.empiriolabs.ai/v1 setzt und als Modell-ID kimi-k2-7-code-highspeed verwendest.
Ja. Der EmpirioLabs Playground führt Kimi K2.7 Code Highspeed im Browser mit denselben Parametern aus, die die API bietet. So kannst du Prompts testen, bevor du Code schreibst.
Erstelle ein EmpirioLabs-Konto und generiere dann einen Schlüssel unter API Keys im Dashboard. Die Abrechnung erfolgt über Pay-as-you-go-Guthaben, du zahlst also nur für deine Requests.
Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.