Kimi K2.6 API

Kimi K2.6 est un modèle de raisonnement multimodal Moonshot avec un contexte 256K, un codage fort, ainsi que des entrées texte, image et vidéo.

Moonshot AIGénération de texte256K contextePublié 20 avr. 2026ChinaEndpoint propriétaire

À propos de Kimi K2.6

Kimi K2.6 est un modèle de raisonnement multimodal Moonshot avec un contexte 256K, un codage fort, ainsi que des entrées texte, image et vidéo.

Prend en charge les entrées texte, image et vidéo, le mode pensée activé par défaut, l’appel de fonctions et la mise en cache automatique des invites. La recherche web, la sortie structurée, les lots et le fine-tuning ne sont pas pris en charge.

Aussi connu sous le nom Moonshot AI Kimi K2.6, Kimi-K2.6, kimi-k2-6

reasoningfunction callingcachemultimodal

Caractéristiques de Kimi K2.6

ID du modèle
kimi-k2-6
Fournisseur
Moonshot AI
Catégorie
Génération de texte
Publié
20 avr. 2026
Fenêtre de contexte
256K tokens
Sortie max
16 000 tokens
Entrée
TexteImageVidéo
Sortie
Texte
Sortie structurée
JSON Schema
Région
China
Endpoints
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/kimi-k2-6:generateContent

Tarifs de l'API Kimi K2.6Économisez jusqu'à 7%

Tarifs à l'usage en direct du catalogue EmpirioLabs. Vous ne payez que ce que vous utilisez, sans minimum mensuel.

Type
Spéc.
Tarif
Entrée
par jetons 1M
$0.95$0.8939
Produit
par jeton généré 1M
$4.00$3.7131
cache implicite lu
par jetons d'entrée en cache 1M
$0.1788
Web Search (Linkup)
per call when invoked
$0.013
Comparer sur la page complète des tarifs

Comment appeler l'API Kimi K2.6

Kimi K2.6 sert l'API Chat Completions compatible OpenAI. Pointez n'importe quel SDK OpenAI vers https://api.empiriolabs.ai/v1 avec votre clé API EmpirioLabs et utilisez l'id de modèle kimi-k2-6. Obtenez une clé API depuis le tableau de bord EmpirioLabs.

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "kimi-k2-6",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="kimi-k2-6",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Référence complète de l'API Kimi K2.6

Paramètres de l'API Kimi K2.6

Paramètres de requête pris en charge par l'API Kimi K2.6 sur EmpirioLabs. Les valeurs par défaut s'appliquent quand un champ est omis.

ParamètreTypePar défautPlage / valeursDescription
temperaturenumber0.70 à 2Température d’échantillonnage. 0 = déterministe, 2 = aléatoire maximal.
top_pnumber0.90 à 1Probabilité d’échantillonnage du noyau, masse. Des valeurs plus basses rendent les sorties plus ciblées.
max_tokensnumber40961 à 16000Jetons de sortie maximum.
stopstring--Jusqu’à 4 chaînes où le modèle cesse de générer d’autres jetons.
enable_thinkingbooleantrue-Activez le raisonnement avant de répondre.
thinking_budgetnumber327681 à 81920Le maximum de jetons est réservé pour le raisonnement lorsque la pensée est activée.
reasoning_effortenummediumnone, low, medium, high, maxNiveau d’effort de raisonnement. Aucun ne décourage la pensée. budgets de pensée limités faible, moyen, élevé et maximal adaptés au modèle sélectionné. Envoyé sous...
response_formatenum--Limitez la sortie au JSON. Utilisez le mode JSON pour tout objet JSON valide, ou un schéma JSON pour forcer une sortie correspondant à un schéma que vous fournissez.
web_search_linkupbooleanfalse-Recherche web optionnelle propulsée par Linkup. Lorsqu’activées, les sources web récentes sont récupérées en utilisant votre dernier message utilisateur comme requête et fournies au modèle comme contexte supplémentaire. Ajoute $0.013 par appel lorsqu’il est invoqué en plus du coût normal du jeton du modèle. Désactivé par défaut.
disable_formattingbooleanfalse-Une fois activée, la passerelle n’ajoutera pas le pied de page « Sources » aux réponses des assistants ayant utilisé la recherche web Linkup. Utile lorsque la sortie...

API Kimi K2.6 : questions fréquentes

Combien coûte l'API Kimi K2.6 ?

Sur EmpirioLabs, Kimi K2.6 est facturé à l'usage. La grille tarifaire en direct de cette page correspond toujours à ce que l'API facture.

Quelle est la fenêtre de contexte de Kimi K2.6 ?

Kimi K2.6 prend en charge une fenêtre de contexte de 256K tokens avec jusqu'à 16 000 tokens de sortie par réponse.

L'API Kimi K2.6 est-elle compatible OpenAI ?

Oui. Kimi K2.6 sert l'API Chat Completions compatible OpenAI : les SDKs OpenAI existants fonctionnent en pointant base_url vers https://api.empiriolabs.ai/v1 et en utilisant l'id de modèle kimi-k2-6.

Puis-je essayer Kimi K2.6 dans le navigateur avant d'intégrer ?

Oui. Le playground EmpirioLabs exécute Kimi K2.6 dans le navigateur avec les mêmes paramètres que l'API expose, pour tester vos prompts avant d'écrire du code.

Comment obtenir une clé API Kimi K2.6 ?

Créez un compte EmpirioLabs, puis générez une clé sous API Keys dans le tableau de bord. La facturation utilise des crédits à l'usage : vous ne payez que vos requêtes.

Prêt à utiliser de meilleurs points de terminaison ?

Consultez nos tarifs ou contactez-nous si vous souhaitez que votre propre modèle soit déployé sur notre stack.