Accueil Blog

Comment utiliser l’API Kimi K3

Kimi K3 via API sur EmpirioLabs

Jul 16, 2026

EmpirioLabs AI

Le Kimi K3 est disponible sur EmpirioLabs. C’est le modèle phare de raisonnement de Moonshot AI, conçu pour l’ingénierie logicielle, le raisonnement approfondi et le travail de connaissance, avec une fenêtre de contexte de 1 million de jetons, une pensée toujours active, une recherche web native, ainsi que des entrées de texte, d’images et de vidéos. Il fonctionne sur une API compatible OpenAI, donc vous pouvez passer à elle en changeant un champ.

Ce que Kimi K3 fait bien

Kimi K3 raisonne avant de répondre à chaque demande, il est donc solide sur les problèmes en plusieurs étapes: comprendre une grande base de code, planifier et exécuter de longues tâches d’agent, et résoudre des questions analytiques difficiles. Il appelle des outils avec un appel de fonction standard, retourne du JSON strict à la demande, lit des images et des vidéos, et peut effectuer des recherches natives sur le web, donc un seul point de terminaison couvre les assistants de codage, les agents autonomes et l’analyse multimodale.

Comment l’appeler

Envoyez une compilation de chat standard. La réflexion est toujours active, donc une réponse réfléchie ne nécessite pas de mise en place supplémentaire:

curl https://api.empiriolabs.ai/v1/chat/completions \ -H « Autorisation: Porteur $EMPIRIOLABS_API_KEY » \ -H « Type-Contenu: application/json » \ -d '{ « modèle »: « kimi-k3 », « messages »: [ {"rôle »: « utilisateur », « contenu »: « Refactorisez cette fonction et expliquez le changement."} ] }'

La réponse renvoie la réponse finale dans Contenu et la réflexion du modèle dans raisonnement contenu.

Ajustez l’effort de raisonnement

La réflexion est toujours activée, et vous pouvez définir à quel point le modèle raisonne avec raisonnement effort: faible, moyen, élevé ou max. Max est le modèle par défaut et recommandé pour le codage et l’analyse complexes:

{ « modèle »: « kimi-k3 », « messages »: [{"role »: « utilisateur », « contenu »: « Concevez un limiteur de fréquence et justifie les compromis."}], « reasoning_effort »: « max » }

Recherche Web

Jeu tool_web_search vrai, et Kimi K3 cherchera sur le web des informations actuelles et citera ses sources dans la réponse. Une seule requête peut effectuer plusieurs recherches lorsque le modèle en a besoin:

{ « modèle »: « kimi-k3 », « messages »: [{"rôle »: « utilisateur », « contenu »: « Qu’est-ce qui a changé dans la dernière version Python ?"}], « tool_web_search »: vrai }

Images et vidéo

Kimi K3 lit des images et des vidéos. Faites-les passer comme parties de contenu dans un message utilisateur en même temps que votre texte, puis posez une question sur ce qu’elles affichent.

Sortie structurée

Utilisation response_format pour contraindre la sortie. Le mode JSON renvoie tout objet JSON valide, et le schéma JSON force une sortie qui correspond à un schéma que vous fournissez, ce qui est utile pour l’extraction et les pipelines d’outils.

Prix

Kimi K3 est pay-in à l’usage, facturé par jeton, et la recherche web est un petit frais par appel uniquement lorsqu’il fonctionne. Voir les tarifs en direct sur le Page modèle Kimi K3 et les page de prix, et essaie dans le aire de jeux.

Prêt à utiliser de meilleurs points de terminaison ?

Explorez nos modèles, ou contactez-nous pour toute demande d’entreprise, des déploiements personnalisés ou pour tout autre sujet.