Le Kimi K3 est disponible sur EmpirioLabs. C’est le modèle phare de raisonnement de Moonshot AI, conçu pour l’ingénierie logicielle, le raisonnement approfondi et le travail de connaissance, avec une fenêtre de contexte de 1 million de jetons, une pensée toujours active, une recherche web native, ainsi que des entrées de texte, d’images et de vidéos. Il fonctionne sur une API compatible OpenAI, donc vous pouvez passer à elle en changeant un champ.
Ce que Kimi K3 fait bien
Kimi K3 raisonne avant de répondre à chaque demande, il est donc solide sur les problèmes en plusieurs étapes: comprendre une grande base de code, planifier et exécuter de longues tâches d’agent, et résoudre des questions analytiques difficiles. Il appelle des outils avec un appel de fonction standard, retourne du JSON strict à la demande, lit des images et des vidéos, et peut effectuer des recherches natives sur le web, donc un seul point de terminaison couvre les assistants de codage, les agents autonomes et l’analyse multimodale.
Comment l’appeler
Envoyez une compilation de chat standard. La réflexion est toujours active, donc une réponse réfléchie ne nécessite pas de mise en place supplémentaire:
curl https://api.empiriolabs.ai/v1/chat/completions \ -H « Autorisation: Porteur $EMPIRIOLABS_API_KEY » \ -H « Type-Contenu: application/json » \ -d '{ « modèle »: « kimi-k3 », « messages »: [ {"rôle »: « utilisateur », « contenu »: « Refactorisez cette fonction et expliquez le changement."} ] }'
La réponse renvoie la réponse finale dans Contenu et la réflexion du modèle dans raisonnement contenu.
Ajustez l’effort de raisonnement
La réflexion est toujours activée, et vous pouvez définir à quel point le modèle raisonne avec raisonnement effort: faible, moyen, élevé ou max. Max est le modèle par défaut et recommandé pour le codage et l’analyse complexes:
{ « modèle »: « kimi-k3 », « messages »: [{"role »: « utilisateur », « contenu »: « Concevez un limiteur de fréquence et justifie les compromis."}], « reasoning_effort »: « max » }
Recherche Web
Jeu tool_web_search vrai, et Kimi K3 cherchera sur le web des informations actuelles et citera ses sources dans la réponse. Une seule requête peut effectuer plusieurs recherches lorsque le modèle en a besoin:
{ « modèle »: « kimi-k3 », « messages »: [{"rôle »: « utilisateur », « contenu »: « Qu’est-ce qui a changé dans la dernière version Python ?"}], « tool_web_search »: vrai }
Images et vidéo
Kimi K3 lit des images et des vidéos. Faites-les passer comme parties de contenu dans un message utilisateur en même temps que votre texte, puis posez une question sur ce qu’elles affichent.
Sortie structurée
Utilisation response_format pour contraindre la sortie. Le mode JSON renvoie tout objet JSON valide, et le schéma JSON force une sortie qui correspond à un schéma que vous fournissez, ce qui est utile pour l’extraction et les pipelines d’outils.
Prix
Kimi K3 est pay-in à l’usage, facturé par jeton, et la recherche web est un petit frais par appel uniquement lorsqu’il fonctionne. Voir les tarifs en direct sur le Page modèle Kimi K3 et les page de prix, et essaie dans le aire de jeux.



