La série MiMo V2.6 de Xiaomi est disponible sur EmpirioLabs. Trois modèles sont livrés ensemble, et les trois partagent la même forme: une fenêtre de contexte de 1 048 576 jetons, une compréhension native d’images, de vidéos et d’audio avec sortie texte, raisonnement par défaut, appel de fonction, et sortie JSON structurée jusqu’à 131 072 jetons de sortie.
Les trois modèles
mimo-v2-6-proest le modèle phare à un billion de paramètres, conçu pour les flux de travail agents, les tâches à long terme et la recherche.mimo-v2-6-flashest le membre à faible coût, destiné aux appels à haute fréquence et au travail en série à grande échelle.mimo-v2-6-pro-ultraspeedpropose la même qualité phare à une vitesse de sortie nettement supérieure, pour un travail sensible à la latence.
Ce que font les modèles
Les trois lisent le texte, les images, la vidéo et l’audio dans la même requête et répondent par texte, vous pouvez donc envoyer une capture d’écran, un court extrait et une note vocale accompagnée d’une invite. La réflexion est activée par défaut et peut être désactivée par requête. L’appel de fonction et les deux modes JSON fonctionnent sur la surface standard de complétion de chat: un response_format de type json_object pour tout objet JSON, ou un strict json_schema Quand vous avez besoin d’une forme de réponse exacte.
Les trois peuvent rechercher sur le web et retrouver une section Sources avec la réponse: MiMo V2.6 Pro et MiMo V2.6 Flash avec recherche web native, et MiMo V2.6 Pro UltraSpeed avec une recherche web Linkup optionnelle.
Comment appeler MiMo V2.6
Utilisez le point de terminaison de complétions de chat compatible OpenAI et définissez modèle À l’ID que vous souhaitez. Les parties image, vidéo et audio utilisent les blocs de contenu standards:
curl https://api.empiriolabs.ai/v1/chat/completions \ -H 'Autorisation: Porteur $EMPIRIOLABS_API_KEY' \ -H 'Type-Contenu: application/json' \ -d '{ « modèle »: « mimo-v2-6-pro », « enable_thinking »: true, « messages »: [ { « role »: « user », « content »: [ {"type »: « text », « text »: « Que montre ce graphique ? Réponse en deux phrases."}, {"type »: « image_url », « image_url »: {"url »: « https://example.com/chart.png"}} ] } ] }'
Notes opérationnelles
- Les images très petites sont rejetées. Une image test de 14 pixels carrés revient comme une erreur générique de requête invalide qui ne mentionne pas la taille, tandis que la même requête avec un carré de 64 pixels réussit. Envoyez les icônes et échantillons à une résolution raisonnable plutôt qu’à leur taille native.
- La recherche web utilise un contrôle différent sur UltraSpeed. Prise Flash MiMo V2.6 Pro et MiMo V2.6
tool_web_search; Le MiMo V2.6 Pro UltraSpeed prendweb_search_linkup. Lorsque vous déplacez une requête entre modèles, envoyez le drapeau que ce modèle accepte. - Le raisonnement est activé par défaut et les jetons de raisonnement sont facturés comme jetons de sortie. Turn
considérerÉteint pour des réponses courtes, sensibles à la latence. - La sortie est plafonnée à 131 072 jetons. Demander plus de jetons renvoie une erreur indiquant la limite.
Prix
L’utilisation du token est facturée à un taux d’entrée publié et un débit de sortie publiés par modèle, sans débit d’entrée cache séparé. La recherche web ajoute un petit frais par appel uniquement lorsqu’une recherche est effectivement exécutée, et la recherche native sur MiMo V2.6 Pro et MiMo V2.6 Flash peut effectuer plus d’une recherche par requête. Voir le live page modèle et page de prix pour les tarifs actuels.
Commencez à construire
Essayez la série dans le Terrain de jeu, lire Documentation API, ou comparer avec d’autres modèles dans le Catalogue de modèles.
Divulgation: Cet article a été rédigé avec l'aide d'AI et examiné par EmpirioLabs AI.



