
MiniMax M3 est un modèle de raisonnement multimodal pour le codage, les agents et l'analyse de long-contexte avec entrée texte, image et vidéo.
MiniMax M3 est un modèle de raisonnement multimodal pour le codage, les agents et l'analyse de long-contexte avec entrée texte, image et vidéo.
Prend en charge les entrées texte, image et vidéo, la pensée adaptative par l'activation pense, l'appel de fonction et la lecture implicite du cache. La tarification est échelonnée par des jetons rapides, y compris les hits de cache: <=512K utilise le niveau standard actualisé, tandis que >512K utilise le niveau de contexte élevé. Les jetons de pensée sont facturés comme jetons de sortie. La recherche Web Linkup est disponible via web_search_linkup et ajoute $0.013 par recherche réussie.
Aussi connu sous le nom MiniMax-M3
minimax-m3/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/minimax-m3:generateContentminimax-m3-standardminimax/m3minimax/m3-standardTarifs à l'usage en direct du catalogue EmpirioLabs. Vous ne payez que ce que vous utilisez, sans minimum mensuel.
MiniMax M3 sert l'API Chat Completions compatible OpenAI. Pointez n'importe quel SDK OpenAI vers https://api.empiriolabs.ai/v1 avec votre clé API EmpirioLabs et utilisez l'id de modèle minimax-m3. Obtenez une clé API depuis le tableau de bord EmpirioLabs.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "minimax-m3",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="minimax-m3",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)Paramètres de requête pris en charge par l'API MiniMax M3 sur EmpirioLabs. Les valeurs par défaut s'appliquent quand un champ est omis.
| Paramètre | Type | Par défaut | Plage / valeurs | Description |
|---|---|---|---|---|
| temperature | number | 1 | 0 à 2 | Contrôle l’aléatoire. Les valeurs inférieures sont plus déterministes; Les valeurs plus élevées sont plus exploratoires. |
| top_p | number | 0.95 | 0 à 1 | Contrôle l’échantillonnage du noyau en limitant la génération à la masse token la plus probable. |
| max_completion_tokens | integer | 4096 | 1 à 524288 | Maximum de jetons générés, y compris les jetons de raisonnement lorsque la réflexion est activée. |
| stop | array | - | - | Séquence d’arrêts optionnelle ou liste de séquences d’arrêts. |
| enable_thinking | boolean | true | - | Activez la pensée modélistique adaptative avant de répondre. Réglez false pour demander une réponse directe sans phase de raisonnement. |
| web_search_linkup | boolean | false | - | Recherche web optionnelle propulsée par Linkup. Lorsqu’activées, les sources web récentes sont récupérées en utilisant votre dernier message utilisateur comme requête et fournies au modèle comme contexte supplémentaire. Ajoute $0.013 par appel lorsqu’il est invoqué en plus du coût normal du jeton du modèle. Désactivé par défaut. |
| tools | array | - | - | Définitions d’outils compatibles OpenAI pour l’appel de fonctions. |
| tool_choice | object | - | - | Option compatible OpenAI tool_choice valeur. |
| response_format | enum | - | - | Retournez la sortie comme un objet JSON valide (mode JSON). Décrivez les domaines que vous souhaitez dans votre prompt. |
Entrée texte, image et vidéo avec sortie texte. La pensée passe par défaut à l’adaptatif et peut être désactivée. La tarification est basée sur les jetons d’entrée, y compris les impacts du cache: <=512K utilise le niveau standard réduit, tandis que >512K utilise le niveau à contexte élevé. Prend en charge jusqu’à 1 million de jetons d’entrée. La recherche web Linkup est disponible via web_search_linkup et ajoute $0.013 par recherche réussie.
:priority
C’est le niveau de service prioritaire: les demandes bénéficient d’une admission prioritaire pour des temps de réponse plus rapides et une fiabilité améliorée, à un prix supérieur à la ligne standard MiniMax M3. Entrée texte, image et vidéo avec sortie texte. La pensée passe par défaut à l’adaptatif et peut être désactivée. La tarification est étalée par palier selon les tokens d’entrée, incluant les impacts du cache, avec <=512K moins cher que >512K. Prend en charge jusqu’à 1 million de jetons d’entrée. La recherche web Linkup est disponible via web_search_linkup et ajoute $0.013 par recherche réussie.
Les variantes sont des versions alternatives de MiniMax M3 avec leur propre id de modèle. Selon la variante, la région de service, les tarifs ou les paramètres pris en charge peuvent différer ; tout le reste fonctionne pareil.
minimax-m3:prioritySur EmpirioLabs, MiniMax M3 est facturé à l'usage. La grille tarifaire en direct de cette page correspond toujours à ce que l'API facture.
MiniMax M3 prend en charge une fenêtre de contexte de 1M tokens avec jusqu'à 524 288 tokens de sortie par réponse.
Oui. MiniMax M3 sert l'API Chat Completions compatible OpenAI : les SDKs OpenAI existants fonctionnent en pointant base_url vers https://api.empiriolabs.ai/v1 et en utilisant l'id de modèle minimax-m3.
MiniMax M3 est disponible sous 2 ids de modèle : le défaut minimax-m3 plus minimax-m3:priority (Singapore). Les variantes peuvent différer en région de service, tarifs ou paramètres pris en charge ; les grilles tarifaires de chacune sont sur cette page.
Oui. Le playground EmpirioLabs exécute MiniMax M3 dans le navigateur avec les mêmes paramètres que l'API expose, pour tester vos prompts avant d'écrire du code.
Créez un compte EmpirioLabs, puis générez une clé sous API Keys dans le tableau de bord. La facturation utilise des crédits à l'usage : vous ne payez que vos requêtes.
Consultez nos tarifs ou contactez-nous si vous souhaitez que votre propre modèle soit déployé sur notre stack.