MiniMax M3 API

MiniMax M3 est un modèle de raisonnement multimodal pour le codage, les agents et l’analyse en contexte long avec saisie texte, image et vidéo.

MiniMaxGénération de texte1M contextePublié 1 juin 2026SingaporeEndpoint propriétaire

À propos de MiniMax M3

MiniMax M3 est un modèle de raisonnement multimodal pour le codage, les agents et l’analyse en contexte long avec saisie texte, image et vidéo.

Prend en charge les entrées texte, image et vidéo, la pensée adaptative via enable_thinking, l’appel de fonctions et la lecture implicite du cache par invites. La tarification est étalée par des jetons d’invitation incluant les résultats de cache: <=512K utilise le palier standard réduit, tandis que >512K utilise le palier à haut contexte. Les jetons pensants sont présentés comme des jetons de sortie. La recherche web Linkup est disponible via web_search_linkup et ajoute $0.013 par recherche réussie.

reasoningvisionvideoweb searchfunction callingcachelong contexte

Caractéristiques de MiniMax M3

ID du modèle
minimax-m3
Auteur
MiniMax
Catégorie
Génération de texte
Publié
1 juin 2026
Fenêtre de contexte
1M tokens
Sortie max
524 288 tokens
Entrée
TexteImageVidéo
Sortie
Texte
Sortie structurée
Mode JSON
Région
Singapore
Endpoints
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/minimax-m3:generateContent
Identifiants de modèle alternatifs
minimax-m3-standardminimax/m3minimax/m3-standard

Tarifs de l'API MiniMax M3Économisez jusqu'à 25%

Tarifs à l'usage en direct du catalogue EmpirioLabs. Vous ne payez que ce que vous utilisez, sans minimum mensuel.

Type
Spéc.
Tarif
Entrée
par 1M de jetons d’invite
$0.30<=512K $0.225$0.60>512K $0.45
Produit
par 1M de jetons générés
$1.20<=512K $0.90$2.40>512K $1.80
Lecture implicite du cache
par 1M de jetons d’entrée mis en cache
$0.06<=512K $0.045$0.12>512K $0.09
Recherche Web (Linkup)
par appel lors de l’invocation
$0.013
Comparer sur la page complète des tarifs

Comment appeler l'API MiniMax M3

MiniMax M3 sert l'API Chat Completions compatible OpenAI. Pointez n'importe quel SDK OpenAI vers https://api.empiriolabs.ai/v1 avec votre clé API EmpirioLabs et utilisez l'id de modèle minimax-m3. Obtenez une clé API depuis le tableau de bord EmpirioLabs.

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "minimax-m3",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="minimax-m3",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Référence complète de l'API MiniMax M3

Paramètres de l'API MiniMax M3

Paramètres de requête pris en charge par l'API MiniMax M3 sur EmpirioLabs. Les valeurs par défaut s'appliquent quand un champ est omis.

ParamètreTypePar défautPlage / valeursDescription
temperaturenumber10 à 2Contrôle l’aléatoire. Les valeurs inférieures sont plus déterministes; Les valeurs plus élevées sont plus exploratoires.
top_pnumber0.950 à 1Contrôle l’échantillonnage du noyau en limitant la génération à la masse token la plus probable.
max_completion_tokensinteger40961 à 524288Maximum de jetons générés, y compris les jetons de raisonnement lorsque la réflexion est activée.
stoparray--Séquence d’arrêts optionnelle ou liste de séquences d’arrêts.
enable_thinkingbooleantrue-Activez la pensée modélistique adaptative avant de répondre. Réglez false pour demander une réponse directe sans phase de raisonnement.
web_search_linkupbooleanfalse-Recherche web optionnelle propulsée par Linkup. Lorsqu’activées, les sources web récentes sont récupérées en utilisant votre dernier message utilisateur comme requête et fournies au modèle comme contexte supplémentaire. Ajoute $0.013 par appel lorsqu’il est invoqué en plus du coût normal du jeton du modèle. Désactivé par défaut.
toolsarray--Définitions d’outils compatibles OpenAI pour l’appel de fonctions.
tool_choiceobject--Option compatible OpenAI tool_choice valeur.
response_formatenum--Retournez la sortie comme un objet JSON valide (mode JSON). Décrivez les domaines que vous souhaitez dans votre prompt.
disable_formattingbooleanfalse-Une fois activée, la passerelle n’ajoutera pas le pied de page « Sources » aux réponses des assistants ayant utilisé la recherche web Linkup. Utile lorsque la sortie...

Bon à savoir

Entrée texte, image et vidéo avec sortie texte. La pensée passe par défaut à l’adaptatif et peut être désactivée. La tarification est basée sur les jetons d’entrée, y compris les impacts du cache: <=512K utilise le niveau standard réduit, tandis que >512K utilise le niveau à contexte élevé. Prend en charge jusqu’à 1 million de jetons d’entrée. La recherche web Linkup est disponible via web_search_linkup et ajoute $0.013 par recherche réussie.

:priority

C’est le niveau de service prioritaire: les demandes bénéficient d’une admission prioritaire pour des temps de réponse plus rapides et une fiabilité améliorée, à un prix supérieur à la ligne standard MiniMax M3. Entrée texte, image et vidéo avec sortie texte. La pensée passe par défaut à l’adaptatif et peut être désactivée. La tarification est étalée par palier selon les tokens d’entrée, incluant les impacts du cache, avec <=512K moins cher que >512K. Prend en charge jusqu’à 1 million de jetons d’entrée. La recherche web Linkup est disponible via web_search_linkup et ajoute $0.013 par recherche réussie.

Variantes de MiniMax M3

Les variantes sont des versions alternatives de MiniMax M3 avec leur propre id de modèle. Selon la variante, la région de service, les tarifs ou les paramètres pris en charge peuvent différer ; tout le reste fonctionne pareil.

MiniMax M3 :priorityÉconomisez jusqu'à 25%

ID du modèle
minimax-m3:priority
Région
Singapore
Fenêtre de contexte
1M tokens
Sortie structurée
Mode JSON
Type
Spéc.
Tarif
Entrée
par 1M de jetons d’invite
$0.45<=512K $0.3375$0.90>512K $0.675
Produit
par 1M de jetons générés
$1.80<=512K $1.35$3.60>512K $2.70
Lecture implicite du cache
par 1M de jetons d’entrée mis en cache
$0.09<=512K $0.0675$0.18>512K $0.135
Recherche Web (Linkup)
par appel lors de l’invocation
$0.013
Essayer :priority dans le playground

API MiniMax M3 : questions fréquentes

Combien coûte l'API MiniMax M3 ?

Sur EmpirioLabs, MiniMax M3 est facturé à l'usage. La grille tarifaire en direct de cette page correspond toujours à ce que l'API facture.

Quelle est la fenêtre de contexte de MiniMax M3 ?

MiniMax M3 prend en charge une fenêtre de contexte de 1M tokens avec jusqu'à 524 288 tokens de sortie par réponse.

L'API MiniMax M3 est-elle compatible OpenAI ?

Oui. MiniMax M3 sert l'API Chat Completions compatible OpenAI : les SDKs OpenAI existants fonctionnent en pointant base_url vers https://api.empiriolabs.ai/v1 et en utilisant l'id de modèle minimax-m3.

Quelles variantes de MiniMax M3 sont disponibles ?

MiniMax M3 est disponible sous 2 ids de modèle : le défaut minimax-m3 plus minimax-m3:priority (Singapore). Les variantes peuvent différer en région de service, tarifs ou paramètres pris en charge ; les grilles tarifaires de chacune sont sur cette page.

Puis-je essayer MiniMax M3 dans le navigateur avant d'intégrer ?

Oui. Le playground EmpirioLabs exécute MiniMax M3 dans le navigateur avec les mêmes paramètres que l'API expose, pour tester vos prompts avant d'écrire du code.

Comment obtenir une clé API MiniMax M3 ?

Créez un compte EmpirioLabs, puis générez une clé sous API Keys dans le tableau de bord. La facturation utilise des crédits à l'usage : vous ne payez que vos requêtes.

Prêt à utiliser de meilleurs points de terminaison ?

Consultez nos tarifs ou contactez-nous si vous souhaitez que votre propre modèle soit déployé sur notre stack.