MiniMax M3 API

MiniMax M3 est un modèle de raisonnement multimodal pour le codage, les agents et l'analyse de long-contexte avec entrée texte, image et vidéo.

MiniMaxGénération de texte1M contextePublié 1 juin 2026SingaporeEndpoint propriétaireNouveau

À propos de MiniMax M3

MiniMax M3 est un modèle de raisonnement multimodal pour le codage, les agents et l'analyse de long-contexte avec entrée texte, image et vidéo.

Prend en charge les entrées texte, image et vidéo, la pensée adaptative par l'activation pense, l'appel de fonction et la lecture implicite du cache. La tarification est échelonnée par des jetons rapides, y compris les hits de cache: <=512K utilise le niveau standard actualisé, tandis que >512K utilise le niveau de contexte élevé. Les jetons de pensée sont facturés comme jetons de sortie. La recherche Web Linkup est disponible via web_search_linkup et ajoute $0.013 par recherche réussie.

Aussi connu sous le nom MiniMax-M3

reasoningvisionvideoweb searchfunction callingcachelong contexte

Caractéristiques de MiniMax M3

ID du modèle
minimax-m3
Fournisseur
MiniMax
Catégorie
Génération de texte
Publié
1 juin 2026
Fenêtre de contexte
1M tokens
Sortie max
524 288 tokens
Entrée
TexteImageVidéo
Sortie
Texte
Sortie structurée
Mode JSON
Région
Singapore
Endpoints
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/minimax-m3:generateContent
Identifiants de modèle alternatifs
minimax-m3-standardminimax/m3minimax/m3-standard

Tarifs de l'API MiniMax M3Économisez jusqu'à 25%

Tarifs à l'usage en direct du catalogue EmpirioLabs. Vous ne payez que ce que vous utilisez, sans minimum mensuel.

Type
Spéc.
Tarif
Entrée
par jetons 1M
$0.30<=512K $0.225$0.60>512K $0.45
Produit
par jeton généré 1M
$1.20<=512K $0.90$2.40>512K $1.80
cache implicite lu
par jetons d'entrée en cache 1M
$0.06<=512K $0.045$0.12>512K $0.09
Recherche Web (Linkup)
par appel lorsqu'il est invoqué
$0.013
Comparer sur la page complète des tarifs

Comment appeler l'API MiniMax M3

MiniMax M3 sert l'API Chat Completions compatible OpenAI. Pointez n'importe quel SDK OpenAI vers https://api.empiriolabs.ai/v1 avec votre clé API EmpirioLabs et utilisez l'id de modèle minimax-m3. Obtenez une clé API depuis le tableau de bord EmpirioLabs.

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "minimax-m3",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="minimax-m3",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Référence complète de l'API MiniMax M3

Paramètres de l'API MiniMax M3

Paramètres de requête pris en charge par l'API MiniMax M3 sur EmpirioLabs. Les valeurs par défaut s'appliquent quand un champ est omis.

ParamètreTypePar défautPlage / valeursDescription
temperaturenumber10 à 2Contrôle l’aléatoire. Les valeurs inférieures sont plus déterministes; Les valeurs plus élevées sont plus exploratoires.
top_pnumber0.950 à 1Contrôle l’échantillonnage du noyau en limitant la génération à la masse token la plus probable.
max_completion_tokensinteger40961 à 524288Maximum de jetons générés, y compris les jetons de raisonnement lorsque la réflexion est activée.
stoparray--Séquence d’arrêts optionnelle ou liste de séquences d’arrêts.
enable_thinkingbooleantrue-Activez la pensée modélistique adaptative avant de répondre. Réglez false pour demander une réponse directe sans phase de raisonnement.
web_search_linkupbooleanfalse-Recherche web optionnelle propulsée par Linkup. Lorsqu’activées, les sources web récentes sont récupérées en utilisant votre dernier message utilisateur comme requête et fournies au modèle comme contexte supplémentaire. Ajoute $0.013 par appel lorsqu’il est invoqué en plus du coût normal du jeton du modèle. Désactivé par défaut.
toolsarray--Définitions d’outils compatibles OpenAI pour l’appel de fonctions.
tool_choiceobject--Option compatible OpenAI tool_choice valeur.
response_formatenum--Retournez la sortie comme un objet JSON valide (mode JSON). Décrivez les domaines que vous souhaitez dans votre prompt.

Bon à savoir

Entrée texte, image et vidéo avec sortie texte. La pensée passe par défaut à l’adaptatif et peut être désactivée. La tarification est basée sur les jetons d’entrée, y compris les impacts du cache: <=512K utilise le niveau standard réduit, tandis que >512K utilise le niveau à contexte élevé. Prend en charge jusqu’à 1 million de jetons d’entrée. La recherche web Linkup est disponible via web_search_linkup et ajoute $0.013 par recherche réussie.

:priority

C’est le niveau de service prioritaire: les demandes bénéficient d’une admission prioritaire pour des temps de réponse plus rapides et une fiabilité améliorée, à un prix supérieur à la ligne standard MiniMax M3. Entrée texte, image et vidéo avec sortie texte. La pensée passe par défaut à l’adaptatif et peut être désactivée. La tarification est étalée par palier selon les tokens d’entrée, incluant les impacts du cache, avec <=512K moins cher que >512K. Prend en charge jusqu’à 1 million de jetons d’entrée. La recherche web Linkup est disponible via web_search_linkup et ajoute $0.013 par recherche réussie.

Variantes de MiniMax M3

Les variantes sont des versions alternatives de MiniMax M3 avec leur propre id de modèle. Selon la variante, la région de service, les tarifs ou les paramètres pris en charge peuvent différer ; tout le reste fonctionne pareil.

MiniMax M3 :priorityÉconomisez jusqu'à 25%

ID du modèle
minimax-m3:priority
Région
Singapore
Fenêtre de contexte
1M tokens
Sortie structurée
Mode JSON
Type
Spéc.
Tarif
Entrée
par jetons 1M
$0.45<=512K $0.3375$0.90>512K $0.675
Produit
par jeton généré 1M
$1.80<=512K $1.35$3.60>512K $2.70
cache implicite lu
par jetons d'entrée en cache 1M
$0.09<=512K $0.0675$0.18>512K $0.135
Recherche Web (Linkup)
par appel lorsqu'il est invoqué
$0.013
Essayer :priority dans le playground

API MiniMax M3 : questions fréquentes

Combien coûte l'API MiniMax M3 ?

Sur EmpirioLabs, MiniMax M3 est facturé à l'usage. La grille tarifaire en direct de cette page correspond toujours à ce que l'API facture.

Quelle est la fenêtre de contexte de MiniMax M3 ?

MiniMax M3 prend en charge une fenêtre de contexte de 1M tokens avec jusqu'à 524 288 tokens de sortie par réponse.

L'API MiniMax M3 est-elle compatible OpenAI ?

Oui. MiniMax M3 sert l'API Chat Completions compatible OpenAI : les SDKs OpenAI existants fonctionnent en pointant base_url vers https://api.empiriolabs.ai/v1 et en utilisant l'id de modèle minimax-m3.

Quelles variantes de MiniMax M3 sont disponibles ?

MiniMax M3 est disponible sous 2 ids de modèle : le défaut minimax-m3 plus minimax-m3:priority (Singapore). Les variantes peuvent différer en région de service, tarifs ou paramètres pris en charge ; les grilles tarifaires de chacune sont sur cette page.

Puis-je essayer MiniMax M3 dans le navigateur avant d'intégrer ?

Oui. Le playground EmpirioLabs exécute MiniMax M3 dans le navigateur avec les mêmes paramètres que l'API expose, pour tester vos prompts avant d'écrire du code.

Comment obtenir une clé API MiniMax M3 ?

Créez un compte EmpirioLabs, puis générez une clé sous API Keys dans le tableau de bord. La facturation utilise des crédits à l'usage : vous ne payez que vos requêtes.

Prêt à utiliser de meilleurs points de terminaison ?

Consultez nos tarifs ou contactez-nous si vous souhaitez que votre propre modèle soit déployé sur notre stack.