MiniMax M3 API

MiniMax M3 ist ein multimodales Argumentationsmodell für Codierung, Agenten und lange Kontextanalyse mit Text-, Bild- und Videoeingabe.

MiniMaxTextgenerierung1M KontextVeröffentlicht 1. Juni 2026SingaporeProprietärer EndpointNeu

Über MiniMax M3

MiniMax M3 ist ein multimodales Argumentationsmodell für Codierung, Agenten und lange Kontextanalyse mit Text-, Bild- und Videoeingabe.

Unterstützt Text-, Bild- und Videoeingaben, adaptives Denken durch enable thinking, Funktionsaufrufe und implizite prompte Cache-Lesevorgänge. Die Preisgestaltung wird durch prompte Token einschließlich Cache-Hits gestaffelt: <=512K verwendet die ermäßigte Standardstufe, während >512K die High-Context-Stufe verwendet. Denk-Token werden als Output-Token abgerechnet. Die Linkup-Websuche ist über web_search_linkup verfügbar und fügt $0.013 pro erfolgreicher Suche hinzu.

Auch bekannt als MiniMax-M3

reasoningvisionvideoweb searchfunction callingcachelong Kontext

MiniMax M3 Spezifikationen

Modell-ID
minimax-m3
Anbieter
MiniMax
Kategorie
Textgenerierung
Veröffentlicht
1. Juni 2026
Kontextfenster
1M Token
Max. Ausgabe
524.288 Token
Eingabe
TextBildVideo
Ausgabe
Text
Strukturierte Ausgabe
JSON-Modus
Region
Singapore
Endpoints
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/minimax-m3:generateContent
Alternative Modell-IDs
minimax-m3-standardminimax/m3minimax/m3-standard

MiniMax M3 API-PreiseSpare bis zu 25%

Live Pay-as-you-go-Preise aus dem EmpirioLabs-Katalog. Du zahlst nur für das, was du nutzt, ohne monatliches Minimum.

Typ
Spezifikation
Preis
Eingabe
pro 1M prompte Token
$0.30<=512K $0.225$0.60>512K $0.45
Ausgabe
pro 1M generierte Token
$1.20<=512K $0.90$2.40>512K $1.80
Impliziter Cache Read
pro 1M zwischengespeicherte Eingangstoken
$0.06<=512K $0.045$0.12>512K $0.09
Websuche (Linkup)
pro Anruf beim Aufruf
$0.013
Auf der vollständigen Preisseite vergleichen

So rufst du die MiniMax M3 API auf

MiniMax M3 bedient die OpenAI-kompatible Chat Completions API. Richte ein beliebiges OpenAI SDK mit deinem EmpirioLabs API-Schlüssel auf https://api.empiriolabs.ai/v1 und verwende die Modell-ID minimax-m3. Hol dir einen API-Schlüssel im EmpirioLabs Dashboard.

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "minimax-m3",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="minimax-m3",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Vollständige MiniMax M3 API-Referenz

MiniMax M3 API-Parameter

Request-Parameter, die die MiniMax M3 API auf EmpirioLabs unterstützt. Standardwerte gelten, wenn ein Feld weggelassen wird.

ParameterTypStandardBereich / WerteBeschreibung
temperaturenumber10 bis 2Kontrolliert Zufall. Niedrigere Werte sind deterministischer; höhere Werte sind eher explorativ.
top_pnumber0.950 bis 1Kontrolliert die Kernprobennahme, indem die Erzeugung auf die wahrscheinlichste Token-Masse beschränkt wird.
max_completion_tokensinteger40961 bis 524288Die maximal generierten Token, einschließlich der Denk-Tokens beim Denken, sind aktiviert.
stoparray--Optionale Stop-Sequenz oder Liste von Stop-Sequenzen.
enable_thinkingbooleantrue-Aktiviere adaptives Modelldenken, bevor du antwortest. Setze falsch, um eine direkte Antwort ohne Schlussphase zu verlangen.
web_search_linkupbooleanfalse-Optionale Websuche, betrieben von Linkup. Wenn aktiviert, werden aktuelle Webquellen mit Ihrer neuesten Benutzernachricht als Abfrage abgerufen und dem Modell als zusätzlicher Kontext bereitgestellt. Fügt $0.013 pro Aufruf hinzu, wenn er aufgerufen wird, zusätzlich zu den normalen Tokenkosten des Modells. Standardmäßig deaktiviert.
toolsarray--OpenAI-kompatible Werkzeugdefinitionen für Funktionsaufrufe.
tool_choiceobject--Optional, OpenAI-kompatibler tool_choice Wert.
response_formatenum--Geben Sie die Ausgabe als gültiges JSON-Objekt (JSON-Modus) zurück. Beschreibe die Felder, die du in deinem Prompt verwenden möchtest.

Gut zu wissen

Text-, Bild- und Videoeingabe mit Textausgabe. Das Denken steht standardmäßig auf adaptiv und kann deaktiviert werden. Die Preisgestaltung basiert auf Eingabetokens einschließlich Cache-Hits: <=512K verwendet die rabattierte Standard-Stufe, während >512K die Hochkontext-Stufe verwendet. Unterstützt bis zu 1 Millionen Eingabetoken. Linkup-Websuche ist über web_search_linkup verfügbar und fügt $0.013 pro erfolgreicher Suche hinzu.

:priority

Dies ist die Prioritätsservice-Stufe: Anfragen erhalten bevorzugte Zulassung für schnellere Reaktionszeiten und verbesserte Zuverlässigkeit, preislich über der Standard-MiniMax M3-Route. Text-, Bild- und Videoeingabe mit Textausgabe. Das Denken steht standardmäßig auf adaptiv und kann deaktiviert werden. Die Preisgestaltung wird nach Eingabetoken einschließlich Cache-Hits gestaffelt, wobei <=512K günstiger als >512K. Unterstützt bis zu 1 Millionen Eingabetoken. Linkup-Websuche ist über web_search_linkup verfügbar und fügt $0.013 pro erfolgreicher Suche hinzu.

MiniMax M3 Varianten

Varianten sind alternative Versionen von MiniMax M3 mit eigener Modell-ID. Je nach Variante können sich Serving-Region, Preise oder unterstützte Parameter unterscheiden; alles andere funktioniert gleich.

MiniMax M3 :prioritySpare bis zu 25%

Modell-ID
minimax-m3:priority
Region
Singapore
Kontextfenster
1M Token
Strukturierte Ausgabe
JSON-Modus
Typ
Spezifikation
Preis
Eingabe
pro 1M prompte Token
$0.45<=512K $0.3375$0.90>512K $0.675
Ausgabe
pro 1M generierte Token
$1.80<=512K $1.35$3.60>512K $2.70
Impliziter Cache Read
pro 1M zwischengespeicherte Eingangstoken
$0.09<=512K $0.0675$0.18>512K $0.135
Websuche (Linkup)
pro Anruf beim Aufruf
$0.013
:priority im Playground testen

MiniMax M3 API: häufige Fragen

Wie viel kostet die MiniMax M3 API?

Auf EmpirioLabs wird MiniMax M3 nach Verbrauch abgerechnet. Die Live-Preistabelle auf dieser Seite entspricht immer dem, was die API berechnet.

Wie groß ist das Kontextfenster von MiniMax M3?

MiniMax M3 unterstützt ein Kontextfenster von 1M Token mit bis zu 524.288 Ausgabe-Token pro Antwort.

Ist die MiniMax M3 API OpenAI-kompatibel?

Ja. MiniMax M3 bedient die OpenAI-kompatible Chat Completions API. Bestehende OpenAI SDKs funktionieren, indem du base_url auf https://api.empiriolabs.ai/v1 setzt und als Modell-ID minimax-m3 verwendest.

Welche MiniMax M3 Varianten sind verfügbar?

MiniMax M3 ist als 2 Modell-IDs verfügbar: der Standard minimax-m3 plus minimax-m3:priority (Singapore). Varianten können sich in Serving-Region, Preisen oder unterstützten Parametern unterscheiden; die Preistabellen stehen auf dieser Seite.

Kann ich MiniMax M3 im Browser testen, bevor ich integriere?

Ja. Der EmpirioLabs Playground führt MiniMax M3 im Browser mit denselben Parametern aus, die die API bietet. So kannst du Prompts testen, bevor du Code schreibst.

Wie bekomme ich einen MiniMax M3 API-Schlüssel?

Erstelle ein EmpirioLabs-Konto und generiere dann einen Schlüssel unter API Keys im Dashboard. Die Abrechnung erfolgt über Pay-as-you-go-Guthaben, du zahlst also nur für deine Requests.

Bereit, bessere Endpunkte zu nutzen?

Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.