
MiniMax M3 ist ein multimodales Argumentationsmodell für Codierung, Agenten und lange Kontextanalyse mit Text-, Bild- und Videoeingabe.
MiniMax M3 ist ein multimodales Argumentationsmodell für Codierung, Agenten und lange Kontextanalyse mit Text-, Bild- und Videoeingabe.
Unterstützt Text-, Bild- und Videoeingaben, adaptives Denken durch enable thinking, Funktionsaufrufe und implizite prompte Cache-Lesevorgänge. Die Preisgestaltung wird durch prompte Token einschließlich Cache-Hits gestaffelt: <=512K verwendet die ermäßigte Standardstufe, während >512K die High-Context-Stufe verwendet. Denk-Token werden als Output-Token abgerechnet. Die Linkup-Websuche ist über web_search_linkup verfügbar und fügt $0.013 pro erfolgreicher Suche hinzu.
Auch bekannt als MiniMax-M3
minimax-m3/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/minimax-m3:generateContentminimax-m3-standardminimax/m3minimax/m3-standardLive Pay-as-you-go-Preise aus dem EmpirioLabs-Katalog. Du zahlst nur für das, was du nutzt, ohne monatliches Minimum.
MiniMax M3 bedient die OpenAI-kompatible Chat Completions API. Richte ein beliebiges OpenAI SDK mit deinem EmpirioLabs API-Schlüssel auf https://api.empiriolabs.ai/v1 und verwende die Modell-ID minimax-m3. Hol dir einen API-Schlüssel im EmpirioLabs Dashboard.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "minimax-m3",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="minimax-m3",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)Request-Parameter, die die MiniMax M3 API auf EmpirioLabs unterstützt. Standardwerte gelten, wenn ein Feld weggelassen wird.
| Parameter | Typ | Standard | Bereich / Werte | Beschreibung |
|---|---|---|---|---|
| temperature | number | 1 | 0 bis 2 | Kontrolliert Zufall. Niedrigere Werte sind deterministischer; höhere Werte sind eher explorativ. |
| top_p | number | 0.95 | 0 bis 1 | Kontrolliert die Kernprobennahme, indem die Erzeugung auf die wahrscheinlichste Token-Masse beschränkt wird. |
| max_completion_tokens | integer | 4096 | 1 bis 524288 | Die maximal generierten Token, einschließlich der Denk-Tokens beim Denken, sind aktiviert. |
| stop | array | - | - | Optionale Stop-Sequenz oder Liste von Stop-Sequenzen. |
| enable_thinking | boolean | true | - | Aktiviere adaptives Modelldenken, bevor du antwortest. Setze falsch, um eine direkte Antwort ohne Schlussphase zu verlangen. |
| web_search_linkup | boolean | false | - | Optionale Websuche, betrieben von Linkup. Wenn aktiviert, werden aktuelle Webquellen mit Ihrer neuesten Benutzernachricht als Abfrage abgerufen und dem Modell als zusätzlicher Kontext bereitgestellt. Fügt $0.013 pro Aufruf hinzu, wenn er aufgerufen wird, zusätzlich zu den normalen Tokenkosten des Modells. Standardmäßig deaktiviert. |
| tools | array | - | - | OpenAI-kompatible Werkzeugdefinitionen für Funktionsaufrufe. |
| tool_choice | object | - | - | Optional, OpenAI-kompatibler tool_choice Wert. |
| response_format | enum | - | - | Geben Sie die Ausgabe als gültiges JSON-Objekt (JSON-Modus) zurück. Beschreibe die Felder, die du in deinem Prompt verwenden möchtest. |
Text-, Bild- und Videoeingabe mit Textausgabe. Das Denken steht standardmäßig auf adaptiv und kann deaktiviert werden. Die Preisgestaltung basiert auf Eingabetokens einschließlich Cache-Hits: <=512K verwendet die rabattierte Standard-Stufe, während >512K die Hochkontext-Stufe verwendet. Unterstützt bis zu 1 Millionen Eingabetoken. Linkup-Websuche ist über web_search_linkup verfügbar und fügt $0.013 pro erfolgreicher Suche hinzu.
:priority
Dies ist die Prioritätsservice-Stufe: Anfragen erhalten bevorzugte Zulassung für schnellere Reaktionszeiten und verbesserte Zuverlässigkeit, preislich über der Standard-MiniMax M3-Route. Text-, Bild- und Videoeingabe mit Textausgabe. Das Denken steht standardmäßig auf adaptiv und kann deaktiviert werden. Die Preisgestaltung wird nach Eingabetoken einschließlich Cache-Hits gestaffelt, wobei <=512K günstiger als >512K. Unterstützt bis zu 1 Millionen Eingabetoken. Linkup-Websuche ist über web_search_linkup verfügbar und fügt $0.013 pro erfolgreicher Suche hinzu.
Varianten sind alternative Versionen von MiniMax M3 mit eigener Modell-ID. Je nach Variante können sich Serving-Region, Preise oder unterstützte Parameter unterscheiden; alles andere funktioniert gleich.
minimax-m3:priorityAuf EmpirioLabs wird MiniMax M3 nach Verbrauch abgerechnet. Die Live-Preistabelle auf dieser Seite entspricht immer dem, was die API berechnet.
MiniMax M3 unterstützt ein Kontextfenster von 1M Token mit bis zu 524.288 Ausgabe-Token pro Antwort.
Ja. MiniMax M3 bedient die OpenAI-kompatible Chat Completions API. Bestehende OpenAI SDKs funktionieren, indem du base_url auf https://api.empiriolabs.ai/v1 setzt und als Modell-ID minimax-m3 verwendest.
MiniMax M3 ist als 2 Modell-IDs verfügbar: der Standard minimax-m3 plus minimax-m3:priority (Singapore). Varianten können sich in Serving-Region, Preisen oder unterstützten Parametern unterscheiden; die Preistabellen stehen auf dieser Seite.
Ja. Der EmpirioLabs Playground führt MiniMax M3 im Browser mit denselben Parametern aus, die die API bietet. So kannst du Prompts testen, bevor du Code schreibst.
Erstelle ein EmpirioLabs-Konto und generiere dann einen Schlüssel unter API Keys im Dashboard. Die Abrechnung erfolgt über Pay-as-you-go-Guthaben, du zahlst also nur für deine Requests.
Schauen Sie sich unsere Preise an oder kontaktieren Sie uns, wenn Sie Ihr eigenes Modell auf unserem Stack implementieren möchten.