
MiniMax M3 es un modelo de razonamiento multimodal para codificación, agentes y análisis de contexto largo con entrada de texto, imagen y vídeo.
MiniMax M3 es un modelo de razonamiento multimodal para codificación, agentes y análisis de contexto largo con entrada de texto, imagen y vídeo.
Soporta entradas de texto, imagen y vídeo, pensamiento adaptativo a través de enable_thinking, llamadas a funciones y lecturas implícitas de caché de prompts. La fijación de precios se clasifica según los tokens de prompt que incluyen los hits de caché: <=512K usa el nivel estándar con descuento, mientras que >512K usa el nivel de alto contexto. Los tokens de pensamiento se presentan como tokens de salida. La búsqueda web de Linkup está disponible a través de web_search_linkup y añade $0.013 por cada búsqueda exitosa.
También conocido como MiniMax-M3
minimax-m3/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/minimax-m3:generateContentminimax-m3-standardminimax/m3minimax/m3-standardTarifas de pago por uso en vivo del catálogo de EmpirioLabs. Solo pagas por lo que usas, sin mínimo mensual.
MiniMax M3 sirve la API de Chat Completions compatible con OpenAI. Apunta cualquier SDK de OpenAI a https://api.empiriolabs.ai/v1 con tu clave de API de EmpirioLabs y usa el id de modelo minimax-m3. Consigue una clave de API en el panel de EmpirioLabs.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "minimax-m3",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="minimax-m3",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)Parámetros de solicitud compatibles con la API de MiniMax M3 en EmpirioLabs. Los valores por defecto se aplican cuando se omite un campo.
| Parámetro | Tipo | Predeterminado | Rango / valores | Descripción |
|---|---|---|---|---|
| temperature | number | 1 | 0 a 2 | Controla la aleatoriedad. Los valores inferiores son más deterministas; los valores más altos son más exploratorios. |
| top_p | number | 0.95 | 0 a 1 | Controla el muestreo del núcleo limitando la generación a la masa token más probable. |
| max_completion_tokens | integer | 4096 | 1 a 524288 | Se habilita el máximo de tokens generados, incluidos los tokens de razonamiento cuando se puede pensar. |
| stop | array | - | - | Secuencia opcional de paradas o lista de secuencias de paradas. |
| enable_thinking | boolean | true | - | Activa el pensamiento adaptativo por modelo antes de responder. Configura false para pedir una respuesta directa sin una fase de razonamiento. |
| web_search_linkup | boolean | false | - | Búsqueda web opcional impulsada por Linkup. Cuando están habilitadas, las fuentes web recientes se recuperan usando tu último mensaje de usuario como consulta y se proporcionan al modelo como contexto adicional. Añade $0.013 por llamada cuando se invoca además del coste normal del token del modelo. Desactivado por defecto. |
| tools | array | - | - | Definiciones de herramientas compatibles con OpenAI para llamadas a funciones. |
| tool_choice | object | - | - | Opcional tool_choice compatible con OpenAI. |
| response_format | enum | - | - | Devuelve la salida como un objeto JSON válido (modo JSON). Describe los campos que quieres en tu tema. |
Entrada de texto, imagen y vídeo con salida de texto. El pensamiento por defecto es adaptativo y puede desactivarse. El precio se basa en tokens de entrada, incluyendo los impactos de caché: <=512K usa el nivel estándar con descuento, mientras que >512K usa el nivel de alto contexto. Soporta hasta 1 millón de tokens de entrada. La búsqueda web de Linkup está disponible a través de web_search_linkup y añade $0.013 por cada búsqueda exitosa.
:priority
Este es el nivel de servicio prioritario: las solicitudes reciben acceso prioritario para tiempos de respuesta más rápidos y mayor fiabilidad, con un precio superior al de la ruta estándar del MiniMax M3. Entrada de texto, imagen y vídeo con salida de texto. El pensamiento por defecto es adaptativo y puede desactivarse. El precio se clasifica por niveles según los tokens de entrada, incluyendo los impactos de caché, con <=512K más baratos que >512K. Soporta hasta 1 millón de tokens de entrada. La búsqueda web de Linkup está disponible a través de web_search_linkup y añade $0.013 por cada búsqueda exitosa.
Las variantes son versiones alternativas de MiniMax M3 con su propio id de modelo. Según la variante, pueden diferir en región de servicio, precios o parámetros compatibles; todo lo demás funciona igual.
minimax-m3:priorityEn EmpirioLabs, MiniMax M3 se factura por uso. La tabla de tarifas en vivo de esta página siempre coincide con lo que cobra la API.
MiniMax M3 admite una ventana de contexto de 1M tokens con hasta 524.288 tokens de salida por respuesta.
Sí. MiniMax M3 sirve la API de Chat Completions compatible con OpenAI, así que los SDKs de OpenAI existentes funcionan apuntando base_url a https://api.empiriolabs.ai/v1 y usando el id de modelo minimax-m3.
MiniMax M3 está disponible como 2 ids de modelo: el predeterminado minimax-m3 más minimax-m3:priority (Singapore). Las variantes pueden diferir en región de servicio, precios o parámetros compatibles; las tablas de tarifas de cada una están en esta página.
Sí. El playground de EmpirioLabs ejecuta MiniMax M3 en el navegador con los mismos parámetros que expone la API, para que pruebes prompts antes de escribir código.
Crea una cuenta de EmpirioLabs y genera una clave en API Keys en el panel. La facturación es con créditos de pago por uso, así que solo pagas por las solicitudes que haces.
Consulta nuestros precios o contacta con nosotros si quieres que tu propio modelo se implemente en nuestra pila.