MiniMax M3 API

MiniMax M3 es un modelo de razonamiento multimodal para codificación, agentes y análisis de contexto largo con entrada de texto, imagen y vídeo.

MiniMaxGeneracion de texto1M contextoLanzado 1 jun 2026SingaporeEndpoint propietarioNuevo

Acerca de MiniMax M3

MiniMax M3 es un modelo de razonamiento multimodal para codificación, agentes y análisis de contexto largo con entrada de texto, imagen y vídeo.

Soporta entradas de texto, imagen y vídeo, pensamiento adaptativo a través de enable_thinking, llamadas a funciones y lecturas implícitas de caché de prompts. La fijación de precios se clasifica según los tokens de prompt que incluyen los hits de caché: <=512K usa el nivel estándar con descuento, mientras que >512K usa el nivel de alto contexto. Los tokens de pensamiento se presentan como tokens de salida. La búsqueda web de Linkup está disponible a través de web_search_linkup y añade $0.013 por cada búsqueda exitosa.

También conocido como MiniMax-M3

reasoningvisionvideoweb searchfunction callingcachelong contexto

Especificaciones de MiniMax M3

ID del modelo
minimax-m3
Proveedor
MiniMax
Categoría
Generacion de texto
Lanzado
1 jun 2026
Ventana de contexto
1M tokens
Salida máxima
524.288 tokens
Entrada
TextoImagenVideo
Salida
Texto
Salida estructurada
Modo JSON
Región
Singapore
Endpoints
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/minimax-m3:generateContent
IDs de modelo alternativos
minimax-m3-standardminimax/m3minimax/m3-standard

Precios de la API de MiniMax M3Ahorra hasta 25%

Tarifas de pago por uso en vivo del catálogo de EmpirioLabs. Solo pagas por lo que usas, sin mínimo mensual.

Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.30<=512K $0.225$0.60>512K $0.45
Producto
por 1M de tokens generados
$1.20<=512K $0.90$2.40>512K $1.80
Caché implícita
por fichas de entrada en caché de 1M
$0.06<=512K $0.045$0.12>512K $0.09
Búsqueda web (Linkup)
por llamada cuando se invoca
$0.013
Comparar en la página completa de precios

Cómo llamar a la API de MiniMax M3

MiniMax M3 sirve la API de Chat Completions compatible con OpenAI. Apunta cualquier SDK de OpenAI a https://api.empiriolabs.ai/v1 con tu clave de API de EmpirioLabs y usa el id de modelo minimax-m3. Consigue una clave de API en el panel de EmpirioLabs.

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "minimax-m3",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="minimax-m3",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Referencia completa de la API de MiniMax M3

Parámetros de la API de MiniMax M3

Parámetros de solicitud compatibles con la API de MiniMax M3 en EmpirioLabs. Los valores por defecto se aplican cuando se omite un campo.

ParámetroTipoPredeterminadoRango / valoresDescripción
temperaturenumber10 a 2Controla la aleatoriedad. Los valores inferiores son más deterministas; los valores más altos son más exploratorios.
top_pnumber0.950 a 1Controla el muestreo del núcleo limitando la generación a la masa token más probable.
max_completion_tokensinteger40961 a 524288Se habilita el máximo de tokens generados, incluidos los tokens de razonamiento cuando se puede pensar.
stoparray--Secuencia opcional de paradas o lista de secuencias de paradas.
enable_thinkingbooleantrue-Activa el pensamiento adaptativo por modelo antes de responder. Configura false para pedir una respuesta directa sin una fase de razonamiento.
web_search_linkupbooleanfalse-Búsqueda web opcional impulsada por Linkup. Cuando están habilitadas, las fuentes web recientes se recuperan usando tu último mensaje de usuario como consulta y se proporcionan al modelo como contexto adicional. Añade $0.013 por llamada cuando se invoca además del coste normal del token del modelo. Desactivado por defecto.
toolsarray--Definiciones de herramientas compatibles con OpenAI para llamadas a funciones.
tool_choiceobject--Opcional tool_choice compatible con OpenAI.
response_formatenum--Devuelve la salida como un objeto JSON válido (modo JSON). Describe los campos que quieres en tu tema.

Información útil

Entrada de texto, imagen y vídeo con salida de texto. El pensamiento por defecto es adaptativo y puede desactivarse. El precio se basa en tokens de entrada, incluyendo los impactos de caché: <=512K usa el nivel estándar con descuento, mientras que >512K usa el nivel de alto contexto. Soporta hasta 1 millón de tokens de entrada. La búsqueda web de Linkup está disponible a través de web_search_linkup y añade $0.013 por cada búsqueda exitosa.

:priority

Este es el nivel de servicio prioritario: las solicitudes reciben acceso prioritario para tiempos de respuesta más rápidos y mayor fiabilidad, con un precio superior al de la ruta estándar del MiniMax M3. Entrada de texto, imagen y vídeo con salida de texto. El pensamiento por defecto es adaptativo y puede desactivarse. El precio se clasifica por niveles según los tokens de entrada, incluyendo los impactos de caché, con <=512K más baratos que >512K. Soporta hasta 1 millón de tokens de entrada. La búsqueda web de Linkup está disponible a través de web_search_linkup y añade $0.013 por cada búsqueda exitosa.

Variantes de MiniMax M3

Las variantes son versiones alternativas de MiniMax M3 con su propio id de modelo. Según la variante, pueden diferir en región de servicio, precios o parámetros compatibles; todo lo demás funciona igual.

MiniMax M3 :priorityAhorra hasta 25%

ID del modelo
minimax-m3:priority
Región
Singapore
Ventana de contexto
1M tokens
Salida estructurada
Modo JSON
Tipo
Especificación
Tarifa
Entrada
por 1M de tokens de prompt
$0.45<=512K $0.3375$0.90>512K $0.675
Producto
por 1M de tokens generados
$1.80<=512K $1.35$3.60>512K $2.70
Caché implícita
por fichas de entrada en caché de 1M
$0.09<=512K $0.0675$0.18>512K $0.135
Búsqueda web (Linkup)
por llamada cuando se invoca
$0.013
Probar :priority en el playground

API de MiniMax M3: preguntas frecuentes

¿Cuánto cuesta la API de MiniMax M3?

En EmpirioLabs, MiniMax M3 se factura por uso. La tabla de tarifas en vivo de esta página siempre coincide con lo que cobra la API.

¿Cuál es la ventana de contexto de MiniMax M3?

MiniMax M3 admite una ventana de contexto de 1M tokens con hasta 524.288 tokens de salida por respuesta.

¿La API de MiniMax M3 es compatible con OpenAI?

Sí. MiniMax M3 sirve la API de Chat Completions compatible con OpenAI, así que los SDKs de OpenAI existentes funcionan apuntando base_url a https://api.empiriolabs.ai/v1 y usando el id de modelo minimax-m3.

¿Qué variantes de MiniMax M3 están disponibles?

MiniMax M3 está disponible como 2 ids de modelo: el predeterminado minimax-m3 más minimax-m3:priority (Singapore). Las variantes pueden diferir en región de servicio, precios o parámetros compatibles; las tablas de tarifas de cada una están en esta página.

¿Puedo probar MiniMax M3 en el navegador antes de integrar?

Sí. El playground de EmpirioLabs ejecuta MiniMax M3 en el navegador con los mismos parámetros que expone la API, para que pruebes prompts antes de escribir código.

¿Cómo consigo una clave de API de MiniMax M3?

Crea una cuenta de EmpirioLabs y genera una clave en API Keys en el panel. La facturación es con créditos de pago por uso, así que solo pagas por las solicitudes que haces.

¿Listo para usar mejores endpoints?

Consulta nuestros precios o contacta con nosotros si quieres que tu propio modelo se implemente en nuestra pila.