MiniMax M3 API

MiniMax M3 é um modelo de raciocínio multimodal para codificação, agentes e análise de contexto longo com texto, imagem e entrada de vídeo.

MiniMaxGeração de Texto1M contextoLançado 1 de jun. de 2026SingaporeEndpoint proprietárioNovo

Sobre MiniMax M3

MiniMax M3 é um modelo de raciocínio multimodal para codificação, agentes e análise de contexto longo com texto, imagem e entrada de vídeo.

Suporta entradas de texto, imagem e vídeo, pensamento adaptativo através de enable thinking, chamadas de função e leituras de cache implícitas. Os preços são discriminados por tokens imediatos, incluindo hits de cache: <=512K usa o nível padrão descontado, enquanto >512K usa o nível de alto contexto. Pensar tokens são faturados como tokens de saída. O linkup web search está disponível através de web_search_linkup e adiciona $0.013 por pesquisa bem sucedida.

Também conhecido como MiniMax-M3

reasoningvisionvideoweb searchfunction callingcachelong contexto

Especificações de MiniMax M3

ID do modelo
minimax-m3
Provedor
MiniMax
Categoria
Geração de Texto
Lançado
1 de jun. de 2026
Janela de contexto
1M tokens
Saída máxima
524.288 tokens
Entrada
TextoImagemVídeo
Saída
Texto
Saída estruturada
Modo JSON
Região
Singapore
Endpoints
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/minimax-m3:generateContent
IDs de modelo alternativos
minimax-m3-standardminimax/m3minimax/m3-standard

Preços da API MiniMax M3Economize até 25%

Tarifas pay-as-you-go ao vivo do catálogo EmpirioLabs. Você paga só pelo que usa, sem mínimo mensal.

Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.30<=512K $0.225$0.60>512K $0.45
Saída
por tokens gerados 1M
$1.20<=512K $0.90$2.40>512K $1.80
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
$0.06<=512K $0.045$0.12>512K $0.09
Busca na Web (Linkup)
por chamada quando invocado
$0.013
Comparar na página completa de preços

Como chamar a API MiniMax M3

MiniMax M3 atende a API Chat Completions compatível com OpenAI. Aponte qualquer SDK OpenAI para https://api.empiriolabs.ai/v1 com sua chave de API EmpirioLabs e use o id de modelo minimax-m3. Obtenha uma chave de API no painel EmpirioLabs.

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "minimax-m3",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="minimax-m3",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
Referência completa da API MiniMax M3

Parâmetros da API MiniMax M3

Parâmetros de requisição suportados pela API MiniMax M3 na EmpirioLabs. Os padrões valem quando um campo é omitido.

ParâmetroTipoPadrãoIntervalo / valoresDescrição
temperaturenumber10 a 2Controla a aleatoriedade. Valores mais baixos são mais determinísticos; valores mais altos são mais exploratórios.
top_pnumber0.950 a 1Controla a amostragem do núcleo limitando a geração à massa token mais provável.
max_completion_tokensinteger40961 a 524288Token máximo gerado, incluindo tokens de raciocínio quando o pensamento está ativado.
stoparray--Sequência opcional de paradas ou lista de sequências de paradas.
enable_thinkingbooleantrue-Ative o pensamento adaptativo em modelos antes de responder. Defina false para pedir uma resposta direta sem uma fase de raciocínio.
web_search_linkupbooleanfalse-Busca opcional na web alimentada pelo Linkup. Quando ativadas, fontes web recentes são recuperadas usando sua última mensagem de usuário como consulta e fornecidas ao modelo como contexto adicional. Adiciona $0.013 por chamada quando invocada, além do custo normal do token do modelo. Desativado por padrão.
toolsarray--Definições de ferramentas compatíveis com OpenAI para chamadas de funções.
tool_choiceobject--Opcional compatível com OpenAI tool_choice valor.
response_formatenum--Devolva a saída como um objeto JSON válido (modo JSON). Descreva as áreas que você quer no seu prompt.

Bom saber

Entrada de texto, imagem e vídeo com saída de texto. O pensamento é adaptativo e pode ser desativado. A precificação é baseada em tokens de entrada, incluindo os acertos de cache: <=512K usa o nível padrão com desconto, enquanto >512K usa o nível de alto contexto. Suporta até 1 milhão de tokens de entrada. A busca web do Linkup está disponível através do web_search_linkup e adiciona $0.013 por busca bem-sucedida.

:priority

Este é o nível de serviço prioritário: os pedidos recebem admissão prioritária para tempos de resposta mais rápidos e maior confiabilidade, com preços acima da rota padrão do MiniMax M3. Entrada de texto, imagem e vídeo com saída de texto. O pensamento é adaptativo e pode ser desativado. A precificação é dividida em níveis de tokens de entrada, incluindo os acertos no cache, com <=512K mais barato que >512K. Suporta até 1 milhão de tokens de entrada. A busca web do Linkup está disponível através do web_search_linkup e adiciona $0.013 por busca bem-sucedida.

Variantes de MiniMax M3

Variantes são versões alternativas de MiniMax M3 com id de modelo próprio. Dependendo da variante, podem diferir em região de serviço, preços ou parâmetros suportados; todo o resto funciona igual.

MiniMax M3 :priorityEconomize até 25%

ID do modelo
minimax-m3:priority
Região
Singapore
Janela de contexto
1M tokens
Saída estruturada
Modo JSON
Tipo
Especificação
Tarifa
Entrada
por fichas de alerta de 1M
$0.45<=512K $0.3375$0.90>512K $0.675
Saída
por tokens gerados 1M
$1.80<=512K $1.35$3.60>512K $2.70
Leu a 'cache' implícita
por fichas de entrada em cache de 1M
$0.09<=512K $0.0675$0.18>512K $0.135
Busca na Web (Linkup)
por chamada quando invocado
$0.013
Testar :priority no playground

API MiniMax M3: perguntas frequentes

Quanto custa a API MiniMax M3?

Na EmpirioLabs, MiniMax M3 é cobrado por uso. A tabela de tarifas ao vivo desta página sempre corresponde ao que a API cobra.

Qual é a janela de contexto de MiniMax M3?

MiniMax M3 suporta uma janela de contexto de 1M tokens com até 524.288 tokens de saída por resposta.

A API MiniMax M3 é compatível com OpenAI?

Sim. MiniMax M3 atende a API Chat Completions compatível com OpenAI, então SDKs OpenAI existentes funcionam apontando base_url para https://api.empiriolabs.ai/v1 e definindo o id de modelo minimax-m3.

Quais variantes de MiniMax M3 estão disponíveis?

MiniMax M3 está disponível como 2 ids de modelo: o padrão minimax-m3 mais minimax-m3:priority (Singapore). Variantes podem diferir em região de serviço, preços ou parâmetros suportados; as tabelas de tarifas de cada uma estão nesta página.

Posso testar MiniMax M3 no navegador antes de integrar?

Sim. O playground da EmpirioLabs executa MiniMax M3 no navegador com os mesmos parâmetros que a API expõe, para você testar prompts antes de escrever código.

Como consigo uma chave de API MiniMax M3?

Crie uma conta EmpirioLabs e gere uma chave em API Keys no painel. A cobrança usa créditos pay-as-you-go, então você paga apenas pelas requisições que faz.

Pronto para usar endpoints melhores?

Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.