
MiniMax M3 é um modelo de raciocínio multimodal para codificação, agentes e análise de contexto longo com texto, imagem e entrada de vídeo.
MiniMax M3 é um modelo de raciocínio multimodal para codificação, agentes e análise de contexto longo com texto, imagem e entrada de vídeo.
Suporta entradas de texto, imagem e vídeo, pensamento adaptativo através de enable thinking, chamadas de função e leituras de cache implícitas. Os preços são discriminados por tokens imediatos, incluindo hits de cache: <=512K usa o nível padrão descontado, enquanto >512K usa o nível de alto contexto. Pensar tokens são faturados como tokens de saída. O linkup web search está disponível através de web_search_linkup e adiciona $0.013 por pesquisa bem sucedida.
Também conhecido como MiniMax-M3
minimax-m3/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/minimax-m3:generateContentminimax-m3-standardminimax/m3minimax/m3-standardTarifas pay-as-you-go ao vivo do catálogo EmpirioLabs. Você paga só pelo que usa, sem mínimo mensal.
MiniMax M3 atende a API Chat Completions compatível com OpenAI. Aponte qualquer SDK OpenAI para https://api.empiriolabs.ai/v1 com sua chave de API EmpirioLabs e use o id de modelo minimax-m3. Obtenha uma chave de API no painel EmpirioLabs.
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "minimax-m3",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="minimax-m3",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)Parâmetros de requisição suportados pela API MiniMax M3 na EmpirioLabs. Os padrões valem quando um campo é omitido.
| Parâmetro | Tipo | Padrão | Intervalo / valores | Descrição |
|---|---|---|---|---|
| temperature | number | 1 | 0 a 2 | Controla a aleatoriedade. Valores mais baixos são mais determinísticos; valores mais altos são mais exploratórios. |
| top_p | number | 0.95 | 0 a 1 | Controla a amostragem do núcleo limitando a geração à massa token mais provável. |
| max_completion_tokens | integer | 4096 | 1 a 524288 | Token máximo gerado, incluindo tokens de raciocínio quando o pensamento está ativado. |
| stop | array | - | - | Sequência opcional de paradas ou lista de sequências de paradas. |
| enable_thinking | boolean | true | - | Ative o pensamento adaptativo em modelos antes de responder. Defina false para pedir uma resposta direta sem uma fase de raciocínio. |
| web_search_linkup | boolean | false | - | Busca opcional na web alimentada pelo Linkup. Quando ativadas, fontes web recentes são recuperadas usando sua última mensagem de usuário como consulta e fornecidas ao modelo como contexto adicional. Adiciona $0.013 por chamada quando invocada, além do custo normal do token do modelo. Desativado por padrão. |
| tools | array | - | - | Definições de ferramentas compatíveis com OpenAI para chamadas de funções. |
| tool_choice | object | - | - | Opcional compatível com OpenAI tool_choice valor. |
| response_format | enum | - | - | Devolva a saída como um objeto JSON válido (modo JSON). Descreva as áreas que você quer no seu prompt. |
Entrada de texto, imagem e vídeo com saída de texto. O pensamento é adaptativo e pode ser desativado. A precificação é baseada em tokens de entrada, incluindo os acertos de cache: <=512K usa o nível padrão com desconto, enquanto >512K usa o nível de alto contexto. Suporta até 1 milhão de tokens de entrada. A busca web do Linkup está disponível através do web_search_linkup e adiciona $0.013 por busca bem-sucedida.
:priority
Este é o nível de serviço prioritário: os pedidos recebem admissão prioritária para tempos de resposta mais rápidos e maior confiabilidade, com preços acima da rota padrão do MiniMax M3. Entrada de texto, imagem e vídeo com saída de texto. O pensamento é adaptativo e pode ser desativado. A precificação é dividida em níveis de tokens de entrada, incluindo os acertos no cache, com <=512K mais barato que >512K. Suporta até 1 milhão de tokens de entrada. A busca web do Linkup está disponível através do web_search_linkup e adiciona $0.013 por busca bem-sucedida.
Variantes são versões alternativas de MiniMax M3 com id de modelo próprio. Dependendo da variante, podem diferir em região de serviço, preços ou parâmetros suportados; todo o resto funciona igual.
minimax-m3:priorityNa EmpirioLabs, MiniMax M3 é cobrado por uso. A tabela de tarifas ao vivo desta página sempre corresponde ao que a API cobra.
MiniMax M3 suporta uma janela de contexto de 1M tokens com até 524.288 tokens de saída por resposta.
Sim. MiniMax M3 atende a API Chat Completions compatível com OpenAI, então SDKs OpenAI existentes funcionam apontando base_url para https://api.empiriolabs.ai/v1 e definindo o id de modelo minimax-m3.
MiniMax M3 está disponível como 2 ids de modelo: o padrão minimax-m3 mais minimax-m3:priority (Singapore). Variantes podem diferir em região de serviço, preços ou parâmetros suportados; as tabelas de tarifas de cada uma estão nesta página.
Sim. O playground da EmpirioLabs executa MiniMax M3 no navegador com os mesmos parâmetros que a API expõe, para você testar prompts antes de escrever código.
Crie uma conta EmpirioLabs e gere uma chave em API Keys no painel. A cobrança usa créditos pay-as-you-go, então você paga apenas pelas requisições que faz.
Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.