MiniMax M3 API

MiniMax M3是一种多模式推理模型,用于编码,代理,以及带有文本,图像,视频输入的长文本分析.

MiniMax文本生成1M 上下文发布日期 2026年6月1日Singapore专有端点

关于 MiniMax M3

MiniMax M3是一种多模式推理模型,用于编码,代理,以及带有文本,图像,视频输入的长文本分析.

支持文本、图像和视频输入、通过允许 思考的适应性思维、函数调用和隐含的即时缓存读取。 定价通过包括缓存命中数在内的即时令牌进行分级:QQ512K使用折扣标准级,而>512K使用高文本级. 思维符记为输出符记. Linkup web 搜索通过 web_search_linkup 提供,并每次成功搜索都加入 $0.013.

也称为 MiniMax-M3

reasoningvisionvideoweb searchfunction callingcachelong 上下文

MiniMax M3 规格

模型 ID
minimax-m3
提供方
MiniMax
类别
文本生成
发布日期
2026年6月1日
上下文窗口
1M 个 token
最大输出
524,288 个 token
输入
文本图像视频
输出
文本
结构化输出
JSON 模式
区域
Singapore
端点
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/minimax-m3:generateContent
备用模型 ID
minimax-m3-standardminimax/m3minimax/m3-standard

MiniMax M3 API 价格最高省 25%

来自 EmpirioLabs 目录的实时按量计费价格。只为实际用量付费,没有月度最低消费。

类型
规格
价格
投入
每1M 提示符
$0.30<=512K $0.225$0.60>512K $0.45
产出
每1M个生成的令牌
$1.20<=512K $0.90$2.40>512K $1.80
隐形缓存已读
每1M缓存输入符
$0.06<=512K $0.045$0.12>512K $0.09
网络搜索(链接)
引用时每次呼叫
$0.013
在完整价格页比较

如何调用 MiniMax M3 API

MiniMax M3 提供 OpenAI 兼容的 Chat Completions API。用你的 EmpirioLabs API 密钥把任意 OpenAI SDK 指向 https://api.empiriolabs.ai/v1,并使用模型 ID minimax-m3。 在EmpirioLabs 控制台获取 API 密钥。

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "minimax-m3",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="minimax-m3",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
MiniMax M3 API 完整参考

MiniMax M3 API 参数

EmpirioLabs 上 MiniMax M3 API 支持的请求参数。省略字段时使用默认值。

参数类型默认值范围 / 值描述
temperaturenumber10 到 2控制随机性。较低的数值则更具确定性;更高的数值则更具探索性。
top_pnumber0.950 到 1通过限制生成到最可能的标记质量来控制核采样。
max_completion_tokensinteger40961 到 524288最大生成的代币,包括在思考时的推理代币。
stoparray--可选的停止序列或停止序列列表。
enable_thinkingbooleantrue-在回答之前,先启用自适应模型思维。设为false,要求直接回答,无需推理阶段。
web_search_linkupbooleanfalse-可选的网页搜索由Linkup提供。启用后,最近的网页源会通过最新的用户消息作为查询检索,并作为额外上下文提供给模型。每次调用时,在模型正常的令牌成本基础上额外增加$0.013。默认为禁用。
toolsarray--兼容 OpenAI 的函数调用工具定义。
tool_choiceobject--可选兼容OpenAI的tool_choice值。
response_formatenum--返回输出为有效的 JSON 对象(JSON 模式)。描述你在提示词中想要的字段。

须知

文本、图像和视频输入,输出文本。思维默认为适应性,可以被禁用。定价基于输入代币,包括缓存命中:<=512K使用折扣标准层,而>512K使用高上下文层。支持最多100万个输入令牌。链接网络搜索可通过web_search_linkup进行,每成功搜索一次会增加$0.013。

:priority

这是优先服务层级:请求获得优先准入,以加快响应速度和提升可靠性,价格高于标准MiniMax M3路由。文本、图像和视频输入,输出文本。思维默认为适应性,可以被禁用。定价按输入代币分层,包括缓存命中,<=512K比>512K便宜。支持最多100万个输入令牌。链接网络搜索可通过web_search_linkup进行,每成功搜索一次会增加$0.013。

MiniMax M3 变体

变体是拥有独立模型 ID 的 MiniMax M3 替代版本。不同变体的服务区域、价格或支持的参数可能不同;其他方面完全一致。

MiniMax M3 :priority最高省 25%

模型 ID
minimax-m3:priority
区域
Singapore
上下文窗口
1M 个 token
结构化输出
JSON 模式
类型
规格
价格
投入
每1M 提示符
$0.45<=512K $0.3375$0.90>512K $0.675
产出
每1M个生成的令牌
$1.80<=512K $1.35$3.60>512K $2.70
隐形缓存已读
每1M缓存输入符
$0.09<=512K $0.0675$0.18>512K $0.135
网络搜索(链接)
引用时每次呼叫
$0.013
在 Playground 中试用 :priority

MiniMax M3 API:常见问题

MiniMax M3 API 收费多少?

在 EmpirioLabs,MiniMax M3 按量计费。本页的实时价格表始终与 API 的实际计费一致。

MiniMax M3 的上下文窗口有多大?

MiniMax M3 支持 1M token 的上下文窗口,每次响应最多 524,288 个输出 token。

MiniMax M3 API 兼容 OpenAI 吗?

兼容。MiniMax M3 提供 OpenAI 兼容的 Chat Completions API,现有 OpenAI SDK 只需把 base_url 指向 https://api.empiriolabs.ai/v1 并把模型 ID 设为 minimax-m3 即可使用。

MiniMax M3 有哪些变体可用?

MiniMax M3 提供 2 个模型 ID:默认的 minimax-m3 以及 minimax-m3:priority (Singapore)。变体的服务区域、价格或支持的参数可能不同;各自的价格表都在本页。

集成之前可以在浏览器里试用 MiniMax M3 吗?

可以。EmpirioLabs Playground在浏览器中以与 API 相同的参数运行 MiniMax M3,你可以在写代码之前先测试提示词。

如何获取 MiniMax M3 API 密钥?

创建 EmpirioLabs 账户,然后在控制台的 API Keys生成密钥。计费使用按量付费的额度,只为实际发出的请求付费。

准备好使用更好的终端了吗?

查看我们的定价,或者如果你想将自己的模型部署到我们的堆栈中,请联系我们。