MiniMax M3 是一种多模态推理模型,用于编码、代理和长上下文分析,包含文本、图像和视频输入。
支持文本、图像和视频输入,自适应思维enable_thinking、函数调用和隐式提示缓存读取。定价按提示令牌分层,包括缓存命中:<=512K使用折扣标准层,>512K使用高上下文层。思考令牌作为输出令牌计费。链接网页搜索通过web_search_linkup提供,每成功搜索增加$0.013。
minimax-m3/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/minimax-m3:generateContentminimax-m3-standardminimax/m3minimax/m3-standard来自 EmpirioLabs 目录的实时按量计费价格。只为实际用量付费,没有月度最低消费。
MiniMax M3 提供 OpenAI 兼容的 Chat Completions API。用你的 EmpirioLabs API 密钥把任意 OpenAI SDK 指向 https://api.empiriolabs.ai/v1,并使用模型 ID minimax-m3。 在EmpirioLabs 控制台获取 API 密钥。
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "minimax-m3",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="minimax-m3",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)EmpirioLabs 上 MiniMax M3 API 支持的请求参数。省略字段时使用默认值。
| 参数 | 类型 | 默认值 | 范围 / 值 | 描述 |
|---|---|---|---|---|
| temperature | number | 1 | 0 到 2 | 控制随机性。较低的数值则更具确定性;更高的数值则更具探索性。 |
| top_p | number | 0.95 | 0 到 1 | 通过限制生成到最可能的标记质量来控制核采样。 |
| max_completion_tokens | integer | 4096 | 1 到 524288 | 最大生成的代币,包括在思考时的推理代币。 |
| stop | array | - | - | 可选的停止序列或停止序列列表。 |
| enable_thinking | boolean | true | - | 在回答之前,先启用自适应模型思维。设为false,要求直接回答,无需推理阶段。 |
| web_search_linkup | boolean | false | - | 可选的网页搜索由Linkup提供。启用后,最近的网页源会通过最新的用户消息作为查询检索,并作为额外上下文提供给模型。每次调用时,在模型正常的令牌成本基础上额外增加$0.013。默认为禁用。 |
| tools | array | - | - | 兼容 OpenAI 的函数调用工具定义。 |
| tool_choice | object | - | - | 可选兼容OpenAI的tool_choice值。 |
| response_format | enum | - | - | 返回输出为有效的 JSON 对象(JSON 模式)。描述你在提示词中想要的字段。 |
| disable_formatting | boolean | false | - | 启用后,网关不会在使用Linkup网页搜索的助理响应中附加“来源”脚部。当模型输出被传输到另一个不需要装饰的系统时,这很有用。 |
文本、图像和视频输入,输出文本。思维默认为适应性,可以被禁用。定价基于输入代币,包括缓存命中:<=512K使用折扣标准层,而>512K使用高上下文层。支持最多100万个输入令牌。链接网络搜索可通过web_search_linkup进行,每成功搜索一次会增加$0.013。
:priority
这是优先服务层级:请求获得优先准入,以加快响应速度和提升可靠性,价格高于标准MiniMax M3路由。文本、图像和视频输入,输出文本。思维默认为适应性,可以被禁用。定价按输入代币分层,包括缓存命中,<=512K比>512K便宜。支持最多100万个输入令牌。链接网络搜索可通过web_search_linkup进行,每成功搜索一次会增加$0.013。
变体是拥有独立模型 ID 的 MiniMax M3 替代版本。不同变体的服务区域、价格或支持的参数可能不同;其他方面完全一致。
minimax-m3:priority在 EmpirioLabs,MiniMax M3 按量计费。本页的实时价格表始终与 API 的实际计费一致。
MiniMax M3 支持 1M token 的上下文窗口,每次响应最多 524,288 个输出 token。
兼容。MiniMax M3 提供 OpenAI 兼容的 Chat Completions API,现有 OpenAI SDK 只需把 base_url 指向 https://api.empiriolabs.ai/v1 并把模型 ID 设为 minimax-m3 即可使用。
MiniMax M3 提供 2 个模型 ID:默认的 minimax-m3 以及 minimax-m3:priority (Singapore)。变体的服务区域、价格或支持的参数可能不同;各自的价格表都在本页。
可以。EmpirioLabs Playground在浏览器中以与 API 相同的参数运行 MiniMax M3,你可以在写代码之前先测试提示词。
创建 EmpirioLabs 账户,然后在控制台的 API Keys生成密钥。计费使用按量付费的额度,只为实际发出的请求付费。