Kimi K3、GLM 5.2 和 DeepSeek V4 Pro 是 EmpirioLabs 上的三款旗舰推理机型,每个都支持100万令牌上下文。 这三者都先推理再回答,调用带有函数调用的工具,返回结构化JSON,且都运行在同一个兼容OpenAI的API,所以你可以通过更换一个字段来切换它们。本文比较了它们在实际推理、编码和代理工作中重要的事实:上下文窗口、价格、模态和能力。
一眼看
| 型号 | 背景 | 输入 | 产出 | 图片 + 视频 | 结构化输出 |
|---|---|---|---|---|---|
| Kimi K3 | 1M | $3.00 | $15.00 | 是的 | JSON schema |
| GLM 5.2 | 1M | $1.40 | $4.40 | 仅用文字 | JSON 模式 |
| DeepSeek V4 Pro | 1M | $1.65 | $3.30 | 仅用文字 | JSON schema |
输入和输出价格为当前pay-as-you-go每100万代币的美元汇率,且可能发生变化。实时数据始终存在于每个模型页面,且 定价页面.这三者都支持推理和函数调用,并行工具调用,并且都可以按搜索付费使用网页搜索。
Kimi K3
Moonshot的旗舰推理模型,也是三者中唯一能同时读取图像和视频的,同时拥有100万令牌上下文。思维始终在线,你可以通过推理努力控制来调节推理难度。它内置了原生网页搜索,因此适合需要实时信息和深度推理的多模态分析和代理循环。它是三者中最昂贵的,所以当你需要视觉、顶级推理和庞大上下文时,选择它。参见 Kimi K3 型号页面。 。 。.
GLM 5.2
Z.ai 的旗舰推理与编码模型,同样支持100万上下文,支持可调节推理努力和原生网页搜索。它在三者中输入成本最低,且仅支持文本,其结构化输出为JSON模式,即任何有效的JSON对象,而非严格的JSON模式。它是成本敏感的文本推理和编码的强力选择,同时仍希望获得实时的网页结果。参见 GLM 5.2 型号页面。 。 。.
DeepSeek V4 Pro
这是一个强大的推理和编码模型,处于100万上下文中,价格介于另外两者之间。它仅支持文本,返回严格的JSON模式,适合需要保证结构的提取和工具流水线。网页搜索作为可选插件提供。选择用于大型文本代码库和文档,这些文档需要严格的结构化输出且不需要多模态输入。参见 DeepSeek V4 Pro 型号页面。 。 。.
选哪一个
- 规模化的愿景与顶尖推理: Kimi K3。唯一能读取图片和视频的,始终在线可调推理,原生网页搜索,且上下文达100万。
- 最低成本的文本推理: GLM 5.2。三者中最便宜的输入,支持可调节推理努力和原生网页搜索。
- 更低价格的严格JSON: DeepSeek V4 Pro. JSON模式输出和强编码,仅用文本时可以 1M 上下文。
如何称呼他们
这三个端口都使用同一个端点。交换 模型 换场:
curl https://api.empiriolabs.ai/v1/chat/completions \ -h “授权:承载者 $EMPIRIOLABS_API_KEY” \ -h “内容类型:application/json” \ -d '{ “model”: “kimi-k3”, “messages”: [{“role”: “user”, “content”: “解释并修复此函数中的bug。”}] }'
用途 glm-5-2 (英语) 或 deepseek-v4-pro 作为另外两个的型号ID。它们也适用于 /v1/responses (英语), (中文), /v1/messages (英语)以及双子座兼容路线。
常见问题解答
哪种最便宜?
GLM 5.2 在三者中输入价格最低。DeepSeek V4 Pro 处于中间位置,Kimi K3 价格最高,但是唯一支持图像和视频输入的。
它们都有100万上下文窗口吗?
是的。Kimi K3、GLM 5.2 和 DeepSeek V4 Pro 都支持一个 100 万令牌上下文。
哪些支持图像和视频输入?
只有Kimi K3。GLM 5.2和DeepSeek V4 Pro是纯文本。
哪个会返回严格的JSON模式?
Kimi K3 和 DeepSeek V4 Pro 可以强制输出与你提供的模式相符的方案。GLM 5.2 支持 JSON 模式,返回任何有效的 JSON 对象。
它们都支持推理和工具吗?
是的。这三者都应该考虑,回答前可以做功能调用,并用并行工具调用,并且可以使用网页搜索。



