
Kimi K3 是 Moonshot 的旗舰推理模型,具备 100 万令牌上下文、始终在线思维、原生网页搜索以及文本、图片和视频输入。
Kimi K3 是 Moonshot 的旗舰推理模型,具备 100 万令牌上下文、始终在线思维、原生网页搜索以及文本、图片和视频输入。
支持文本、图像和视频输入、函数调用、JSON schema结构化输出,以及内置网页搜索,按每次调用计费$0.015。思维始终开启,并可调reasoning_effort控制(推荐最大值);推理令牌作为输出令牌计费。温度和其他采样覆盖由模型服务固定。多步函数调用必须保持reasoning_content字段完整地重放助手消息。不支持显式缓存控制、批处理和微调。
也称为 Moonshot AI Kimi K3
kimi-k3/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/kimi-k3:generateContentmoonshotai/kimi-k3来自 EmpirioLabs 目录的实时按量计费价格。只为实际用量付费,没有月度最低消费。
Kimi K3 提供 OpenAI 兼容的 Chat Completions API。用你的 EmpirioLabs API 密钥把任意 OpenAI SDK 指向 https://api.empiriolabs.ai/v1,并使用模型 ID kimi-k3。 在EmpirioLabs 控制台获取 API 密钥。
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "kimi-k3",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="kimi-k3",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)EmpirioLabs 上 Kimi K3 API 支持的请求参数。省略字段时使用默认值。
| 参数 | 类型 | 默认值 | 范围 / 值 | 描述 |
|---|---|---|---|---|
| max_tokens | number | 32768 | 1 到 1048576 | 最大输出令牌。推理代币计入此限额。 |
| stop | string | - | - | 最多有4串字符串,模型会停止生成更多代币。 |
| reasoning_effort | enum | max | low, high, max | Kimi K3推理努力。思考始终在进行。努力越高,回答前花费的推理代币越多。推荐最高且默认。 |
| tool_web_search | boolean | false | - | 在网上搜索实时信息。每次调用的网络搜索调用的请求成本增加了$0.015。 |
| response_format | enum | - | - | 将输出限制为JSON。对任何有效的 JSON 对象使用 JSON 模式,或者用 JSON 模式强制输出与你提供的模式相符的模式。 |
支持文本、图像和视频输入,带有100万令牌上下文,函数调用,JSON模式结构化输出,以及每个调用$0.015的内置网页搜索。思考始终开启;推理深度可通过reasoning_effort控制调节(建议最大),推理令牌作为输出令牌计费。温度及其他采样设置由模型服务确定。通过API进行多步函数调用,必须重放助手消息,且其reasoning_content字段保持完整。
When this model invokes built-in tools inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts. Tool counts are already factored into cost_usd and are surfaced for transparency.
在 EmpirioLabs,Kimi K3 按量计费:输入 $3.00 每100万个提示词标记; 产出 $15.00 每100万个生成代币; 网络搜索 $0.015 每次调用时。本页的实时价格表始终与 API 的实际计费一致。
Kimi K3 支持 1M token 的上下文窗口,每次响应最多 131,072 个输出 token。
兼容。Kimi K3 提供 OpenAI 兼容的 Chat Completions API,现有 OpenAI SDK 只需把 base_url 指向 https://api.empiriolabs.ai/v1 并把模型 ID 设为 kimi-k3 即可使用。
可以。EmpirioLabs Playground在浏览器中以与 API 相同的参数运行 Kimi K3,你可以在写代码之前先测试提示词。
创建 EmpirioLabs 账户,然后在控制台的 API Keys生成密钥。计费使用按量付费的额度,只为实际发出的请求付费。