
Kimi K3は、1Mトークンコンテキスト、常時稼働型思考、ネイティブウェブ検索、テキスト、画像、動画入力を備えたMoonshotの旗艦推論モデルです。
Kimi K3は、1Mトークンコンテキスト、常時稼働型思考、ネイティブウェブ検索、テキスト、画像、動画入力を備えたMoonshotの旗艦推論モデルです。
テキスト、画像、ビデオ入力、関数呼び出し、JSONスキーマ構造化出力、呼び出しごとに$0.015請求される組み込みウェブ検索をサポートします。思考は常にオンで、調整可能なreasoning_effortコントロール(最大推奨)があります。推論トークンは出力トークンとして課金されます。温度やその他のサンプリングオーバーライドはモデルサービスによって決定されます。多段階関数呼び出しは、reasoning_contentフィールドを保持したままアシスタントメッセージを再生しなければなりません。明示的なキャッシュ制御、バッチ処理、ファインチューニングはサポートされていません。
別名 Moonshot AI Kimi K3
kimi-k3/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/kimi-k3:generateContentmoonshotai/kimi-k3EmpirioLabs カタログのライブ従量課金料金です。使った分だけの支払いで、月額最低料金はありません。
Kimi K3 は OpenAI 互換の Chat Completions API を提供します。任意の OpenAI SDK を EmpirioLabs API キーで https://api.empiriolabs.ai/v1 に向け、モデル ID kimi-k3 を使ってください。 EmpirioLabs ダッシュボードで API キーを取得してください。
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "kimi-k3",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="kimi-k3",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)EmpirioLabs 上の Kimi K3 API が対応するリクエストパラメーターです。フィールドを省略した場合はデフォルト値が適用されます。
| パラメータ | タイプ | デフォルト | 範囲 / 値 | 説明 |
|---|---|---|---|---|
| max_tokens | number | 32768 | 1 から 1048576 | 最大出力トークン。推論トークンもこの制限にカウントされます。 |
| stop | string | - | - | 最大4つの文字列で、モデルはこれ以上のトークン生成を停止します。 |
| reasoning_effort | enum | max | low, high, max | キミK3の推論努力。常に思考が続けられています。努力が高いほど、答える前により多くの推論トークンを消費します。最大限の制限が推奨され、それがデフォルトです。 |
| tool_web_search | boolean | false | - | リアルタイムの情報をウェブで検索しましょう。呼び出すウェブ検索コールごとにリクエストコストが$0.015増加します。 |
| response_format | enum | - | - | 出力をJSONに制約します。有効なJSONオブジェクトにはJSONモードを使い、提供したスキーマに一致する出力を強制的に行ってください。 |
1Mトークンコンテキスト付きテキスト、画像、ビデオ入力をサポートし、関数呼び出し、JSONスキーマ構造化出力、呼び出しごとに$0.015の組み込みウェブ検索機能。常に思考は続けられている。推論深度はreasoning_effort制御で調整可能(最大推奨)で、推論トークンは出力トークンとして請求されます。温度やその他のサンプリング設定はモデルサービスによって決定されます。APIを通じた多段階関数呼び出しは、reasoning_contentフィールドを保持したままアシスタントメッセージを再生しなければなりません。
When this model invokes built-in tools inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts. Tool counts are already factored into cost_usd and are surfaced for transparency.
EmpirioLabs では Kimi K3 は従量課金です: 入力 $3.00 1Mプロンプトトークンあたり; ソリューション $15.00 生成された1Mトークンあたり; ウェブ検索 $0.015 呼び出し時の通話ごと。このページのライブ料金表は常に API の請求額と一致します。
Kimi K3 は 1M トークンのコンテキストウィンドウに対応しています(1回の応答あたり最大 131,072 出力トークン)。
はい。Kimi K3 は OpenAI 互換の Chat Completions API を提供しているため、既存の OpenAI SDK は base_url を https://api.empiriolabs.ai/v1 に向けてモデル ID を kimi-k3 に設定するだけで動作します。
はい。EmpirioLabs プレイグラウンドでは API と同じパラメーターで Kimi K3 をブラウザ上で実行できるので、コードを書く前にプロンプトを試せます。
EmpirioLabs アカウントを作成し、ダッシュボードの API Keysでキーを生成してください。課金は従量制クレジットなので、実行したリクエストの分だけ支払います。