
202K文脈、128K出力、ツール呼び出し、構造化された出力、キャッシュサポートのモデルを推論するロングコンテキストZhipu AI。
202K文脈、128K出力、ツール呼び出し、構造化された出力、キャッシュサポートのモデルを推論するロングコンテキストZhipu AI。
注意: - 中国展開モードのAlibabaクラウドモデルスタジオによって編まれる - コンテキストウィンドウ:202Kトークン - 最大出力:128Kトークン - サポート機能呼び出し、構造化された出力、およびコンテキストキャッシュ - 構造化された出力は、 enable thinking=falseで実行する必要があります - Web検索、バッチ、プレフィックスの継続、または微調整をサポートしていません
別名 Z.ai GLM 5.1, GLM-5.1, glm-5-1
glm-5-1/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/glm-5-1:generateContentEmpirioLabs カタログのライブ従量課金料金です。使った分だけの支払いで、月額最低料金はありません。
GLM 5.1 は OpenAI 互換の Chat Completions API を提供します。任意の OpenAI SDK を EmpirioLabs API キーで https://api.empiriolabs.ai/v1 に向け、モデル ID glm-5-1 を使ってください。 EmpirioLabs ダッシュボードで API キーを取得してください。
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5-1",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="glm-5-1",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)EmpirioLabs 上の GLM 5.1 API が対応するリクエストパラメーターです。フィールドを省略した場合はデフォルト値が適用されます。
| パラメータ | タイプ | デフォルト | 範囲 / 値 | 説明 |
|---|---|---|---|---|
| max_tokens | integer | 4096 | 1 から 128000 | 生成できる最大出力トークン数。 |
| temperature | number | 1 | 0 から 2 | ランダム性を制御します。値が低いほど応答はより決定的になります。 |
| top_p | number | 0.95 | 0 から 1 | 核サンプリングカットオフ。 |
| top_k | integer | 20 | 1 から 100 | サンプリングは上位Kトークンに限定します。 |
| repetition_penalty | number | 1 | 0.1 から 2 | 繰り返しトークンを使った場合にペナルティを与えます。 |
| reasoning_effort | enum | medium | none, low, medium, high, max | 推論の努力レベル。誰も思考を妨げるものではありません。低、中、高、最大は選択したモデルに合わせて限定された思考予算を設定します。OpenAIスタイルのreasoning_effortフィールドとして送られ、モデルサービス用にenable_thinkingとthinking_budgetに翻訳されました。 |
| enable_thinking | boolean | true | - | 答える前にモデルに理屈を持たせてください。厳密な構造化出力のためにこれを無効にしてください。 |
| thinking_budget | integer | 32768 | 1 から 38912 | 思考時に思考するコンテンツの最大トークンが有効になっています。 |
| tool_stream | boolean | false | - | ストリーム中に関数呼び出しの引数を段階的に行います。 |
| tools | array | [] | - | OpenAI互換の関数呼び出しツール定義。 |
| tool_choice | object | - | - | OpenAI互換のツール選択制御。 |
| parallel_tool_calls | boolean | true | - | サポートされている場合、1ターンのアシスタントターンで複数のツールコールを許可してください。 |
| stop | array | - | - | オプションの停止シーケンス。 |
| response_format | enum | - | - | 出力をJSONに制約します。有効なJSONオブジェクトにはJSONモードを使い、提供したスキーマに一致する出力を強制的に行ってください。 |
EmpirioLabs では GLM 5.1 は従量課金です。このページのライブ料金表は常に API の請求額と一致します。
GLM 5.1 は 202K トークンのコンテキストウィンドウに対応しています。
はい。GLM 5.1 は OpenAI 互換の Chat Completions API を提供しているため、既存の OpenAI SDK は base_url を https://api.empiriolabs.ai/v1 に向けてモデル ID を glm-5-1 に設定するだけで動作します。
はい。EmpirioLabs プレイグラウンドでは API と同じパラメーターで GLM 5.1 をブラウザ上で実行できるので、コードを書く前にプロンプトを試せます。
EmpirioLabs アカウントを作成し、ダッシュボードの API Keysでキーを生成してください。課金は従量制クレジットなので、実行したリクエストの分だけ支払います。