
1Mトークンコンテクスト、128K出力、調整可能な推論努力、ネイティブWeb検索、ツールコールによるモデルの調整とコーディング。
1Mトークンコンテクスト、128K出力、調整可能な推論努力、ネイティブWeb検索、ツールコールによるモデルの調整とコーディング。
メモ: - コンテキストウィンドウ: 1M トークン - 最大出力: 128K トークン - 最小値から最大値までの調整可能な推論努力 (複雑なコーディングに推奨される最大値) - 内蔵の Web 検索は、使用時にリクエストごとに $0.033 を追加します - サポート関数呼び出し、構造化された出力、およびストリーミング - 無効に思考で構造化された出力を実行します
別名 Z.ai GLM 5.2, GLM-5.2, glm-5-2
glm-5-2/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/glm-5-2:generateContentglm-5.2zai/glm-5.2zhipu/glm-5.2EmpirioLabs カタログのライブ従量課金料金です。使った分だけの支払いで、月額最低料金はありません。
GLM 5.2 は OpenAI 互換の Chat Completions API を提供します。任意の OpenAI SDK を EmpirioLabs API キーで https://api.empiriolabs.ai/v1 に向け、モデル ID glm-5-2 を使ってください。 EmpirioLabs ダッシュボードで API キーを取得してください。
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5-2",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="glm-5-2",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)EmpirioLabs 上の GLM 5.2 API が対応するリクエストパラメーターです。フィールドを省略した場合はデフォルト値が適用されます。
| パラメータ | タイプ | デフォルト | 範囲 / 値 | 説明 |
|---|---|---|---|---|
| max_tokens | integer | 65536 | 1 から 131072 | 生成できる最大出力トークン数。 |
| temperature | number | 1 | 0 から 1 | ランダム性を制御します。値が低いほど応答はより決定的になります。 |
| top_p | number | 0.95 | 0.01 から 1 | 核サンプリングカットオフ。 |
| reasoning_effort | enum | max | none, minimal, low, medium, high, xhigh, max | GLM-5.2の推論努力。誰も思考を妨げるものではない。最小から最大まで、モデルがどれだけ推理をしているかを決めてから答えます。複雑なコーディングにはMaxが推奨されます。 |
| enable_thinking | boolean | true | - | 答える前にモデルに理屈を持たせてください。最も遅延の少ない返信や厳格な構造化出力のために電源を切ってください。 |
| do_sample | boolean | true | - | サンプリングを有効にしてください。貪欲な決定論的出力(温度とtop_pは無視)には電源を切ってください。 |
| tool_web_search | boolean | false | - | 組み込みのウェブ検索を有効にしてください。使用時にリクエストごとに$0.033個を追加します。 |
| search_recency_filter | enum | noLimit | oneDay, oneWeek, oneMonth, oneYear, noLimit | ウェブ検索結果は最近のウィンドウに限定しましょう。 |
| count | integer | 10 | 1 から 50 | ウェブ検索が有効になっているときに取得できる検索結果の数。 |
| search_domain_filter | string | - | - | ウェブ検索を特定のドメインに限定しましょう。 |
| search_prompt | string | - | - | 取得したウェブ検索結果を要約するためのオプションプロンプト。 |
| search_result | boolean | true | - | ウェブ検索が有効になった場合、レスポンスでウェブ検索結果のメタデータを返してください。 |
| tool_stream | boolean | false | - | ストリーム中に関数呼び出しの引数を段階的に行います。 |
| tools | array | [] | - | OpenAI互換の関数呼び出しツール定義。 |
バリアントは独自のモデル ID を持つ GLM 5.2 の別バージョンです。バリアントによって提供リージョン、料金、対応パラメーターが異なる場合がありますが、それ以外は同じように動作します。
glm-5-2:variant1EmpirioLabs では GLM 5.2 は従量課金です: パスワード $1.40 1M プロンプトトークンあたり; ソリューション $4.40 1M生成トークンあたり; ウェブ検索 $0.033 リクエストごとに。このページのライブ料金表は常に API の請求額と一致します。
GLM 5.2 は 1M トークンのコンテキストウィンドウに対応しています(1回の応答あたり最大 131,072 出力トークン)。
はい。GLM 5.2 は OpenAI 互換の Chat Completions API を提供しているため、既存の OpenAI SDK は base_url を https://api.empiriolabs.ai/v1 に向けてモデル ID を glm-5-2 に設定するだけで動作します。
GLM 5.2 は 2 個のモデル ID で利用できます: デフォルトの glm-5-2 に加えて glm-5-2:variant1 (Germany)。バリアントは提供リージョン、料金、対応パラメーターが異なる場合があり、それぞれの料金表はこのページにあります。
はい。EmpirioLabs プレイグラウンドでは API と同じパラメーターで GLM 5.2 をブラウザ上で実行できるので、コードを書く前にプロンプトを試せます。
EmpirioLabs アカウントを作成し、ダッシュボードの API Keysでキーを生成してください。課金は従量制クレジットなので、実行したリクエストの分だけ支払います。