GLM 5.3 API

100万トークンコンテキスト、128K出力、低・高・最大努力での常時オン推論、ネイティブウェブ検索、ツール呼び出しによるコーディングとエージェントモデル。

Z.aiテキスト生成1M コンテキストリリース 2026年8月14日Singapore独自エンドポイント新着

GLM 5.3 について

100万トークンコンテキスト、128K出力、低・高・最大努力での常時オン推論、ネイティブウェブ検索、ツール呼び出しによるコーディングとエージェントモデル。

注記:- コンテキストウィンドウ:100万トークン - 最大出力:128Kトークン - 常に理由;思考は無効化できません - 推論努力:低、高、最大(複雑なコーディングに推奨される最大) - 別の努力のリクエストや思考を停止するリクエストは、最も近い対応レベルで提供されます - 組み込みのウェブ検索によりリクエストごとに$0.033が加算されます - 関数呼び出し、構造化出力(JSONモード)、ストリーミングをサポート

別名 Z.ai GLM 5.3

reasoningfunction callingweb search

GLM 5.3 の仕様

モデルID
glm-5-3
プロバイダー
Z.ai
カテゴリ
テキスト生成
リリース
2026年8月14日
コンテキスト長
1M トークン
最大出力
131,072 トークン
入力
テキスト
出力
テキスト
構造化出力
JSON モード
リージョン
Singapore
エンドポイント
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/glm-5-3:generateContent
代替モデルID
glm-5.3zai/glm-5.3zhipu/glm-5.3

GLM 5.3 API の料金

EmpirioLabs カタログのライブ従量課金料金です。使った分だけの支払いで、月額最低料金はありません。

タイプ
仕様
料金
入力
1Mプロンプトトークンあたり
$1.40
ソリューション
生成された1Mトークンあたり
$4.40
ウェブ検索
リクエストごとに
$0.033
料金ページ全体で比較

GLM 5.3 API の呼び出し方

GLM 5.3 は OpenAI 互換の Chat Completions API を提供します。任意の OpenAI SDK を EmpirioLabs API キーで https://api.empiriolabs.ai/v1 に向け、モデル ID glm-5-3 を使ってください。 EmpirioLabs ダッシュボードで API キーを取得してください。

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-5-3",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="glm-5-3",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
GLM 5.3 API の完全リファレンス

GLM 5.3 API のパラメーター

EmpirioLabs 上の GLM 5.3 API が対応するリクエストパラメーターです。フィールドを省略した場合はデフォルト値が適用されます。

パラメータタイプデフォルト範囲 / 値説明
max_tokensinteger655361 から 131072生成できる最大出力トークン数。
temperaturenumber10 から 1ランダム性を制御します。値が低いほど応答はより決定的になります。
top_pnumber0.950.01 から 1核サンプリングカットオフ。
reasoning_effortenummaxlow, high, maxGLM 5.3の推論努力。このモデルは常に推論的でオフにできません。低は軽量、高は強化、最大は深い推論です。複雑なコーディングにはMaxが推奨されます。
do_samplebooleantrue-サンプリングを有効にしてください。貪欲な決定論的出力(温度とtop_pは無視)には電源を切ってください。
tool_web_searchbooleanfalse-組み込みのウェブ検索を有効にしてください。使用時にリクエストごとに$0.033個を追加します。
search_recency_filterenumnoLimitoneDay, oneWeek, oneMonth, oneYear, noLimitウェブ検索結果は最近のウィンドウに限定しましょう。
countinteger101 から 50ウェブ検索が有効になっているときに取得できる検索結果の数。
search_domain_filterstring--ウェブ検索を特定のドメインに限定しましょう。
search_promptstring--取得したウェブ検索結果を要約するためのオプションプロンプト。
search_resultbooleantrue-ウェブ検索が有効になった場合、レスポンスでウェブ検索結果のメタデータを返してください。
tool_streambooleanfalse-ストリーム中に関数呼び出しの引数を段階的に行います。
toolsarray[]-OpenAI互換の関数呼び出しツール定義。
tool_choiceobject--OpenAI互換のツール選択制御。
ドキュメントにあと2個のパラメーター

GLM 5.3 API: よくある質問

GLM 5.3 API の料金はいくらですか?

EmpirioLabs では GLM 5.3 は従量課金です: 入力 $1.40 1Mプロンプトトークンあたり; ソリューション $4.40 生成された1Mトークンあたり; ウェブ検索 $0.033 リクエストごとに。このページのライブ料金表は常に API の請求額と一致します。

GLM 5.3 のコンテキストウィンドウはどれくらいですか?

GLM 5.3 は 1M トークンのコンテキストウィンドウに対応しています(1回の応答あたり最大 131,072 出力トークン)。

GLM 5.3 API は OpenAI 互換ですか?

はい。GLM 5.3 は OpenAI 互換の Chat Completions API を提供しているため、既存の OpenAI SDK は base_urlhttps://api.empiriolabs.ai/v1 に向けてモデル ID を glm-5-3 に設定するだけで動作します。

統合する前にブラウザで GLM 5.3 を試せますか?

はい。EmpirioLabs プレイグラウンドでは API と同じパラメーターで GLM 5.3 をブラウザ上で実行できるので、コードを書く前にプロンプトを試せます。

GLM 5.3 の API キーはどうやって取得しますか?

EmpirioLabs アカウントを作成し、ダッシュボードの API Keysでキーを生成してください。課金は従量制クレジットなので、実行したリクエストの分だけ支払います。

より良いエンドポイントを使う準備はできていますか?

ご自身のモデルを当社のスタックに展開したい方は、ぜひご価格をご覧ください。