ホーム ブログ

GLM 5.3 APIの使い方

GLM 5.3 API カバー

Aug 19, 2026

EmpirioLabs AI

GLM 5.3はZ.aiのフラッグシップコーディングおよびエージェントモデルで、2026年8月14日にリリースされました。GLM 5.2と同じベースモデルで動作し、新たな事前学習ランではなく、拡張されたポストトレーニングによる利点があります。Z.ai 独自のCode BenchでGLM 5.2に比べてコーディングが50%向上し、オープンソースモデルのTerminal Bench 3.0やAgents' Last Examでもstate-of-the-art結果を報告しています。

GLM 5.3は本日、OpenAI互換APIを通じてEmpirioLabs上で稼働しており、テキスト入力・出力、1Mトークンコンテキスト、最大128Kの出力トークン、関数呼び出し、JSONモード構造化出力、組み込みウェブ検索、ストリーミング機能を備えています。試してみて プレイグラウンド または、OpenAI対応のクライアントから呼び出す。 フルスペックと現在のレートは、 GLM 5.3モデルページ そして、 API ドキュメントお問い合わせ.

料金について

請求は利用量に基づいており、入力トークンと出力トークンはトークンごとに計量され、組み込みのウェブ検索ごとにわずかな通話料金が加算されますが、これは検索が実際に実行された場合にのみ適用されます。別にキャッシュティアはありません。現在のトークンあたりのレートは常に モデルページ そして、 プライシングページ、あなたが請求したものと同期して滞在する.

クイックスタート

EmpirioLabs ベース URL で OpenAI SDK をポイントし、パス glm-5-3 モデルとして:

openaiからインポート OpenAIクライアント = OpenAI(base_url="https://api.empiriolabs.ai/v1", api_key="YOUR_EMPIRIOLABS_API_KEY",) resp = client.chat.completions.create(model="glm-5-3", messages=[ {"role": "user", "content": "このワーカープールのレース条件を見つけて修正提案。", ], reasoning_effort="max",) print(resp.choices[0].message.content)

同じモデルIDで動作します お問い合わせ、人形をした お問い合わせ、そしてGoogle互換 /v1beta/models/glm-5-3:コンテンツ生成 ルート。代替IDについて GLM-5.3, zai/glm-5.3、および zhipu/glm-5.3 同じモデルに対処してください。

働き方改革

GLM 5.3はネイティブを露出します 理由 努力 3段階の操作: ロー 軽い推論のために、 高く 推論力を高めるために、 マックス 深い理屈のために。デフォルトは マックスこれは Z.ai が複雑な符号化や長期的なエージェント作業に推奨している方法です。降格 ロー 短時間の遅延に敏感なターンです。

ウェブ検索とツール

セット お問い合わせ から 確かに モデルがウェブを検索してから答え、結果を絞り込むために search_recency_filter, search_domain_filter、および カウント.関数呼び出しは標準のOpenAIを使用しています ツール 配列、 tool_stream ツールコールの引数は生成されるたびにストリーム化します。

最初の電話の前に知っておくべきこと

  • 理性は止められないので、常に出力の一部です。 GLM 5.2とは異なり、このモデルには思考オフモードがなく、 理由 努力 ただ受け入れる ロー, 高く、および マックス.異なるレベルを求めるリクエストや、思考を無効化するリクエストは、最も近いサポートレベルで提供され、失敗せず、GLM 5.2用に書かれたコードは動作し続けます。推論トークンは出力トークンとして請求され、 マックス たった一言の返事でも、出力予算の大半を考えることに費やされてしまうので、送信してください ロー 明示的に些細なコールに対して。
  • 構造化出力はスキーマ強制ではなくJSONモードです。 使用方法 response_format お問い合わせ {"type": "json_object"} そして、プロンプトで欲しいフィールドを説明してください。JSONスキーマの提供は受け入れられますが強制されるわけではないので、形状を仮定するのではなく、自分の側で結果を検証してください。
  • テキストのみです。 画像、映像、ファイルの一部は拒否されます。マルチモーダル入力にはGLM 5.3 Flashのようなビジョンモデルを使いましょう。

次にどこへ行くべきか

開く プレイグラウンド コードを書かずにGLM 5.3を試すには、 API参照 パラメータリストの全内容については、または モデルカタログ 他のラインナップと比較するために。

より良いエンドポイントを使う準備はできていますか?

当社のモデルをご覧いただくか、ビジネスの問い合わせ、カスタム展開、その他何でもご連絡ください。