GLM 4.7 Flash API

コーディング、推論、ロングコンテキストライティング、一般的なチャット用の無料の軽量GLM-4.7テキストモデル。

Z.aiテキスト生成200K コンテキストリリース 2026年1月19日Singapore独自エンドポイント

GLM 4.7 Flash について

コーディング、推論、ロングコンテキストライティング、一般的なチャット用の無料の軽量GLM-4.7テキストモデル。

ベーストークンの使用は無料です。 組み込みのWeb検索は、 tool_web_search でオプションで、有効化時にリクエストごとに $0.033 を追加できます。 関数ツール、ツール choice auto、JSON response format、思考制御、ツール stream、温度、top p、do sample、max tokens、停止、ストリーミングをサポートしています。

別名 GLM Flash, Z.ai GLM 4.7 Flash, GLM-4.7-Flash, glm-4-7-flash

reasoningfunction callingweb search

GLM 4.7 Flash の仕様

モデルID
glm-4-7-flash
プロバイダー
Z.ai
カテゴリ
テキスト生成
リリース
2026年1月19日
コンテキスト長
200K トークン
最大出力
131,072 トークン
入力
テキスト
出力
テキスト
構造化出力
JSON モード
リージョン
Singapore
エンドポイント
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/glm-4-7-flash:generateContent
代替モデルID
glm-4.7-flashzai/glm-4.7-flashzhipu/glm-4.7-flash

GLM 4.7 Flash API の料金

EmpirioLabs カタログのライブ従量課金料金です。使った分だけの支払いで、月額最低料金はありません。

タイプ
仕様
料金
パスワード
1M プロンプトトークンあたり
無料
ソリューション
1M生成トークンあたり
無料
キャッシュの読み込み
1M キャッシュされた入力トークンあたり
無料
ウェブ検索
有効な要求が有効な場合ごとの
$0.033
料金ページ全体で比較

GLM 4.7 Flash API の呼び出し方

GLM 4.7 Flash は OpenAI 互換の Chat Completions API を提供します。任意の OpenAI SDK を EmpirioLabs API キーで https://api.empiriolabs.ai/v1 に向け、モデル ID glm-4-7-flash を使ってください。 EmpirioLabs ダッシュボードで API キーを取得してください。

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-4-7-flash",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="glm-4-7-flash",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
GLM 4.7 Flash API の完全リファレンス

GLM 4.7 Flash API のパラメーター

EmpirioLabs 上の GLM 4.7 Flash API が対応するリクエストパラメーターです。フィールドを省略した場合はデフォルト値が適用されます。

パラメータタイプデフォルト範囲 / 値説明
temperaturenumber10 から 1サンプリング温度。値が低いほど決定論的です。GLM-4.7-フラッシュおよびGLM-4.6V-フラッシュはデフォルトで1.0です。GLM-4.5-フラッシュはデフォルトで0.6です。
top_pnumber0.950.01 から 1原子核サンプリング確率質量。Z.AI ではGLM-4.7、GLM-4.6、GLM-4.5シリーズのデフォルトは0.95とされています。
max_tokensnumber40961 から 131072GLM-4.7-フラッシュの最大出力トークン数:131072。
stoparray--ストップワードリスト。Z.AI 現在、配列形式のワンストップ文字列をサポートしています。
do_samplebooleantrue-サンプリングを有効にしてください。誤りの場合、温度や発電top_pは影響しません。
enable_thinkingbooleantrue-操作は思考モード Z.AI。Enabledがデフォルトで、GLM-4.7-Flashは思考します。単純な低遅延ターンには無効にしてください。
thinkingobject--高度な思考対象。{"type":"enabled"} または {"type":disabled"} を使ってください。GLM-4.7-フラッシュは有効時の思考を行います。
toolsarray--機能ツールおよび組み込みのweb_searchツールもサポートしています。
tool_choiceenumautoautoモデルがツールを使うかどうかを制御します。Z.AI 文書自動ツール選択;ツールの使用を無効にするツールは省略してください。
tool_streambooleanfalse-ストリーム関数-ツールの出力は、ストリームが真である場合に行われます。Z.AI 文書はGLM-4.6以降のモデルtool_streamです。
tool_web_searchbooleanfalse-組み込みのウェブ検索を有効にしてください。有効化するとリクエストごとに$0.033個を追加します。
search_resultbooleantrue-ウェブ検索が有効の場合、構造化されたウェブ検索結果メタデータを返します。
search_promptstring--取得したウェブ検索結果をまとめるためのオプションの指示があります。
countnumber101 から 50検索結果の取得数。
ドキュメントにあと3個のパラメーター

知っておくと便利

ベーストークンの使用は無料です。 組み込みのWeb検索は、 tool_web_search でオプションで、有効化時にリクエストごとに $0.033 を追加できます。

GLM 4.7 Flash API: よくある質問

GLM 4.7 Flash API の料金はいくらですか?

EmpirioLabs では GLM 4.7 Flash は従量課金です。このページのライブ料金表は常に API の請求額と一致します。

GLM 4.7 Flash のコンテキストウィンドウはどれくらいですか?

GLM 4.7 Flash は 200K トークンのコンテキストウィンドウに対応しています(1回の応答あたり最大 131,072 出力トークン)。

GLM 4.7 Flash API は OpenAI 互換ですか?

はい。GLM 4.7 Flash は OpenAI 互換の Chat Completions API を提供しているため、既存の OpenAI SDK は base_urlhttps://api.empiriolabs.ai/v1 に向けてモデル ID を glm-4-7-flash に設定するだけで動作します。

統合する前にブラウザで GLM 4.7 Flash を試せますか?

はい。EmpirioLabs プレイグラウンドでは API と同じパラメーターで GLM 4.7 Flash をブラウザ上で実行できるので、コードを書く前にプロンプトを試せます。

GLM 4.7 Flash の API キーはどうやって取得しますか?

EmpirioLabs アカウントを作成し、ダッシュボードの API Keysでキーを生成してください。課金は従量制クレジットなので、実行したリクエストの分だけ支払います。

より良いエンドポイントを使う準備はできていますか?

ご自身のモデルを当社のスタックに展開したい方は、ぜひご価格をご覧ください。