
ネイティブ関数呼び出しで画像、ビデオ、ファイル、およびテキスト理解のための無料のマルチモーダルGLM-4.6Vモデル。
ネイティブ関数呼び出しで画像、ビデオ、ファイル、およびテキスト理解のための無料のマルチモーダルGLM-4.6Vモデル。
ベーストークンの使用は無料です。 組み込みのWeb検索は、 tool_web_search でオプションで、有効化時にリクエストごとに $0.033 を追加できます。 テキスト、画像、ビデオ、ファイル入力と関数ツール、tool choice auto、JSON response format、思考制御、ツール stream、温度、top p、do sample、max tokens、停止、ストリーミングをサポートしています。
別名 Z.ai GLM 4.6V Flash, GLM-4.6V-Flash, glm-4-6v-flash
glm-4-6v-flash/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/glm-4-6v-flash:generateContentglm-4.6v-flashzai/glm-4.6v-flashzhipu/glm-4.6v-flashEmpirioLabs カタログのライブ従量課金料金です。使った分だけの支払いで、月額最低料金はありません。
GLM 4.6V Flash は OpenAI 互換の Chat Completions API を提供します。任意の OpenAI SDK を EmpirioLabs API キーで https://api.empiriolabs.ai/v1 に向け、モデル ID glm-4-6v-flash を使ってください。 EmpirioLabs ダッシュボードで API キーを取得してください。
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-4-6v-flash",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="glm-4-6v-flash",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)EmpirioLabs 上の GLM 4.6V Flash API が対応するリクエストパラメーターです。フィールドを省略した場合はデフォルト値が適用されます。
| パラメータ | タイプ | デフォルト | 範囲 / 値 | 説明 |
|---|---|---|---|---|
| temperature | number | 1 | 0 から 1 | サンプリング温度。値が低いほど決定論的です。GLM-4.7-フラッシュおよびGLM-4.6V-フラッシュはデフォルトで1.0です。GLM-4.5-フラッシュはデフォルトで0.6です。 |
| top_p | number | 0.95 | 0.01 から 1 | 原子核サンプリング確率質量。Z.AI ではGLM-4.7、GLM-4.6、GLM-4.5シリーズのデフォルトは0.95とされています。 |
| max_tokens | number | 4096 | 1 から 32768 | GLM-4.6Vフラッシュの最大出力トークン数:32768。 |
| stop | array | - | - | ストップワードリスト。Z.AI 現在、配列形式のワンストップ文字列をサポートしています。 |
| do_sample | boolean | true | - | サンプリングを有効にしてください。誤りの場合、温度や発電top_pは影響しません。 |
| enable_thinking | boolean | true | - | 操作は思考モード Z.AI。デフォルトは有効です。GLM-4.6Vフラッシュは、有効になると自動的に思考するかどうかを判断します。 |
| thinking | object | - | - | 高度な思考対象。{"type":"enabled"} または {"type":disabled"} を使ってください。GLM-4.6Vフラッシュは、有効になると自動的に思考するかどうかを判断します。 |
| tools | array | - | - | 機能ツールおよび組み込みのweb_searchツールもサポートしています。 |
| tool_choice | enum | auto | auto | モデルがツールを使うかどうかを制御します。Z.AI 文書自動ツール選択;ツールの使用を無効にするツールは省略してください。 |
| tool_stream | boolean | false | - | ストリーム関数-ツールの出力は、ストリームが真である場合に行われます。Z.AI 文書はGLM-4.6以降のモデルtool_streamです。 |
| tool_web_search | boolean | false | - | 組み込みのウェブ検索を有効にしてください。有効化するとリクエストごとに$0.033個を追加します。 |
| search_result | boolean | true | - | ウェブ検索が有効の場合、構造化されたウェブ検索結果メタデータを返します。 |
| search_prompt | string | - | - | 取得したウェブ検索結果をまとめるためのオプションの指示があります。 |
| count | number | 10 | 1 から 50 | 検索結果の取得数。 |
ベーストークンの使用は無料です。 組み込みのWeb検索は、 tool_web_search でオプションで、有効化時にリクエストごとに $0.033 を追加できます。
EmpirioLabs では GLM 4.6V Flash は従量課金です。このページのライブ料金表は常に API の請求額と一致します。
GLM 4.6V Flash は 128K トークンのコンテキストウィンドウに対応しています(1回の応答あたり最大 32,768 出力トークン)。
はい。GLM 4.6V Flash は OpenAI 互換の Chat Completions API を提供しているため、既存の OpenAI SDK は base_url を https://api.empiriolabs.ai/v1 に向けてモデル ID を glm-4-6v-flash に設定するだけで動作します。
はい。EmpirioLabs プレイグラウンドでは API と同じパラメーターで GLM 4.6V Flash をブラウザ上で実行できるので、コードを書く前にプロンプトを試せます。
EmpirioLabs アカウントを作成し、ダッシュボードの API Keysでキーを生成してください。課金は従量制クレジットなので、実行したリクエストの分だけ支払います。