GLM 4.6V Flash API

用于图像,视频,文件和文本理解的免费多模式 GLM-4.6V 模型,带有本地函数调用.

Z.ai文本生成128K 上下文发布日期 2025年12月8日Singapore专有端点

关于 GLM 4.6V Flash

用于图像,视频,文件和文本理解的免费多模式 GLM-4.6V 模型,带有本地函数调用.

基础符号使用是免费的. 内建的网络搜索通过 tool_web_search 可选,并在启用时每个请求都添加 $0.033. 支持文本,图像,视频,以及文件输入加函数工具,工具 选择自动,JSON响应 格式,思维控制,工具 流,温度,上 p, do sample, max tokens, stop, 和流.

也称为 Z.ai GLM 4.6V Flash, GLM-4.6V-Flash, glm-4-6v-flash

visionvideo understandingdocument understandingfunction callingweb searchreasoning

GLM 4.6V Flash 规格

模型 ID
glm-4-6v-flash
提供方
Z.ai
类别
文本生成
发布日期
2025年12月8日
上下文窗口
128K 个 token
最大输出
32,768 个 token
输入
文本图像视频文件
输出
文本
结构化输出
JSON 模式
区域
Singapore
端点
POST/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/glm-4-6v-flash:generateContent
备用模型 ID
glm-4.6v-flashzai/glm-4.6v-flashzhipu/glm-4.6v-flash

GLM 4.6V Flash API 价格

来自 EmpirioLabs 目录的实时按量计费价格。只为实际用量付费,没有月度最低消费。

类型
规格
价格
投入
每1M 提示符
免费
产出
每1M个生成的令牌
免费
隐形缓存已读
每1M缓存输入符
免费
网络搜索
启用时每个请求
$0.033
在完整价格页比较

如何调用 GLM 4.6V Flash API

GLM 4.6V Flash 提供 OpenAI 兼容的 Chat Completions API。用你的 EmpirioLabs API 密钥把任意 OpenAI SDK 指向 https://api.empiriolabs.ai/v1,并使用模型 ID glm-4-6v-flash。 在EmpirioLabs 控制台获取 API 密钥。

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "glm-4-6v-flash",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'
Python (OpenAI SDK)
from openai import OpenAI

client = OpenAI(
    base_url="https://api.empiriolabs.ai/v1",
    api_key="YOUR_EMPIRIOLABS_API_KEY",
)

response = client.chat.completions.create(
    model="glm-4-6v-flash",
    messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)
GLM 4.6V Flash API 完整参考

GLM 4.6V Flash API 参数

EmpirioLabs 上 GLM 4.6V Flash API 支持的请求参数。省略字段时使用默认值。

参数类型默认值范围 / 值描述
temperaturenumber10 到 1采样温度。较低的数值则更具确定性。GLM-4.7-闪存和GLM-4.6V闪存默认为1.0;GLM-4.5-闪存默认为0.6。
top_pnumber0.950.01 到 1核抽样概率质量。Z.AI 文档中,GLM-4.7、GLM-4.6 和 GLM-4.5 系列默认为 0.95。
max_tokensnumber40961 到 32768GLM-4.6V闪存的最大输出令牌数:32768。
stoparray--停止词列表。Z.AI 目前支持数组形式的单点字符串。
do_samplebooleantrue-启用采样。如果不确定,温度和top_p不会影响发电。
enable_thinkingbooleantrue-控制控制,Z.AI 思考模式。启用是默认设置;GLM-4.6V闪光灯会自动决定是否启用。
thinkingobject--高级思维对象。请使用 {“type”:“enabled”} 或 {“type”:disabled“}。GLM-4.6V闪光灯会自动决定是否启用。
toolsarray--支持函数工具和内置web_search工具。
tool_choiceenumautoauto控制模型是否可以使用工具。Z.AI 文档自动工具选择;省略禁用工具使用。
tool_streambooleanfalse-当流为真时,流函数调用工具输出。Z.AI 文档tool_stream GLM-4.6及更新型号。
tool_web_searchbooleanfalse-启用内置的网页搜索功能。启用后每个请求会增加$0.033个请求。
search_resultbooleantrue-启用网页搜索时返回结构化的网页搜索结果元数据。
search_promptstring--可选的总结检索网页搜索结果的说明。
countnumber101 到 50需要检索的网络搜索结果数量。
文档中还有 3 个参数

须知

基础符号使用是免费的. 内建的网络搜索通过 tool_web_search 可选,并在启用时每个请求都添加 $0.033.

GLM 4.6V Flash API:常见问题

GLM 4.6V Flash API 收费多少?

在 EmpirioLabs,GLM 4.6V Flash 按量计费。本页的实时价格表始终与 API 的实际计费一致。

GLM 4.6V Flash 的上下文窗口有多大?

GLM 4.6V Flash 支持 128K token 的上下文窗口,每次响应最多 32,768 个输出 token。

GLM 4.6V Flash API 兼容 OpenAI 吗?

兼容。GLM 4.6V Flash 提供 OpenAI 兼容的 Chat Completions API,现有 OpenAI SDK 只需把 base_url 指向 https://api.empiriolabs.ai/v1 并把模型 ID 设为 glm-4-6v-flash 即可使用。

集成之前可以在浏览器里试用 GLM 4.6V Flash 吗?

可以。EmpirioLabs Playground在浏览器中以与 API 相同的参数运行 GLM 4.6V Flash,你可以在写代码之前先测试提示词。

如何获取 GLM 4.6V Flash API 密钥?

创建 EmpirioLabs 账户,然后在控制台的 API Keys生成密钥。计费使用按量付费的额度,只为实际发出的请求付费。

准备好使用更好的终端了吗?

查看我们的定价,或者如果你想将自己的模型部署到我们的堆栈中,请联系我们。