用于推理,编码,长式聊天和一般语言任务的免费轻量级GLM-4.5文本模型.
基础符号使用是免费的. 内建的网络搜索通过 tool_web_search 可选,并在启用时每个请求都添加 $0.033. 支持函数工具,工具 选择自动,JSON响应 格式,思维控制,温度,上 p, do sample, max tokens, stop, 和流.
也称为 GLM Flash, Z.ai GLM 4.5 Flash, GLM-4.5-Flash, glm-4-5-flash
glm-4-5-flash/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/glm-4-5-flash:generateContentglm-4.5-flashzai/glm-4.5-flashzhipu/glm-4.5-flash来自 EmpirioLabs 目录的实时按量计费价格。只为实际用量付费,没有月度最低消费。
GLM 4.5 Flash 提供 OpenAI 兼容的 Chat Completions API。用你的 EmpirioLabs API 密钥把任意 OpenAI SDK 指向 https://api.empiriolabs.ai/v1,并使用模型 ID glm-4-5-flash。 在EmpirioLabs 控制台获取 API 密钥。
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-4-5-flash",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="glm-4-5-flash",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)EmpirioLabs 上 GLM 4.5 Flash API 支持的请求参数。省略字段时使用默认值。
| 参数 | 类型 | 默认值 | 范围 / 值 | 描述 |
|---|---|---|---|---|
| temperature | number | 0.6 | 0 到 1 | 采样温度。较低的数值则更具确定性。GLM-4.7-闪存和GLM-4.6V闪存默认为1.0;GLM-4.5-闪存默认为0.6。 |
| top_p | number | 0.95 | 0.01 到 1 | 核抽样概率质量。Z.AI 文档中,GLM-4.7、GLM-4.6 和 GLM-4.5 系列默认为 0.95。 |
| max_tokens | number | 4096 | 1 到 98304 | GLM-4.5-闪存的最大输出令牌数:98304。 |
| stop | array | - | - | 停止词列表。Z.AI 目前支持数组形式的单点字符串。 |
| do_sample | boolean | true | - | 启用采样。如果不确定,温度和top_p不会影响发电。 |
| enable_thinking | boolean | true | - | 控制控制,Z.AI 思考模式。启用是默认设置;GLM-4.5-Flash 在启用时会自动决定是否思考。 |
| thinking | object | - | - | 高级思维对象。请使用 {“type”:“enabled”} 或 {“type”:disabled“}。GLM-4.5-Flash 在启用时会自动决定是否思考。 |
| tools | array | - | - | 支持函数工具和内置web_search工具。 |
| tool_choice | enum | auto | auto | 控制模型是否可以使用工具。Z.AI 文档自动工具选择;省略禁用工具使用。 |
| tool_web_search | boolean | false | - | 启用内置的网页搜索功能。启用后每个请求会增加$0.033个请求。 |
| search_result | boolean | true | - | 启用网页搜索时返回结构化的网页搜索结果元数据。 |
| search_prompt | string | - | - | 可选的总结检索网页搜索结果的说明。 |
| count | number | 10 | 1 到 50 | 需要检索的网络搜索结果数量。 |
| search_domain_filter | string | - | - | 可选的域名白名单用于网页搜索结果。 |
基础符号使用是免费的. 内建的网络搜索通过 tool_web_search 可选,并在启用时每个请求都添加 $0.033.
在 EmpirioLabs,GLM 4.5 Flash 按量计费。本页的实时价格表始终与 API 的实际计费一致。
GLM 4.5 Flash 支持 200K token 的上下文窗口,每次响应最多 98,304 个输出 token。
兼容。GLM 4.5 Flash 提供 OpenAI 兼容的 Chat Completions API,现有 OpenAI SDK 只需把 base_url 指向 https://api.empiriolabs.ai/v1 并把模型 ID 设为 glm-4-5-flash 即可使用。
可以。EmpirioLabs Playground在浏览器中以与 API 相同的参数运行 GLM 4.5 Flash,你可以在写代码之前先测试提示词。
创建 EmpirioLabs 账户,然后在控制台的 API Keys生成密钥。计费使用按量付费的额度,只为实际发出的请求付费。