GLM 5.3 Flash 是 Z.ai GLM-5 家族中首款原生多模态模型,于2026年8月26日在 MIT 许可下发布,此前曾以 Ox Alpha 的名义预览。它是一台320B-A18Bmixture-of-experts,基于多模态语料库训练,Z.ai 报告称其在编码和代理基准测试中表现优于GLM 5.2,且成本仅为其一小部分,结果接近更大规模的前沿编码模型。
GLM 5.3 Flash 现已通过兼容 OpenAI 的 API 上线EmpirioLabs,支持文本、图像、视频和文件输入,100万令牌上下文,最多 128K 个输出令牌,函数调用,JSON 模式结构化输出,内置网页搜索和流媒体。试试在 操场 或者从任何 OpenAI 兼容客户端调用它。 全部谱率和当前率 GLM 5.3 闪存模型页面 页:1 API 文档。 。 。.
定价
计费是基于用法的:输入和输出的令牌是每个令牌计数的,每个内置的网络搜索都增加了一个小的每调费,只在搜索实际运行时才适用. 没有单独的缓存级 。 现时每户费率一直维持在 模型页面 页:1 定价页面,它与你被控的罪行保持同步.
快速启动
将 OpenAI SDK 指向 EmpirioLabs 基础 URL并通过 glm-5-3-flash 作为模式:
从 openai 导入 OpenAI 客户端 = OpenAI( base_url=“https://api.empiriolabs.ai/v1", api_key=”YOUR_EMPIRIOLABS_API_KEY“, ) resp = client.chat.completions.create( model=”glm-5-3-flash“, messages=[ {”role“: ”user“, ”content“: [ {”type“: ”text“, ”text“: ”这个构建日志截图中有什么故障?“}, {”type“: ”image_url“, ”image_url“: {”url“: ”https://example.com/build-log.png"}}, ], ], reasoning_effort=“low”, ) print(resp.choices[0].message.content)
同一个型号ID也适用于 /v1/responses (英语),类人形态 /v1/messages (英语),以及谷歌兼容的 /v1beta/models/glm-5-3-flash:生成内容 路线。替代身份 glm-5.3-flash, (中文), zai/glm-5.3-flash, 和 zhipu/glm-5.3-flash 解析到同一个模型。
多模态输入
图片、视频和文件运行在标准内容部分数组中: image_url 对于图像, video_url 用于视频,以及 file_url 为了文件。传递一个公共的 https URL(推荐)或 base64 数据 URL。Z.ai 为代理视觉工作定位了该模型:它可以读取接口、渲染输出和交互反馈,从而实现代码、浏览器和图形界面之间的闭环。
作出合理努力
GLM 5.3 闪存暴露了本地文件 推理(e) 控制有三个层次: 低 对于轻量级推理, 高 用于增强推理,以及 最大数 为了深层的推理。默认为 最大数这正是 Z.ai 推荐用于复杂编码和长视野代理工作的做法。降级至。 低 用于短暂且对延迟敏感的转弯。
网页搜索与工具
设定 tool_web_search (英语) 到 确实如此 让模型在回答前先搜索网络,并缩小范围,用 search_recency_filter, (中文), search_domain_filter, 和 伯爵.函数调用使用标准的OpenAI 工具 数组,以及 tool_stream 在工具调用参数生成时进行流式传输。
第一次打电话前值得了解的事情
- 推理无法关闭,所以它始终是你产出账单的一部分。
推理(e)只接受低, (中文),高, 和最大数.请求不同级别或禁用思维的请求会在最近的支持级别被送达,而非失败,因此为其他GLM模型编写的代码能够继续工作。推理代币作为输出代币计费,且在最大数即使是一个单词的回答,也可能花费大部分产出预算思考,所以发送低专门用于琐碎的呼叫。 - 结构化输出是JSON模式,不是模式强制。 用途
response_format与{'类型':"json object"}并描述你想在提示中看到的字段。提供 JSON Schema 是被接受但不强制执行的,所以你应该在自己这边验证结果,而不是假设形状。 - 媒体部分应该是服务能获取的URL。 模型取物
image_url, (中文),video_url, 和file_url针对自身,因此登录或私有网络背后的URL会失败请求。当媒体无法公开访问时,应将其内嵌为base64数据URL。
下一步该去哪里
打开 操场 要尝试不写代码的GLM 5.3闪存,请阅读 API 参考 如需查看完整参数列表,或浏览 型号目录 用来和其他节目做个比较。



