Qwen3.8 Max 已在 EmpirioLabs 上可用。 它是阿里巴巴Qwen3.8系列的旗舰层,Qwen3.8是一个万亿规模的mixture-of-experts模型,专为编码、长期代理工作和专业任务打造,拥有100万令牌上下文窗口、深度思考以及文本、图像和视频输入。它运行在兼容OpenAI的API,因此你只需切换一个字段即可切换到OpenAI。
Qwen3.8 Max 的强项
Max 是 Qwen3.8 家族中的能力层,适合质量比速度更重要的工作:跨大型仓库编码、长时间运行的代理循环、文档和截图理解,以及需要同时包含大量上下文的分析。它能读取图片和视频,调用标准函数调用工具,按要求返回严格符合模式规范的 JSON,并可通过内置工具搜索网页、运行代码、读取 URL 和图片搜索。
怎么称呼它呢
发送标准聊天回复:
curl https://api.empiriolabs.ai/v1/chat/completions \ -h “授权:承载者 $EMPIRIOLABS_API_key” \ -h “内容类型:application/json” \ -d '{ “model”:“qwen3-8-max”, “messages”: [ {“role”: “user”, “content”: “重构此模块并解释权衡。”} ] }''
同一个型号ID也适用于 /v1/responses (英语),关于拟人形 /v1/messages (英语)以及谷歌兼容版 /v1beta/models/qwen3-8-max:生成内容 路线,所以大多数现有的SDK设置无需重写即可正常工作。
思考是默认开启的
Qwen3.8 除非你关闭它,否则它会回答最多理由。设置 启用 思考 到 错误 用于短暂、对延迟敏感的通话,或呼叫 thinking_budget 当你想让它更努力地处理问题时,最多可以262144个代币。推理代币作为输出代币来计费,所以在一个简单的提示词上投入大量预算是该模型过度支出的主要原因。
在你移植代理之前,有一个实用细节值得了解:当思考是启用的,模型会接受 tool_choice 仅为 自动.强制特定函数 tool_choice:“必须” 或者明确的工具对象被拒绝。如果你的代理强制执行第一个工具调用,要么让选择保持自动,要么在该步骤中禁用思考。
内置工具默认为 开启
模型内置五个工具:网页搜索、网页提取器、代码解释器、text-to-image搜索和image-to-image搜索。它们默认启用,这对研究类提示非常方便,但对简单的完成则浪费,因为工具定义会伴随每个提示。关闭不需要的那些工具 tool_* 参数:
{ “model”: “qwen3-8-max”, “messages”: [{“role”: “user”, “content”: “本周规范发生了什么变化?”}], “tool_web_search”: true, “tool_web_extractor”: true, “tool_code_interpreter”: false, “tool_web_search_image”: false, “tool_image_search”: false }
上游强制执行两个依赖关系:网页提取器仅与网页搜索同时运行,且网页提取器和代码解释器都需要启用思维。网页搜索和两个图片搜索工具按调用调用计费,单个请求可以多次调用一个工具,因此响应会准确报告运行内容 usage.tool_usage。 。 。.
结构化输出
Qwen3.8 Max 强制执行严格的 JSON 模式,而不仅仅是 JSON 模式,因此你可以请求精确的响应形状并解析它,无需修复步骤:
{ “model”: “qwen3-8-max”, “messages”: [{“role”: “user”, “content”: “提取发票字段。”}], “response_format”: { “type”: “json_schema”, “json_schema”: { “name”: “invoice”, “strict”: true, “schema”: { “type”: “object”, “properties”: { “vendor”: {“type”: “string”}, “total”: {“type”: “number”} }, “required”: [“vendor”, “total”], “additionalProperties”: false } }
图片与视频
像使用任何兼容OpenAI的视觉模型一样,添加图片或视频 image_url 或 video_url 内容部分。你可以在一条消息中发送多张图片,并按位置进行引用。对于视频, video_fps 控制帧采样的密度,且 vl_high_resolution_images 在图像输入中,细节与提示大小进行权衡。
定价
Qwen3.8 Max是按需付费,按输入和输出令牌计价,实际运行时搜索工具中会收取少量每次调用费用。思考令牌也算作输出令牌。当前利率在 Qwen3.8 Max 模型页面 页:1 定价页面,总是反映实时费率表。
试试看吧
打开它 EmpirioLabs Playground 测试提示词、附件和工具开关,无需编写代码,或读取 API 参考 完整参数列表。



