问题3.7 Flash在 EmpirioLabs 上可获取. 它是阿里巴巴的Qwen3.7视觉语言系列的快速阶梯,为多模式理解,代理工具使用,以及长文本工作所建,设有1M符号上下文窗口,可切换思维,以及文本,图像,视频输入. 它运行在一个兼容OpenAI的API上,因此可以通过改变一个字段来切换到它.
什么样的Quen3.7 闪光是好的
Flash是Qwen3.7家族的速度和成本级,因此它适合您仍然想要真正推理的量大的工作:文档和截图理解,视频问答,提取管道,以及调用工具的代理循环. 它读取图像和视频,调用具有标准函数调用的工具,按要求返回JSON,并且可以通过内置工具搜索网络,运行代码,读取URL. 新加坡和中国都有部署,这样你就可以选择适合你暂时性和定价需要的部署。
怎么称呼它呢
发送标准聊天补全:
卷 https://api.empiriolabs.ai/v1/chat/completions =-H "授权:熊鼠 $EMPRIOLABS API KEY"=-H "联系: application/json "==========================================================================================================================================================================================================
最后的答案回来了 内容,当思考 在模型的推理是在 推理(c)。 。 。.
控制思维
思考是默认的。 关闭它为短短的,耐久的敏感呼叫,或者为模型可能花多少个符号推理设定预算. 您还可以使用 推理(e) 无,低,中,高,或最大, 绘制到此模型的预算大小:
{"模型":" qwen3-7-flash ","信息":[{>"作用":"用户","内容":"计划迁移,并论证命令. ]],"能 思考":真,"思考 预算":32768}
说明理由的代币作为产出代币记账.
图像和视频
将图像和视频作为内容部分传送到用户信息与您的文本一起,然后询问它们显示的内容。 您可以在一个请求中附加多个输入:
{"模型":" qwen3-7-flash ","信息":[{"作用":"用户","内容":[{'类型]:"文本","文本":"这两个截图之间有什么变化?"},{"类型":"图像 url","图像 url",{ https://example.com/before.png"}}, {"类型":"图像 url","图像 url","图像 TOKEN 2 }}}
内建工具
问题3.7 有网页搜索的闪存船,读取URL的网络提取器,代码解释器,以及 text-to-image 和 image-to-image 搜索. 每个都是一种切换,只有在模型实际引用时才会计费. 网络解析器和代码解释器需要启用思维:
{"模型":" qwen3-7-flash ","消息":[{>"作用":"用户","内容":"在最新发布中运出什么?"}," tool_web_search ":真 }
当工具运行时,反应带有 使用.工具 usage 符号旁边的映射数 这样你就可以精确地检查被引用的内容。
结构化输出和函数调用
用途 response_format 与 {'类型':"json object"} 以强制使用有效的 JSON 对象,并通过 工具 用于标准函数,当您想要该模型调用自己的代码时调用。
快速缓存
重复的快速前缀会自动缓存,缓存的输入令牌帐单的速率远低于新输入. 如果您在很多请求中发送一个长期共享的系统即时或文档头,则您可以在不更改代码的情况下获得折扣.
区域
默认 qwen3-7-flash 是新加坡的部署。 qwen3-7-flash:variant1 是中国以较低的费率部署同一模式。 两者都采用相同的参数,这样你就可以在它们之间单独与模型场切换.
定价
问题3.7 闪电是工资,你走, 账单每个令牌。 投入率和产出率在较短的提示率下调,在非常长的提示率上调,缓存输入账单的速率降低,内置工具只有在运行时才会花费少量的每调费. 参见现场直播率 问题3.7 闪光模型页面 页:1 定价页面,并尝试在 操场。 。 。.



