首页 博客

如何使用Qwen3.8 Flash API

如何使用Qwen3.8 Flash API

Aug 26, 2026

EmpirioLabs AI

Qwen3.8 Flash 是阿里巴巴 Qwen3.8 系列中最新的多模态模型,于2026年8月26日发布,专为快速、低成本的编码、代理和视觉工作而打造。它将100万令牌上下文与文本、图像和视频理解、默认开启的深度思考,以及与Qwen3.8 Max相同的五个内置工具。

Qwen3.8 Flash 现已通过兼容 OpenAI 的 API 上线EmpirioLabs,支持函数调用、严格的 JSON Schema 结构化输出、流式传输,以及最多 128K 的输出令牌。试试在 操场 或者从任何 OpenAI 兼容客户端调用它。 全部谱率和当前率 Qwen3.8 Flash模型页面 页:1 API 文档。 。 。.

定价

计费基于使用量,每个提示大小都有一个固定输入速率和一个固定输出速率,且没有单独的缓存层。网页搜索、text-to-image搜索和image-to-image搜索会增加少量每次通话费用,仅在通话实际运行时生效;网页解压器和代码解释器运行时无需额外付费。当前费率始终存在于 模型页面 页:1 定价页面,它与你被控的罪行保持同步.

快速启动

将 OpenAI SDK 指向 EmpirioLabs 基础 URL并通过 qwen3-8-flash 作为模式:

来自 openai 导入 OpenAI 客户端 = OpenAI( base_url=“https://api.empiriolabs.ai/v1", api_key=”YOUR_EMPIRIOLABS_API_KEY“, ) resp = client.chat.completions.create( model=”qwen3-8-flash“, messages=[ {”role“: ”user“, ”content“: [ {”type“: ”text“, ”text“: ”这张图表发生了什么?“}, {”type“: ”image_url“, ”image_url“: {”url“: ”https://example.com/chart.png"}}, ], ], extra_body={“enable_thinking”: True, “thinking_budget”: 8192}, ) print(resp.choices[0].message.content)

同一个型号ID也适用于 /v1/responses (英语),类人形态 /v1/messages (英语),以及谷歌兼容的 /v1beta/models/qwen3-8-flash:生成内容 路线。备用ID(替代ID) QWEN3.8-闪电 解析为同一模型。

思考

深度思考默认开启,回流为 推理(c) 同时也在回答中。控制它: 启用 思考 以及 考虑预算 (最多262,144个令牌),或发送 推理(e) 平台会将其映射到模型预算大小。思考标记作为输出标记计费,所以关闭思考,或者为短暂且有延迟的回合设定小预算。

内建工具

五个内置工具坐在后面 工具 * 切换开关: tool_web_search (英语), (中文), tool_web_extractor, (中文), tool_code_interpreter, (中文), tool_web_search_image, 和 tool_image_search.网页提取器需要网页搜索,且提取器和代码解释器仅在思考启用状态时运行。当工具运行时,反应是 使用.工具 usage MAP 会准确报告通话次数,方便你审计按工具计费。

结构化产出

对于精确的响应形状,通过 response_format{“type”: “json_schema”,...} 以及 “严格”:真:模型返回的键完全相同,没有额外内容。纯JSON模式,其中 {'类型':"json object"} 也支持。

第一次打电话前值得了解的事情

  • 所有五个内置工具默认开启,并按呼叫搜索计费。 单个请求可以多次运行网络搜索,每次调用都会计费。如果是纯聊且无工具费,设置 tool_web_search (英语), (中文), tool_web_search_image, 和 tool_image_search虚假。 。 。.
  • 工具 选择:“需要” 思考时不起作用。 请求被拒绝,显示明显错误。守 tool_choice:“自动” 在思考被启用或设定的情况下 enable_thinking:错误 当你需要强制调用函数时,
  • JSON 模式需要在你的消息中加上“json”这个词。 A {'类型':"json object"} 除非该词在对话中出现,否则请求会被拒绝。JSON Schema 请求没有这样的要求。

Qwen3.8 Flash 现已在 操场 并通过 EmpirioLabs API。 。 。.

准备好使用更好的终端了吗?

欢迎浏览我们的模型,或联系我们洽谈业务咨询、定制部署或其他任何事宜。