
升级后的Qwen3.8 Max快照,增强编码、更稳定的多工具代理运行,以及在100万令牌上下文中更清晰的图表和文档视野。
升级后的Qwen3.8 Max快照,增强编码、更稳定的多工具代理运行,以及在100万令牌上下文中更清晰的图表和文档视野。
支持文本、图像和视频输入,思考模式支持enable_thinking和thinking_budget,最多支持262144个令牌,函数调用,结构化输出(包括严格的JSON模式),以及五个内置工具:tool_web_search、tool_web_extractor、tool_code_interpreter、tool_web_search_image和tool_image_search。思考令牌作为输出令牌计费。
也称为 Alibaba Cloud Qwen3.8 Max 0902
qwen3-8-max-0902/v1/chat/completionsPOST/v1/responsesPOST/v1/messagesPOST/v1beta/models/qwen3-8-max-0902:generateContentqwen3.8-max-0902qwen3.8-max-2026-09-02来自 EmpirioLabs 目录的实时按量计费价格。只为实际用量付费,没有月度最低消费。
Qwen3.8 Max 0902 提供 OpenAI 兼容的 Chat Completions API。用你的 EmpirioLabs API 密钥把任意 OpenAI SDK 指向 https://api.empiriolabs.ai/v1,并使用模型 ID qwen3-8-max-0902。 在EmpirioLabs 控制台获取 API 密钥。
curl https://api.empiriolabs.ai/v1/chat/completions \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3-8-max-0902",
"messages": [
{"role": "user", "content": "Write a haiku about the ocean."}
]
}'from openai import OpenAI
client = OpenAI(
base_url="https://api.empiriolabs.ai/v1",
api_key="YOUR_EMPIRIOLABS_API_KEY",
)
response = client.chat.completions.create(
model="qwen3-8-max-0902",
messages=[{"role": "user", "content": "Write a haiku about the ocean."}],
)
print(response.choices[0].message.content)EmpirioLabs 上 Qwen3.8 Max 0902 API 支持的请求参数。省略字段时使用默认值。
| 参数 | 类型 | 默认值 | 范围 / 值 | 描述 |
|---|---|---|---|---|
| temperature | number | 0.7 | 0 到 2 | 采样温度。0是确定性的,2是最大随机性。 |
| top_p | number | 0.9 | 0 到 1 | 核抽样概率质量。较低的数值使输出更集中。 |
| max_tokens | number | 4096 | 1 到 131072 | 最大输出令牌。 |
| stop | string | - | - | 最多有4串字符串,模型会停止生成更多代币。 |
| enable_thinking | boolean | true | - | 在回答之前先启用推理。 |
| reasoning_effort | enum | medium | none, low, medium, high, max | 推理努力程度。没有人能让思考失效。低、中、高和最大设定了根据所选模型大小的有界思维预算。 |
| thinking_budget | number | 32768 | 1 到 262144 | 开启了思考时保留给推理的最大代币。 |
| vl_high_resolution_images | boolean | true | - | 图像输入使用更高分辨率处理。 |
| max_pixels | number | 2621440 | 4096 到 16777216 | 禁用高分辨率处理时,每张图像的最大像素数。 |
| video_fps | number | 2 | 0.1 到 10 | 每秒帧以从视频输入采样。 |
| treat_images_as_video | boolean | false | - | 把一组图像当作视频帧来处理。 |
| tool_web_search | boolean | false | - | 在网上搜索实时信息。每次呼叫的请求费用都会增加$0.02。 |
| tool_web_extractor | boolean | false | - | 从URL中提取并读取内容。需要网络搜索和思考。 |
| tool_code_interpreter | boolean | false | - | 在沙盒中运行Python代码。需要思考。 |
支持文本、图像和视频输入。网页搜索、网页提取器、代码解释器、text-to-image搜索和image-to-image搜索是可选内置工具,通过tool_*参数暴露。网页搜索、text-to-image搜索和image-to-image搜索为每个调用添加$0.02;网页提取器和代码解释器运行无额外费用。网页提取器需要网页搜索,网页提取器和代码解释器都需要思考。一个请求可以多次调用一个工具,且每次调用都会计费。思考令牌作为输出令牌计费。该ID固定在2026年9月2日的快照上,不会改变。滚动qwen3-8-max id自2026年9月5日起使用同一构建,并将迁移到未来的快照中。
When this model invokes built-in tools inside a single request, the response carries a normalized usage.tool_usage map alongside the token counts:
"usage": {
"prompt_tokens": 123,
"completion_tokens": 456,
"cost_usd": 0.0042,
"tool_usage": {"web_search": 3, "code_interpreter": 1}
}Tool counts are already factored into cost_usd and are surfaced for transparency so you can audit per-tool billing. The field is omitted when no tools were invoked.
在 EmpirioLabs,Qwen3.8 Max 0902 按量计费:输入 $2.00 每100万个提示词标记; 产出 $6.00 每100万个生成代币; 网络搜索 $0.02 每次调用时。本页的实时价格表始终与 API 的实际计费一致。
Qwen3.8 Max 0902 支持 1M token 的上下文窗口,每次响应最多 131,072 个输出 token。
兼容。Qwen3.8 Max 0902 提供 OpenAI 兼容的 Chat Completions API,现有 OpenAI SDK 只需把 base_url 指向 https://api.empiriolabs.ai/v1 并把模型 ID 设为 qwen3-8-max-0902 即可使用。
可以。EmpirioLabs Playground在浏览器中以与 API 相同的参数运行 Qwen3.8 Max 0902,你可以在写代码之前先测试提示词。
创建 EmpirioLabs 账户,然后在控制台的 API Keys生成密钥。计费使用按量付费的额度,只为实际发出的请求付费。