Qwen3.5 APIs

比较 Qwen3.5 系列的 8 个文本生成模型,然后调用符合你延迟、质量和价格需求的那一个。

Alibaba Cloud文本生成8 个模型

关于 Qwen3.5 API

EmpirioLabs 上的 Qwen3.5 汇集了 Alibaba Cloud 的 8 个文本生成模型 API(包括 Qwen3.5 Plus, Qwen3.5 122B-A10B, Qwen3.5 397B-A17B, Qwen3.5 35B-A3B)。每个模型都有自己的页面,包含实时价格、参数、文档和 Playground 入口。

在整个系列中使用同一个 EmpirioLabs API 密钥和端点模式,只需更改请求中的 model ID 即可切换行为。

Qwen3.5 模型(8)

Qwen3.5 API 价格

先一眼比较整个系列,再打开模型页面查看完整的实时价格表和参数。

端点
POST/v1/chat/completions
价格
类型
规格
价格
投入
每1M 提示符
$0.40<=256K $0.36$1.20256K-1M $1.08
产出
每1M个生成的令牌
$2.40<=256K $2.21$7.20256K-1M $6.62
网络搜索
引用时每次呼叫
$0.015
文本到图像搜索
引用时每次呼叫
$0.012
图像到图像搜索
引用时每次呼叫
$0.012
网络提取器
引用时每次呼叫
$0.00
代码解释器
引用时每次呼叫
$0.00
最适合
具有混合结构的多模式模型,用于在1M上下文中高效的深度思考和视觉理解,跨越文本,图像,视频.
端点
POST/v1/chat/completions
价格
类型
规格
价格
投入
每1M 提示符
$0.40<=128K $0.115$0.40128K-256K $0.287
产出
每1M个生成的令牌
$3.20<=128K $0.917$3.20128K-256K $2.294
网络搜索
引用时每次呼叫
$0.01
最适合
Quen3.5 122B-A10B是一种多式联运推理模型,其上下文为256K,高效的稀疏的MOE推论,以及文本,图像,视频输入.
端点
POST/v1/chat/completions
价格
类型
规格
价格
投入
每1M 提示符
$0.60<=128K $0.172$0.60128K-256K $0.43
产出
每1M个生成的令牌
$3.60<=128K $1.032$3.60128K-256K $2.58
网络搜索
引用时每次呼叫
$0.01
最适合
Quen3.5 397B-A17B是语言,代码,代理,GUI任务,图像和视频理解的旗舰式多式联运推理模型.
端点
POST/v1/chat/completions
价格
类型
规格
价格
投入
每1M 提示符
$0.25<=128K $0.057$0.25128K-256K $0.229
产出
每1M个生成的令牌
$2.00<=128K $0.459$2.00128K-256K $1.835
网络搜索
引用时每次呼叫
$0.01
最适合
Quen3.5 35B-A3B是一个高效的本土视觉语言模型,其MOE的路由,深思熟虑,以及文本,图像,视频输入.
端点
POST/v1/chat/completions
价格
类型
规格
价格
投入
每1M 提示符
$0.30<=128K $0.086$0.30128K-256K $0.258
产出
每1M个生成的令牌
$2.40<=128K $0.688$2.40128K-256K $2.064
网络搜索
引用时每次呼叫
$0.01
最适合
Quen3.5 27B是一种密集的多式联运推理模型,具有快速响应,256K上下文,以及文本,图像,和视频的理解.
端点
POST/v1/chat/completions
价格
类型
规格
价格
投入
每1M 提示符
$0.10$0.09
产出
每1M个生成的令牌
$0.15$0.13
隐形缓存已读
每1M缓存输入符
$0.045
网络搜索(链接)
引用时每次呼叫
$0.013
最适合
Quen3.5 9B是一种紧凑的多式联运推理模型,有256K上下文,图像和视频输入,功能工具,以及结构化输出.
端点
POST/v1/chat/completions
价格
类型
规格
价格
投入
每1M 提示符
$0.04
产出
每1M个生成的令牌
$0.07
隐形缓存已读
每1M缓存输入符
$0.02
网络搜索(链接)
引用时每次呼叫
$0.013
最适合
Quen3.5 4B是一种低成本的多式联运推理模型,其上下文,图像和视频输入,功能工具,以及结构化输出.
端点
POST/v1/chat/completions
价格
类型
规格
价格
投入
每1M 提示符
$0.10$0.090
产出
每1M个生成的令牌
$0.40$0.368
网络搜索
引用时每次呼叫
$0.015
文本到图像搜索
引用时每次呼叫
$0.012
图像到图像搜索
引用时每次呼叫
$0.012
网络提取器
引用时每次呼叫
$0.00
代码解释器
引用时每次呼叫
$0.00
最适合
具有混合线性意向+稀疏的MOE,1M上下文,以及快速多式联运 text/image /video推论的视觉语言模型.
在完整价格页比较所有模型

如何调用 Qwen3.5 模型

Qwen3.5 Plus 提供 OpenAI 兼容的 Chat Completions API。用你的 EmpirioLabs API 密钥把任意 OpenAI SDK 指向 https://api.empiriolabs.ai/v1,并使用模型 ID qwen3-5-plus。 在这个系列中,可以把 model 值换成任意受支持的 ID:qwen3-5-plus qwen3-5-122b-a10b qwen3-5-397b-a17b qwen3-5-35b-a3b qwen3-5-27b qwen3-5-9b qwen3-5-4b qwen3-5-flash。 在EmpirioLabs 控制台获取 API 密钥。

cURL
curl https://api.empiriolabs.ai/v1/chat/completions \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3-5-plus",
    "messages": [
      {"role": "user", "content": "Write a haiku about the ocean."}
    ]
  }'

Qwen3.5 示例与对比

查看提到这个模型系列的提示词测试、输出笔记和对比实验。

Qwen3.5 API:常见问题

什么是 Qwen3.5 API?

EmpirioLabs 上的 Qwen3.5 是 Alibaba Cloud 的 8 个文本生成模型 API 组成的系列:Qwen3.5 Plus, Qwen3.5 122B-A10B, Qwen3.5 397B-A17B, Qwen3.5 35B-A3B, Qwen3.5 27B, Qwen3.5 9B, Qwen3.5 4B, Qwen3.5 Flash。你使用一个 EmpirioLabs API 密钥,并选择适合请求的模型 ID。

我该用哪个 Qwen3.5 模型?

从页面最符合你速度、质量和价格需求的模型开始,然后在EmpirioLabs Playground中测试。上面的对比卡片链接到每个模型的实时价格表和快速上手。

可以在不重构集成的情况下切换 Qwen3.5 模型吗?

可以。这个系列遵循同一个 EmpirioLabs API 模式,大多数集成只需更改 model 值即可切换。如果依赖某个模型特有的参数,上线前请查看模型页面。

Qwen3.5 的价格如何展示?

按量计费。本页卡片展示实时目录的简短摘要,每个模型页面展示与 API 计费一致的完整价格表。

可以在浏览器里试用 Qwen3.5 吗?

可以。打开该系列的任意模型页面,使用其 Playground 链接在浏览器中测试提示词和参数,然后再集成 API。

准备好使用更好的终端了吗?

查看我们的定价,或者如果你想将自己的模型部署到我们的堆栈中,请联系我们。