语义文档重排序器。可按相关性排序最多500个候选人,支持100+语言,并接受自定义排序指令。
也称为 Alibaba Cloud Qwen3 Rerank
qwen3-rerank/v1/reranks来自 EmpirioLabs 目录的实时按量计费价格。只为实际用量付费,没有月度最低消费。
Qwen3 Rerank 通过 POST /v1/reranks 提供,使用模型 ID qwen3-rerank 和你的 EmpirioLabs API 密钥。 在EmpirioLabs 控制台获取 API 密钥。
curl https://api.empiriolabs.ai/v1/reranks \
-H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3-rerank",
"prompt": "Your input here."
}'EmpirioLabs 上 Qwen3 Rerank API 支持的请求参数。省略字段时使用默认值。
| 参数 | 类型 | 默认值 | 范围 / 值 | 描述 |
|---|---|---|---|---|
| query | string | - | - | 查询文本以对文档进行排序。最多4000个代币。 |
| documents | array | - | - | 候选文档需要排序(字符串)。最多500件物品,每个最多4000个代币。 |
| top_n | number | 10 | 1 到 500 | 需归还的顶级文件数量。默认所有。 |
| instruct | string | Given a web search query, retrieve relevant passages that answer the query. | - | 定制英语教学。使用“检索语义相似文本”进行相似排序。 |
| return_documents | boolean | false | - | 当为真时,返回原始文档文本并列每个结果。 |
每个请求限制 - 每个请求最多500个候选文档 - 每个query/document最多4,000个令牌 - 每个请求最多120,000个令牌(公式:query_tokens × n_docs + sum_of_doc_tokens) - 计费令牌为查询+文档的总和;只有成功的重新排名才会收费 语言 - 100+主要语言,包括中文、英语、西班牙语、法语、葡萄牙语、印尼语、日语、韩语、德语、俄语 排序模式(instruct参数) - *默认,问答检索*:“Given a web search query, retrieve relevant passages that answer the query. - *Semantic similarity*: Retrieve semantically similar text.” - 或任何自定义英语指令(参见[模型任务提示](https://github.com/QwenLM/Qwen3-Embedding/blob/main/evaluation/task_prompts.json))
在 EmpirioLabs,Qwen3 Rerank 按量计费:输入 $0.10 每100万个提示词标记。本页的实时价格表始终与 API 的实际计费一致。
Qwen3 Rerank 支持 4K token 的上下文窗口。
Qwen3 Rerank 通过 api.empiriolabs.ai 上的 POST /v1/reranks 提供,使用标准的 Bearer 令牌认证。
可以。EmpirioLabs Playground在浏览器中以与 API 相同的参数运行 Qwen3 Rerank,你可以在写代码之前先测试提示词。
创建 EmpirioLabs 账户,然后在控制台的 API Keys生成密钥。计费使用按量付费的额度,只为实际发出的请求付费。