Qwen3 Rerank API

Reclassificador semântico de documentos. Ordena até 500 candidatos por consulta por relevância, suporta 100+ idiomas e aceita uma instrução de ordenação personalizada.

Alibaba CloudReclassificadores4K contextoLançado 5 de jun. de 2025SingaporeEndpoint proprietário

Sobre Qwen3 Rerank

Reclassificador semântico de documentos. Ordena até 500 candidatos por consulta por relevância, suporta 100+ idiomas e aceita uma instrução de ordenação personalizada.

Também conhecido como Alibaba Cloud Qwen3 Rerank

semantic rankingmultilingualragcustom instructions

Especificações de Qwen3 Rerank

ID do modelo
qwen3-rerank
Autor
Alibaba Cloud
Categoria
Reclassificadores
Lançado
5 de jun. de 2025
Janela de contexto
4K tokens
Entrada
Texto
Saída
Ranking
Região
Singapore
Endpoints
POST/v1/reranks

Preços da API Qwen3 Rerank

Tarifas pay-as-you-go ao vivo do catálogo EmpirioLabs. Você paga só pelo que usa, sem mínimo mensal.

Tipo
Especificação
Tarifa
Entrada
por 1M de tokens de prompt
$0.10
Comparar na página completa de preços

Como chamar a API Qwen3 Rerank

Qwen3 Rerank é servido por POST /v1/reranks com o id de modelo qwen3-rerank e sua chave de API EmpirioLabs. Obtenha uma chave de API no painel EmpirioLabs.

cURL
curl https://api.empiriolabs.ai/v1/reranks \
  -H "Authorization: Bearer $EMPIRIOLABS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3-rerank",
    "prompt": "Your input here."
  }'
Referência completa da API Qwen3 Rerank

Parâmetros da API Qwen3 Rerank

Parâmetros de requisição suportados pela API Qwen3 Rerank na EmpirioLabs. Os padrões valem quando um campo é omitido.

ParâmetroTipoPadrãoIntervalo / valoresDescrição
querystring--Consulte texto para classificar documentos em relação a eles. No máximo 4.000 tokens.
documentsarray--Documentos candidatos a ordenar (strings). No máximo 500 itens, cada um até 4.000 fichas.
top_nnumber101 a 500Número de documentos mais bem classificados a serem devoltidos. O padrão é para todos.
instructstringGiven a web search query, retrieve relevant passages that answer the query.-Instrução personalizada em inglês. Use "Recuperar texto semanticamente semelhante." para ordenação por similaridade.
return_documentsbooleanfalse-Quando for verdade, retorne o texto original do documento junto com cada resultado.

Bom saber

Limites por requisição - Até 500 documentos candidatos por requisição - Máximo 4.000 tokens por query/document - Máximo 120.000 tokens por requisição (fórmula: query_tokens × n_docs + sum_of_doc_tokens) - Tokens faturados são consulta+documentos combinados; apenas reclassificações bem-sucedidas são cobradas Idiomas - 100+ idiomas principais incluindo chinês, inglês, espanhol, francês, português, indonésio, japonês, coreano, alemão, russo Modos de ordenação (parâmetro instruct) - *Padrão, recuperação de perguntas e respostas*: 'Given a web search query, retrieve relevant passages that answer the query. - *Semantic similarity*: Retrieve semantically similar text.' - Ou qualquer instrução personalizada em inglês (veja [prompts de tarefas modelo](https://github.com/QwenLM/Qwen3-Embedding/blob/main/evaluation/task_prompts.json))

API Qwen3 Rerank: perguntas frequentes

Quanto custa a API Qwen3 Rerank?

Na EmpirioLabs, Qwen3 Rerank é cobrado por uso: Entrada $0.10 por 1M de tokens de prompt. A tabela de tarifas ao vivo desta página sempre corresponde ao que a API cobra.

Qual é a janela de contexto de Qwen3 Rerank?

Qwen3 Rerank suporta uma janela de contexto de 4K tokens.

Qual endpoint Qwen3 Rerank usa?

Qwen3 Rerank é servido por POST /v1/reranks em api.empiriolabs.ai com autenticação padrão por token Bearer.

Posso testar Qwen3 Rerank no navegador antes de integrar?

Sim. O playground da EmpirioLabs executa Qwen3 Rerank no navegador com os mesmos parâmetros que a API expõe, para você testar prompts antes de escrever código.

Como consigo uma chave de API Qwen3 Rerank?

Crie uma conta EmpirioLabs e gere uma chave em API Keys no painel. A cobrança usa créditos pay-as-you-go, então você paga apenas pelas requisições que faz.

Pronto para usar endpoints melhores?

Confira nossos preços ou entre em contato se quiser que seu próprio modelo seja implementado em nossa pilha.