Um modelo de rerank reclassifica os documentos retornados na recuperação inicial e posiciona os resultados mais relevantes no topo.
Visão geral dos modelos
- Singapore
- Beijing
Model | Max documents | Max input tokens per item | Max input tokens per request | Supported languages | Scenarios |
|---|---|---|---|---|---|
qwen3-rerank | 500 | 4.000 | 120.000 | Mais de 100 idiomas principais, como chinês, inglês, espanhol, francês, português, indonésio, japonês, coreano, alemão e russo |
|
- Máximo de tokens de entrada por item: Limite de tokens por consulta ou documento. Se a entrada de uma única consulta ou documento exceder esse limite, a API retornará um erro HTTP 400 e não truncará a entrada.
- Máximo de documentos: Quantidade máxima de documentos por requisição. No modelo qwen3-vl-rerank, o limite varia conforme o tipo de documento (texto, imagem, vídeo ou misto).
- Máximo de tokens de entrada por requisição: Calculado como
Query Tokens × Number of documents + Total document tokens. Não ultrapasse o limite por requisição.
Limitações de entrada
Model | Image | Video |
|---|---|---|
qwen3-vl-rerank | JPEG, PNG, WEBP, BMP, TIFF, ICO, DIB, ICNS e SGI (URL ou Base64) | MP4, AVI e MOV (apenas URL) |
Pré-requisitos
Obtenha uma chave de API e defina a chave de API como variável de ambiente. Para usar o SDK, instale o DashScope SDK.
HTTP
Cada modelo usa um endpoint diferente:
- qwen3-rerank:
POST https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-api/v1/reranks - qwen3-vl-rerank / gte-rerank-v2:
POST https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/services/rerank/text-rerank/text-rerank
{WorkspaceId} pelo seu ID do workspace real.
As duas APIs diferem na estrutura do corpo da requisição e no formato da resposta. Consulte os exemplos de requisição e resposta de cada modelo.
Request |
Replace |
Request headers | |
Content-Type string (Required)Tipo de conteúdo da requisição. Use application/json. | |
Authorization string (Required)Autentica a requisição com uma chave de API do Model Studio. Exemplo: Bearer sk-xxxx. | |
Request body | |
model string (Required)Nome do modelo. Valores aceitos: qwen3-rerank, gte-rerank-v2, qwen3-vl-rerank. | |
input object (Required)Conteúdo de entrada.No
Properties query string | object (Required)Texto da consulta (máximo de 4.000 tokens).O qwen3-vl-rerank aceita dois formatos de query:
array (Required)Documentos candidatos para ordenação. Cada elemento é uma string.O qwen3-vl-rerank aceita um dicionário ou string por elemento: {"modality type": "text/image URL/video URL"}. Tipos aceitos: text, image, video.
| |
parameters object (Optional)Parâmetros opcionais.No
Properties top_n int (Optional)Número de documentos mais bem classificados a retornar. Padrão: todos os documentos. Se o valor exceder o total de documentos, todos serão retornados.return_documents bool (Optional)Define se o texto do documento deve ser incluído nos resultados. Padrão: false. Modelos compatíveis: gte-rerank-v2, qwen3-vl-rerank.instruct string (Optional)Instrução personalizada de ordenação. Aplica-se aos modelos qwen3-rerank e qwen3-vl-rerank. Orienta o modelo a aplicar diferentes políticas de classificação. Exemplos:
float (Optional)Exclusivo do qwen3-vl-rerank. Controla a quantidade de quadros extraídos do vídeo. Valores menores resultam em menos quadros. Intervalo: 0-1 (padrão: 1,0). |
Response |
|
request_id stringIdentificador exclusivo da requisição para rastreamento e solução de problemas. | |
output objectSaída da tarefa.No
Properties results arrayResultados da ordenação, classificados por relevance_score em ordem decrescente.
Properties document dictObjeto do documento original. Retornado apenas quando return_documents for true. Formato: {"text": "Original document text"}.index intÍndice do documento no array de entrada documents.relevance_score doubleRelevância semântica entre o documento e a consulta. Intervalo: 0,0-1,0 (quanto maior, mais relevante).As pontuações são relativas à requisição atual e não podem ser comparadas entre requisições. | |
usage objectEstatísticas de uso de tokens.
Properties total_tokens intTotal de tokens consumidos pela requisição. | |
code stringCódigo de erro. Retornado apenas em requisições com falha. Consulte Error codes. | |
message stringMensagem de erro detalhada. Retornada apenas em requisições com falha. Consulte Error codes. |
Uso do SDK
Exemplo
Chame a API do modelo de rerank.
Os nomes dos parâmetros no SDK correspondem aos da API HTTP, mas a estrutura difere. O HTTP usa objetos aninhadosinputeparameters; já o SDK adota uma estrutura plana.
qwen3-vl-rerank para rerank multimodal com consulta por imagem.
Saída de exemplo
O SDK encapsula a resposta HTTP. Em requisições bem-sucedidas,
code e message são sempre strings vazias.