Skip to main content
向量與重排序

gte-rerank-v2

gte-rerank-v2是通義實驗室研發的多語言文本統一排序模型,面向全球多個主流語種,提供高水平的文本排序服務。通常用於語義檢索、RAG等情境,可以簡單、有效地提升文本檢索的效果。給定查詢 (Query) 和一系列候選文本 (documents),模型會根據與查詢的語義相關性從高到低對候選文本進行排序。

推理服務供應商

gte-rerank-v2模型的推理服務供應商為阿里雲百鍊。

模型能力

能力項支援情況能力項支援情況

輸入模態

Text

輸出模態

Text

模型體驗

不支援

Function Calling

不支援

結構化輸出

不支援

連網搜尋

不支援

首碼續寫

不支援

上下文緩衝

不支援

批量推理

不支援

模型調優

不支援

上下文限制

參數參數

最大輸入長度

30000

最大輸出長度

0

上下文長度

30000

限流

  • 華北2(北京)
參數

RPM(每分鐘請求數)

5040

TPM(每分鐘tokens)

4,980,000,000

Token Plan
模型體驗
  • 音樂產生
用量統計與效能監控
資產中心