Skip to main content
Embedding dan pemeringkatan ulang

gte-rerank-v2

Model pengurutan teks multibahasa untuk pengambilan semantik dan RAG yang mengurutkan dokumen kandidat berdasarkan relevansinya terhadap kueri.

Penyedia Layanan Inferensi

Penyedia layanan inferensi untuk gte-rerank-v2 adalah Alibaba Cloud Model Studio.

Kemampuan Model

KemampuanDukunganKemampuanDukungan

Modalitas Input

Text

Modalitas Output

Text

Pengalaman Model

Unsupported

Function Calling

Unsupported

Structured Outputs

Unsupported

Web Search

Unsupported

Prefix Completion

Unsupported

Context Caching

Unsupported

Batch Inference

Unsupported

Fine-tuning

Unsupported

Batas Konteks

ParameterNilaiParameterNilai

Panjang Input Maksimum

30000

Panjang Output Maksimum

0

Context Window

30000

Batas Laju

  • Tiongkok (Beijing)
ParameterNilai

RPM (Requests Per Minute)

5.040

TPM (Tokens Per Minute)

4.980.000.000

Rencana Token (Team Edition)
Model playground
  • Pembuatan audio
  • Pembuatan musik
Statistik dan Pemantauan
Asset Center
Dukungan layanan