Model pengurutan teks multibahasa untuk pengambilan semantik dan RAG yang mengurutkan dokumen kandidat berdasarkan relevansinya terhadap kueri.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk gte-rerank-v2 adalah Alibaba Cloud Model Studio.
Kemampuan Model
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Modalitas Input | Text | Modalitas Output | Text |
Pengalaman Model | Unsupported | Function Calling | Unsupported |
Structured Outputs | Unsupported | Web Search | Unsupported |
Prefix Completion | Unsupported | Context Caching | Unsupported |
Batch Inference | Unsupported | Fine-tuning | Unsupported |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Panjang Input Maksimum | 30000 | Panjang Output Maksimum | 0 |
Context Window | 30000 |
Batas Laju
- Tiongkok (Beijing)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 5.040 |
TPM (Tokens Per Minute) | 4.980.000.000 |