Versi General Text Vector V4 adalah model vektor teks multibahasa yang dikembangkan oleh Tongyi Lab berdasarkan Qwen3. Dibandingkan dengan versi V3, performanya meningkat secara signifikan dalam tugas pengambilan (retrieval), pengelompokan (clustering), dan klasifikasi teks. Model ini mencatat peningkatan 15% hingga 40% dalam evaluasi seperti MTEB multilingual, pengambilan teks Tiongkok-Inggris, dan pengambilan kode. Selain itu, model ini mendukung dimensi vektor yang ditentukan pengguna dalam rentang 64 hingga 2048.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk text-embedding-v4 adalah Alibaba Cloud Model Studio.
Kemampuan Model
- Tiongkok (Beijing)
- Singapura
- Hong Kong (Tiongkok)
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Modalitas Input | Text | Modalitas Output | Text |
Pengalaman Model | Tidak Didukung | Function Calling | Tidak Didukung |
Structured Outputs | Tidak Didukung | Web Search | Tidak Didukung |
Prefix Completion | Tidak Didukung | Context Caching | Tidak Didukung |
Batch Inference | Tidak Didukung | Fine-tuning | Tidak Didukung |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Panjang Input Maksimum | — | Panjang Output Maksimum | — |
Jendela Konteks | — |
Harga
Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
- Tiongkok (Beijing)
- Singapura
- Hong Kong (Tiongkok)
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Embedding(Batch File) | 0,036 | Per 1 juta token |
Input Teks | 0,072 | Per 1 juta token |
Batas Laju
- Tiongkok (Beijing)
- Singapura
- Hong Kong (Tiongkok)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 1.800 |
TPM (Tokens Per Minute) | 1.200.000 |