Model seri Qwen3.5 Plus dengan kemampuan vision-language native dibangun di atas arsitektur hibrida yang mengintegrasikan mekanisme perhatian linear dan model sparse mixture-of-experts, sehingga mencapai efisiensi inferensi yang lebih tinggi. Dalam berbagai evaluasi tugas, seri 3.5 secara konsisten menunjukkan performa setara dengan model terkemuka teknologi terkini. Dibandingkan seri 3, model ini menunjukkan peningkatan signifikan baik dalam kemampuan teks murni maupun multimodal. Versi model ini secara fungsional setara dengan model snapshot qwen3.5-plus-2026-02-15.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk qwen3.5-plus adalah Alibaba Cloud Model Studio.
Kemampuan Model
- China (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Input Modality | Text Image Video | Output Modality | Text |
Model Experience | Didukung | Function Calling | Didukung |
Structured Outputs | Didukung | Web Search | Didukung |
Prefix Completion | Didukung | Context Caching | Didukung |
Batch Inference | Didukung | Fine-tuning | Tidak didukung |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 991808 | Max Output Length | 65536 |
Context Window | 1000000 | Max Input Length (Thinking Mode) | 983616 |
Max Output Length (Thinking Mode) | 65536 | Max Chain-of-Thought Length | 81920 |
Harga
Halaman ini hanya menampilkan harga standar untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk informasi penawaran promosi.
- China (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
Input<=128k
Input<=128k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,115 | Per 1 juta token |
Output | 0,688 | Per 1 juta token |
Input(Batch File) | 0,057 | Per 1 juta token |
Output(Batch File) | 0,344 | Per 1 juta token |
Explicit Cache Creation | 0,143 | Per 1 juta token |
Explicit Cache Read | 0,012 | Per 1 juta token |
Input(Batch Chat) | 0,115 | Per 1 juta token |
Output(Batch Chat) | 0,688 | Per 1 juta token |
128k<Input<=256k
128k<Input<=256k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,287 | Per 1 juta token |
Output | 1,72 | Per 1 juta token |
Input(Batch File) | 0,143 | Per 1 juta token |
Output(Batch File) | 0,86 | Per 1 juta token |
Explicit Cache Creation | 0,358 | Per 1 juta token |
Explicit Cache Read | 0,029 | Per 1 juta token |
Input(Batch Chat) | 0,287 | Per 1 juta token |
Output(Batch Chat) | 1,72 | Per 1 juta token |
256k<Input<=1m
256k<Input<=1m
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,573 | Per 1 juta token |
Output | 3,44 | Per 1 juta token |
Input(Batch File) | 0,287 | Per 1 juta token |
Output(Batch File) | 1,72 | Per 1 juta token |
Explicit Cache Creation | 0,717 | Per 1 juta token |
Explicit Cache Read | 0,057 | Per 1 juta token |
Input(Batch Chat) | 0,573 | Per 1 juta token |
Output(Batch Chat) | 3,44 | Per 1 juta token |
Batas Laju
- China (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 30.000 |
TPM (Tokens Per Minute) | 5.000.000 |
Versi Snapshot
qwen3.5-plus-2026-04-20
Model seri Plus Qwen3.5 native vision-language mengalami peningkatan signifikan dalam kemampuan coding agentic dibandingkan snapshot tanggal 15 Februari. Kecepatan inferensi juga ditingkatkan secara signifikan, sementara retensi pengetahuan, kemampuan penalaran, dan pemrosesan konteks panjang tetap pada level tinggi, menjadikannya sangat cocok untuk tugas berbasis agen yang kompleks. Model ini ideal untuk aplikasi seperti agen coding, alur kerja produksi, dan skenario throughput tinggi. Versi ini berdasarkan snapshot yang diambil pada 20 April 2026.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk qwen3.5-plus-2026-04-20 adalah Alibaba Cloud Model Studio.
Kemampuan Model
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Input Modality | Image Text Video | Output Modality | Text |
Model Experience | Didukung | Function Calling | Didukung |
Structured Outputs | Didukung | Web Search | Didukung |
Prefix Completion | Didukung | Context Caching | Didukung |
Batch Inference | Tidak didukung | Fine-tuning | Tidak didukung |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 991808 | Max Output Length | 65536 |
Context Window | 1000000 | Max Input Length (Thinking Mode) | 983616 |
Max Output Length (Thinking Mode) | 65536 |
Harga
Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
- China (Beijing)
- Singapura
Input<=128k
Input<=128k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,115 | Per 1 juta token |
Output | 0,688 | Per 1 juta token |
Explicit Cache Creation | 0,14375 | Per 1 juta token |
Explicit Cache Read | 0,0115 | Per 1 juta token |
128k<Input<=256k
128k<Input<=256k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,287 | Per 1 juta token |
Output | 1,72 | Per 1 juta token |
Explicit Cache Creation | 0,35875 | Per 1 juta token |
Explicit Cache Read | 0,0287 | Per 1 juta token |
256k<Input<=1m
256k<Input<=1m
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,573 | Per 1 juta token |
Output | 3,44 | Per 1 juta token |
Explicit Cache Creation | 0,71625 | Per 1 juta token |
Explicit Cache Read | 0,0573 | Per 1 juta token |
Batas Laju
- China (Beijing)
- Singapura
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 600 |
TPM (Tokens Per Minute) | 1.000.000 |
qwen3.5-plus-2026-02-15
Model seri Plus Qwen3.5 native vision-language dibangun di atas arsitektur hibrida yang mengintegrasikan mekanisme perhatian linear dengan model sparse mixture-of-experts, sehingga mencapai efisiensi inferensi yang lebih tinggi. Dalam berbagai evaluasi tugas, seri 3.5 secara konsisten menunjukkan performa setara dengan model terkemuka teknologi terkini. Dibandingkan seri 3, model ini menunjukkan lompatan kemampuan baik dalam teks murni maupun multimodal. Versi ini merupakan snapshot per 15 Februari 2026.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk qwen3.5-plus-2026-02-15 adalah Alibaba Cloud Model Studio.
Kemampuan Model
- China (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Input Modality | Text Image Video | Output Modality | Text |
Model Experience | Didukung | Function Calling | Didukung |
Structured Outputs | Didukung | Web Search | Didukung |
Prefix Completion | Didukung | Context Caching | Tidak didukung |
Batch Inference | Tidak didukung | Fine-tuning | Tidak didukung |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 991808 | Max Output Length | 65536 |
Context Window | 1000000 | Max Input Length (Thinking Mode) | 983616 |
Max Output Length (Thinking Mode) | 65536 | Max Chain-of-Thought Length | 81920 |
Harga
Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
- China (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
Input<=128k
Input<=128k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,115 | Per 1 juta token |
Output | 0,688 | Per 1 juta token |
128k<Input<=256k
128k<Input<=256k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,287 | Per 1 juta token |
Output | 1,72 | Per 1 juta token |
256k<Input<=1m
256k<Input<=1m
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,573 | Per 1 juta token |
Output | 3,44 | Per 1 juta token |
Batas Laju
- China (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 600 |
TPM (Tokens Per Minute) | 1.000.000 |