Skip to main content
Text Generation

qwen3.5-plus

Model seri Qwen3.5 Plus dengan kemampuan vision-language native dibangun di atas arsitektur hibrida yang mengintegrasikan mekanisme perhatian linear dan model sparse mixture-of-experts, sehingga mencapai efisiensi inferensi yang lebih tinggi. Dalam berbagai evaluasi tugas, seri 3.5 secara konsisten menunjukkan performa setara dengan model terkemuka teknologi terkini. Dibandingkan seri 3, model ini menunjukkan peningkatan signifikan baik dalam kemampuan teks murni maupun multimodal. Versi model ini secara fungsional setara dengan model snapshot qwen3.5-plus-2026-02-15.

Penyedia Layanan Inferensi

Penyedia layanan inferensi untuk qwen3.5-plus adalah Alibaba Cloud Model Studio.

Kemampuan Model

  • China (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
KemampuanDukunganKemampuanDukungan

Input Modality

Text Image Video

Output Modality

Text

Model Experience

Didukung

Function Calling

Didukung

Structured Outputs

Didukung

Web Search

Didukung

Prefix Completion

Didukung

Context Caching

Didukung

Batch Inference

Didukung

Fine-tuning

Tidak didukung

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

991808

Max Output Length

65536

Context Window

1000000

Max Input Length (Thinking Mode)

983616

Max Output Length (Thinking Mode)

65536

Max Chain-of-Thought Length

81920

Harga

Halaman ini hanya menampilkan harga standar untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk informasi penawaran promosi.
  • China (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)

Input<=128k

Item PenagihanHarga (USD)Unit

Input

0,115

Per 1 juta token

Output

0,688

Per 1 juta token

Input(Batch File)

0,057

Per 1 juta token

Output(Batch File)

0,344

Per 1 juta token

Explicit Cache Creation

0,143

Per 1 juta token

Explicit Cache Read

0,012

Per 1 juta token

Input(Batch Chat)

0,115

Per 1 juta token

Output(Batch Chat)

0,688

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,287

Per 1 juta token

Output

1,72

Per 1 juta token

Input(Batch File)

0,143

Per 1 juta token

Output(Batch File)

0,86

Per 1 juta token

Explicit Cache Creation

0,358

Per 1 juta token

Explicit Cache Read

0,029

Per 1 juta token

Input(Batch Chat)

0,287

Per 1 juta token

Output(Batch Chat)

1,72

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,573

Per 1 juta token

Output

3,44

Per 1 juta token

Input(Batch File)

0,287

Per 1 juta token

Output(Batch File)

1,72

Per 1 juta token

Explicit Cache Creation

0,717

Per 1 juta token

Explicit Cache Read

0,057

Per 1 juta token

Input(Batch Chat)

0,573

Per 1 juta token

Output(Batch Chat)

3,44

Per 1 juta token

Batas Laju

  • China (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
ParameterNilai

RPM (Requests Per Minute)

30.000

TPM (Tokens Per Minute)

5.000.000

Versi Snapshot

qwen3.5-plus-2026-04-20

Model seri Plus Qwen3.5 native vision-language mengalami peningkatan signifikan dalam kemampuan coding agentic dibandingkan snapshot tanggal 15 Februari. Kecepatan inferensi juga ditingkatkan secara signifikan, sementara retensi pengetahuan, kemampuan penalaran, dan pemrosesan konteks panjang tetap pada level tinggi, menjadikannya sangat cocok untuk tugas berbasis agen yang kompleks. Model ini ideal untuk aplikasi seperti agen coding, alur kerja produksi, dan skenario throughput tinggi. Versi ini berdasarkan snapshot yang diambil pada 20 April 2026.

Penyedia Layanan Inferensi

Penyedia layanan inferensi untuk qwen3.5-plus-2026-04-20 adalah Alibaba Cloud Model Studio.

Kemampuan Model

KemampuanDukunganKemampuanDukungan

Input Modality

Image Text Video

Output Modality

Text

Model Experience

Didukung

Function Calling

Didukung

Structured Outputs

Didukung

Web Search

Didukung

Prefix Completion

Didukung

Context Caching

Didukung

Batch Inference

Tidak didukung

Fine-tuning

Tidak didukung

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

991808

Max Output Length

65536

Context Window

1000000

Max Input Length (Thinking Mode)

983616

Max Output Length (Thinking Mode)

65536

Harga

Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
  • China (Beijing)
  • Singapura

Input<=128k

Item PenagihanHarga (USD)Unit

Input

0,115

Per 1 juta token

Output

0,688

Per 1 juta token

Explicit Cache Creation

0,14375

Per 1 juta token

Explicit Cache Read

0,0115

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,287

Per 1 juta token

Output

1,72

Per 1 juta token

Explicit Cache Creation

0,35875

Per 1 juta token

Explicit Cache Read

0,0287

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,573

Per 1 juta token

Output

3,44

Per 1 juta token

Explicit Cache Creation

0,71625

Per 1 juta token

Explicit Cache Read

0,0573

Per 1 juta token

Batas Laju

  • China (Beijing)
  • Singapura
ParameterNilai

RPM (Requests Per Minute)

600

TPM (Tokens Per Minute)

1.000.000

qwen3.5-plus-2026-02-15

Model seri Plus Qwen3.5 native vision-language dibangun di atas arsitektur hibrida yang mengintegrasikan mekanisme perhatian linear dengan model sparse mixture-of-experts, sehingga mencapai efisiensi inferensi yang lebih tinggi. Dalam berbagai evaluasi tugas, seri 3.5 secara konsisten menunjukkan performa setara dengan model terkemuka teknologi terkini. Dibandingkan seri 3, model ini menunjukkan lompatan kemampuan baik dalam teks murni maupun multimodal. Versi ini merupakan snapshot per 15 Februari 2026.

Penyedia Layanan Inferensi

Penyedia layanan inferensi untuk qwen3.5-plus-2026-02-15 adalah Alibaba Cloud Model Studio.

Kemampuan Model

  • China (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
KemampuanDukunganKemampuanDukungan

Input Modality

Text Image Video

Output Modality

Text

Model Experience

Didukung

Function Calling

Didukung

Structured Outputs

Didukung

Web Search

Didukung

Prefix Completion

Didukung

Context Caching

Tidak didukung

Batch Inference

Tidak didukung

Fine-tuning

Tidak didukung

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

991808

Max Output Length

65536

Context Window

1000000

Max Input Length (Thinking Mode)

983616

Max Output Length (Thinking Mode)

65536

Max Chain-of-Thought Length

81920

Harga

Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
  • China (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)

Input<=128k

Item PenagihanHarga (USD)Unit

Input

0,115

Per 1 juta token

Output

0,688

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,287

Per 1 juta token

Output

1,72

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,573

Per 1 juta token

Output

3,44

Per 1 juta token

Batas Laju

  • China (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
ParameterNilai

RPM (Requests Per Minute)

600

TPM (Tokens Per Minute)

1.000.000

Rencana Token (Team Edition)
Model playground
  • Pembuatan audio
  • Pembuatan musik
Statistik dan Pemantauan
Asset Center
Dukungan layanan