Skip to main content
Vision

qwen3-vl-plus

Model VL seri Qwen3 secara efektif mengintegrasikan mode berpikir dan tidak berpikir, mencapai kinerja terdepan di dunia dalam kemampuan agen visual pada dataset benchmark publik seperti OS World. Versi ini menampilkan peningkatan komprehensif dalam pengkodean visual, persepsi spasial, dan penalaran multimodal, secara signifikan meningkatkan kemampuan persepsi dan pengenalan visual serta mendukung pemahaman video ultra-panjang. Secara fungsional, versi model ini setara dengan model Snapshot qwen3-vl-plus-2025-12-19.

Penyedia Layanan Inferensi

Penyedia layanan inferensi untuk qwen3-vl-plus adalah Alibaba Cloud Model Studio.

Kemampuan Model

  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
  • Hong Kong (Tiongkok)
KemampuanDukunganKemampuanDukungan

Modalitas Input

Text Image Video

Modalitas Output

Text

Pengalaman Model

Didukung

Function Calling

Didukung

Structured Outputs

Didukung

Web Search

Tidak Didukung

Prefix Completion

Didukung

Context Caching

Didukung

Batch Inference

Didukung

Fine-tuning

Tidak Didukung

Batas Konteks

ParameterNilaiParameterNilai

Panjang Input Maksimum

260096

Panjang Output Maksimum

32768

Jendela Konteks

262144

Panjang Input Maksimum (Mode Berpikir)

258048

Panjang Output Maksimum (Mode Berpikir)

32768

Panjang Chain-of-Thought Maksimum

81920

Harga

Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
  • Hong Kong (Tiongkok)

Input<=32k

Item PenagihanHarga (USD)Unit

Input

0,144

Per 1 juta token

Output

1,434

Per 1 juta token

Input(Implicit Cache)

0,029

Per 1 juta token

Input(Batch File)

0,072

Per 1 juta token

Output(Batch File)

0,717

Per 1 juta token

Explicit Cache Creation

0,18

Per 1 juta token

Explicit Cache Read

0,014

Per 1 juta token

Input(Batch Chat)

0,144

Per 1 juta token

Output(Batch Chat)

1,434

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,216

Per 1 juta token

Output

2,151

Per 1 juta token

Input(Implicit Cache)

0,044

Per 1 juta token

Input(Batch File)

0,108

Per 1 juta token

Output(Batch File)

1,075

Per 1 juta token

Explicit Cache Creation

0,27

Per 1 juta token

Explicit Cache Read

0,022

Per 1 juta token

Input(Batch Chat)

0,216

Per 1 juta token

Output(Batch Chat)

2,151

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,431

Per 1 juta token

Output

4,301

Per 1 juta token

Input(Implicit Cache)

0,087

Per 1 juta token

Input(Batch File)

0,215

Per 1 juta token

Output(Batch File)

2,15

Per 1 juta token

Explicit Cache Creation

0,539

Per 1 juta token

Explicit Cache Read

0,043

Per 1 juta token

Input(Batch Chat)

0,431

Per 1 juta token

Output(Batch Chat)

4,301

Per 1 juta token

Batas Laju

  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
  • Hong Kong (Tiongkok)
ParameterNilai

RPM (Permintaan Per Menit)

3000

TPM (Token Per Menit)

5.000.000

Versi Snapshot

qwen3-vl-plus-2025-12-19

Model pemahaman visual seri Qwen3 secara efektif mengintegrasikan mode berpikir dan tidak berpikir. Dibandingkan dengan snapshot yang dirilis pada 23 September, versi ini menawarkan kinerja unggul dalam tugas penalaran, analisis, dan kontrol gaya, serta latensi lebih rendah dan kecepatan respons lebih cepat. Versi ini didasarkan pada snapshot yang diambil pada 19 Desember 2025.

Penyedia Layanan Inferensi

Penyedia layanan inferensi untuk qwen3-vl-plus-2025-12-19 adalah Alibaba Cloud Model Studio.

Kemampuan Model

  • Tiongkok (Beijing)
  • Singapura
  • Hong Kong (Tiongkok)
KemampuanDukunganKemampuanDukungan

Modalitas Input

Text Image Video

Modalitas Output

Text

Pengalaman Model

Didukung

Function Calling

Didukung

Structured Outputs

Didukung

Web Search

Tidak Didukung

Prefix Completion

Didukung

Context Caching

Tidak Didukung

Batch Inference

Tidak Didukung

Fine-tuning

Tidak Didukung

Batas Konteks

ParameterNilaiParameterNilai

Panjang Input Maksimum

260096

Panjang Output Maksimum

32768

Jendela Konteks

262144

Panjang Input Maksimum (Mode Berpikir)

258048

Panjang Output Maksimum (Mode Berpikir)

32768

Panjang Chain-of-Thought Maksimum

81920

Harga

Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
  • Tiongkok (Beijing)
  • Singapura
  • Hong Kong (Tiongkok)

Input<=32k

Item PenagihanHarga (USD)Unit

Input

0,144

Per 1 juta token

Output

1,434

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,216

Per 1 juta token

Output

2,151

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,431

Per 1 juta token

Output

4,301

Per 1 juta token

Batas Laju

  • Tiongkok (Beijing)
  • Singapura
  • Hong Kong (Tiongkok)
ParameterNilai

RPM (Permintaan Per Menit)

60

TPM (Token Per Menit)

100.000

qwen3-vl-plus-2025-09-23

Model VL seri Qwen3 secara efektif mengintegrasikan mode berpikir dan tidak berpikir, mencapai kinerja terdepan di dunia dalam kemampuan agen visual pada dataset benchmark publik seperti OS World. Versi ini menampilkan peningkatan komprehensif dalam pengkodean visual, persepsi spasial, dan penalaran multimodal, secara signifikan meningkatkan kemampuan persepsi dan pengenalan visual serta mendukung pemahaman video ultra-panjang. Versi ini merupakan snapshot per tanggal 23 September 2025.

Penyedia Layanan Inferensi

Penyedia layanan inferensi untuk qwen3-vl-plus-2025-09-23 adalah Alibaba Cloud Model Studio.

Kemampuan Model

  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
KemampuanDukunganKemampuanDukungan

Modalitas Input

Text Image Video

Modalitas Output

Text

Pengalaman Model

Didukung

Function Calling

Didukung

Structured Outputs

Didukung

Web Search

Tidak Didukung

Prefix Completion

Didukung

Context Caching

Tidak Didukung

Batch Inference

Tidak Didukung

Fine-tuning

Tidak Didukung

Batas Konteks

ParameterNilaiParameterNilai

Panjang Input Maksimum

260096

Panjang Output Maksimum

32768

Jendela Konteks

262144

Panjang Input Maksimum (Mode Berpikir)

258048

Panjang Output Maksimum (Mode Berpikir)

32768

Panjang Chain-of-Thought Maksimum

81920

Harga

Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)

Input<=32k

Item PenagihanHarga (USD)Unit

Input

0,143

Per 1 juta token

Output

1,434

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,215

Per 1 juta token

Output

2,15

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,43

Per 1 juta token

Output

4,301

Per 1 juta token

Batas Laju

  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
ParameterNilai

RPM (Permintaan Per Menit)

60

TPM (Token Per Menit)

100.000

Rencana Token (Team Edition)
Model playground
  • Pembuatan audio
  • Pembuatan musik
Statistik dan Pemantauan
Asset Center