Skip to main content
Vision

qwen3-vl-30b-a3b-thinking

Versi Thinking dari model MoE terbesar kedua dalam seri Qwen3-VL menawarkan respons cepat serta peningkatan kemampuan pemahaman dan penalaran multimodal, agen visual, dan dukungan untuk konteks sangat panjang seperti video dan dokumen berdurasi lama. Model ini juga dilengkapi peningkatan komprehensif dalam pemahaman gambar/video, kesadaran spasial, serta kemampuan pengenalan objek, sehingga sangat cocok untuk tugas-tugas dunia nyata yang kompleks.

Penyedia Layanan Inferensi

Penyedia layanan inferensi untuk qwen3-vl-30b-a3b-thinking adalah Alibaba Cloud Model Studio.

Kemampuan Model

  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
KemampuanDukunganKemampuanDukungan

Modalitas Input

Text Image Video

Modalitas Output

Text

Pengalaman Model

Didukung

Function Calling

Didukung

Structured Outputs

Didukung

Web Search

Tidak Didukung

Prefix Completion

Didukung

Context Caching

Tidak Didukung

Batch Inference

Tidak Didukung

Fine-tuning

Tidak Didukung

Batas Konteks

ParameterNilaiParameterNilai

Panjang Input Maksimum

126976

Panjang Output Maksimum

32768

Jendela Konteks

131072

Harga

Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
Item PenagihanHarga (USD)Unit

Input(Thinking)

0,108

Per 1 juta token

Output(Thinking)

1,075

Per 1 juta token

Batas Laju

  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
ParameterNilai

RPM (Requests Per Minute)

600

TPM (Tokens Per Minute)

1.000.000

Rencana Token (Team Edition)
Model playground
  • Pembuatan audio
  • Pembuatan musik
Statistik dan Pemantauan
Asset Center