Skip to main content
Vision

qwen3-vl-8b-thinking

Versi Thinking dari model Dense 8B dalam seri Qwen3-VL mengonsumsi lebih sedikit memori GPU dan mampu melakukan pemahaman serta penalaran multimodal. Model ini mendukung konteks yang sangat panjang, seperti video dan dokumen panjang, pelokalan visual 2D/3D, serta fitur pemahaman gambar/video, kesadaran spasial, dan kemampuan pengenalan objek yang telah ditingkatkan secara komprehensif.

Penyedia Layanan Inferensi

Penyedia layanan inferensi untuk qwen3-vl-8b-thinking adalah Alibaba Cloud Model Studio.

Kemampuan Model

  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
KemampuanDukunganKemampuanDukungan

Modalitas Input

Text Image Video

Modalitas Output

Text

Pengalaman Model

Didukung

Function Calling

Didukung

Structured Outputs

Didukung

Web Search

Tidak Didukung

Prefix Completion

Didukung

Context Caching

Tidak Didukung

Batch Inference

Tidak Didukung

Fine-tuning

Didukung

Batas Konteks

ParameterNilaiParameterNilai

Panjang Input Maksimum

126976

Panjang Output Maksimum

32768

Jendela Konteks

131072

Harga

Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu apa pun. Kunjungi Konsol Model Studio untuk penawaran promosi.
  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
Item PenagihanHarga (USD)Unit

Input(Thinking)

0,072

Per 1 juta token

Output(Thinking)

0,717

Per 1 juta token

Batas Laju

  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
ParameterNilai

RPM (Requests Per Minute)

600

TPM (Tokens Per Minute)

1.000.000

Rencana Token (Team Edition)
Model playground
  • Pembuatan audio
  • Pembuatan musik
Statistik dan Pemantauan
Asset Center