Skip to main content
Text Generation

qwen3.6-flash

Seri model vision-language native Flash Qwen3.6 menawarkan peningkatan performa signifikan dibandingkan versi 3.5-Flash. Model ini unggul terutama dalam kemampuan coding agentic, melampaui pendahulunya secara substansial pada berbagai benchmark code-agent, serta dalam penalaran matematika dan kode. Dari sisi visi, model ini menunjukkan kecerdasan spasial yang jauh lebih baik, dengan peningkatan utama dalam pelokalan objek dan deteksi objek.

Penyedia Layanan Inferensi

Penyedia layanan inferensi untuk qwen3.6-flash adalah Alibaba Cloud Model Studio.

Kemampuan Model

  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
  • Jepang (Tokyo)
  • Hong Kong (Tiongkok)
KemampuanDukunganKemampuanDukungan

Input Modality

Image Text Video

Output Modality

Text

Model Experience

Supported

Function Calling

Supported

Structured Outputs

Supported

Web Search

Supported

Prefix Completion

Supported

Context Caching

Supported

Batch Inference

Supported

Fine-tuning

Unsupported

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

991808

Max Output Length

65536

Context Window

1000000

Max Input Length (Thinking Mode)

983616

Max Output Length (Thinking Mode)

65536

Max Chain-of-Thought Length

131072

Harga

Halaman ini hanya menampilkan harga standar untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk informasi penawaran promosi.
  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
  • Jepang (Tokyo)
  • Hong Kong (Tiongkok)

Input<=256k

Item PenagihanHarga (USD)Unit

Input

0,165

Per 1 juta token

Output

0,99

Per 1 juta token

Input(Batch File)

0,083

Per 1 juta token

Output(Batch File)

0,495

Per 1 juta token

Explicit Cache Creation

0,206

Per 1 juta token

Explicit Cache Read

0,017

Per 1 juta token

Input(Batch Chat)

0,165

Per 1 juta token

Output(Batch Chat)

0,99

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,66

Per 1 juta token

Output

3,961

Per 1 juta token

Input(Batch File)

0,33

Per 1 juta token

Output(Batch File)

1,98

Per 1 juta token

Explicit Cache Creation

0,825

Per 1 juta token

Explicit Cache Read

0,066

Per 1 juta token

Input(Batch Chat)

0,66

Per 1 juta token

Output(Batch Chat)

3,961

Per 1 juta token

Batas Laju

  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
  • Jepang (Tokyo)
  • Hong Kong (Tiongkok)
ParameterNilai

RPM (Requests Per Minute)

30000

TPM (Tokens Per Minute)

10.000.000

Versi Snapshot

qwen3.6-flash-2026-04-16

Seri model vision-language native Flash Qwen3.6 menawarkan peningkatan performa signifikan dibandingkan versi 3.5-Flash. Model ini unggul terutama dalam kemampuan coding agentic, melampaui pendahulunya secara substansial pada berbagai benchmark code-agent, serta dalam penalaran matematika dan kode. Dari sisi visi, model ini menunjukkan kecerdasan spasial yang jauh lebih baik, dengan peningkatan utama dalam pelokalan objek dan deteksi objek. Rilis ini berdasarkan snapshot yang diambil pada 16 April 2026.

Penyedia Layanan Inferensi

Penyedia layanan inferensi untuk qwen3.6-flash-2026-04-16 adalah Alibaba Cloud Model Studio.

Kemampuan Model

  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
  • Jepang (Tokyo)
KemampuanDukunganKemampuanDukungan

Input Modality

Image Text Video

Output Modality

Text

Model Experience

Supported

Function Calling

Supported

Structured Outputs

Supported

Web Search

Supported

Prefix Completion

Supported

Context Caching

Unsupported

Batch Inference

Unsupported

Fine-tuning

Supported

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

991808

Max Output Length

65536

Context Window

1000000

Max Input Length (Thinking Mode)

983616

Max Output Length (Thinking Mode)

65536

Max Chain-of-Thought Length

131072

Harga

Halaman ini hanya menampilkan harga standar untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk informasi penawaran promosi.
  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
  • Jepang (Tokyo)

Input<=256k

Item PenagihanHarga (USD)Unit

Input

0,165

Per 1 juta token

Output

0,99

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,66

Per 1 juta token

Output

3,961

Per 1 juta token

Batas Laju

  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
  • Jepang (Tokyo)
ParameterNilai

RPM (Requests Per Minute)

600

TPM (Tokens Per Minute)

1.000.000

Rencana Token (Team Edition)
Model playground
  • Pembuatan audio
  • Pembuatan musik
Statistik dan Pemantauan
Asset Center
Dukungan layanan