Skip to main content
Text Generation

qwen3.7-flash

Model Flash seri vision-language native Qwen3.7 secara komprehensif meningkatkan kemampuan pemahaman multimodal dan eksekusi Agent dibandingkan dengan 3.6-Flash. Peningkatan utama mencakup penguatan kemampuan multimodal dasar, peningkatan pengenalan objek, serta persepsi dunia nyata dan kecerdasan spasial yang lebih baik. Skenario Multimodal Agent seperti Search Agent dan CI Agent mengalami peningkatan signifikan dengan eksekusi tugas end-to-end yang lebih stabil. Kemampuan coding multimodal juga dioptimalkan untuk memberikan pengalaman coding vibe yang lebih lancar.

Penyedia Layanan Inferensi

Penyedia layanan inferensi untuk qwen3.7-flash adalah Alibaba Cloud Model Studio.

Kemampuan Model

  • China (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
  • Jepang (Tokyo)
  • Hong Kong (China)
KemampuanDukunganKemampuanDukungan

Input Modality

Image Text Video

Output Modality

Text

Model Experience

Didukung

Function Calling

Didukung

Structured Outputs

Didukung

Web Search

Didukung

Prefix Completion

Didukung

Context Caching

Didukung

Batch Inference

Didukung

Fine-tuning

Tidak didukung

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

991808

Max Output Length

131072

Context Window

1000000

Max Input Length (Thinking Mode)

983616

Max Output Length (Thinking Mode)

131072

Max Chain-of-Thought Length

262144

Harga

Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
  • China (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
  • Jepang (Tokyo)
  • Hong Kong (China)

Input<=32k

Item PenagihanHarga (USD)Unit

Input

0,028

Per 1 juta token

Output

0,11

Per 1 juta token

Input(Implicit Cache)

0,006

Per 1 juta token

Input(Batch File)

0,014

Per 1 juta token

Output(Batch File)

0,055

Per 1 juta token

Explicit Cache Creation

0,034

Per 1 juta token

Explicit Cache Read

0,003

Per 1 juta token

Input(Batch Chat)

0,028

Per 1 juta token

Output(Batch Chat)

0,11

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,083

Per 1 juta token

Output

0,33

Per 1 juta token

Input(Implicit Cache)

0,017

Per 1 juta token

Input(Batch File)

0,041

Per 1 juta token

Output(Batch File)

0,165

Per 1 juta token

Explicit Cache Creation

0,103

Per 1 juta token

Explicit Cache Read

0,008

Per 1 juta token

Input(Batch Chat)

0,083

Per 1 juta token

Output(Batch Chat)

0,33

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,165

Per 1 juta token

Output

0,66

Per 1 juta token

Input(Implicit Cache)

0,033

Per 1 juta token

Input(Batch File)

0,083

Per 1 juta token

Output(Batch File)

0,33

Per 1 juta token

Explicit Cache Creation

0,206

Per 1 juta token

Explicit Cache Read

0,017

Per 1 juta token

Input(Batch Chat)

0,165

Per 1 juta token

Output(Batch Chat)

0,66

Per 1 juta token

Batas Laju

  • China (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • Jepang (Tokyo)
  • Hong Kong (China)
ParameterNilai

RPM (Requests Per Minute)

30000

TPM (Tokens Per Minute)

5.000.000

Versi Snapshot

qwen3.7-flash-2026-07-15

Model Flash seri vision-language native Qwen3.7 secara komprehensif meningkatkan kemampuan pemahaman multimodal dan eksekusi Agent dibandingkan dengan 3.6-Flash. Peningkatan utama mencakup penguatan kemampuan multimodal dasar, peningkatan pengenalan objek, serta persepsi dunia nyata dan kecerdasan spasial yang lebih baik. Skenario Multimodal Agent seperti Search Agent dan CI Agent mengalami peningkatan signifikan dengan eksekusi tugas end-to-end yang lebih stabil. Kemampuan coding multimodal juga dioptimalkan untuk memberikan pengalaman coding vibe yang lebih lancar.

Penyedia Layanan Inferensi

Penyedia layanan inferensi untuk qwen3.7-flash-2026-07-15 adalah Alibaba Cloud Model Studio.

Kemampuan Model

  • China (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
  • Jepang (Tokyo)
  • Hong Kong (China)
KemampuanDukunganKemampuanDukungan

Input Modality

Image Text Video

Output Modality

Text

Model Experience

Didukung

Function Calling

Didukung

Structured Outputs

Didukung

Web Search

Didukung

Prefix Completion

Didukung

Context Caching

Didukung

Batch Inference

Tidak didukung

Fine-tuning

Tidak didukung

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

991808

Max Output Length

131072

Context Window

1000000

Max Input Length (Thinking Mode)

983616

Max Output Length (Thinking Mode)

131072

Max Chain-of-Thought Length

262144

Harga

Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
  • China (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
  • Jepang (Tokyo)
  • Hong Kong (China)

Input<=32k

Item PenagihanHarga (USD)Unit

Input

0,028

Per 1 juta token

Output

0,11

Per 1 juta token

Input(Implicit Cache)

0,006

Per 1 juta token

Explicit Cache Creation

0,034

Per 1 juta token

Explicit Cache Read

0,003

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,083

Per 1 juta token

Output

0,33

Per 1 juta token

Input(Implicit Cache)

0,017

Per 1 juta token

Explicit Cache Creation

0,103

Per 1 juta token

Explicit Cache Read

0,008

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,165

Per 1 juta token

Output

0,66

Per 1 juta token

Input(Implicit Cache)

0,033

Per 1 juta token

Explicit Cache Creation

0,206

Per 1 juta token

Explicit Cache Read

0,017

Per 1 juta token

Batas Laju

  • China (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • Jepang (Tokyo)
  • Hong Kong (China)
ParameterNilai

RPM (Requests Per Minute)

30000

TPM (Tokens Per Minute)

5.000.000

Rencana Token (Team Edition)
Model playground
  • Pembuatan audio
  • Pembuatan musik
Statistik dan Pemantauan
Asset Center
Dukungan layanan