Skip to main content
Text Generation

qwen3-coder-flash

Berdasarkan Qwen3, model generasi kode ini mewarisi kemampuan coding agent dari Qwen3-Coder-Plus dan mendukung interaksi tool multi-turn. Model ini menampilkan optimasi yang difokuskan pada pemahaman tingkat repositori serta peningkatan stabilitas pemanggilan tool. Versi ini secara fungsional setara dengan snapshot model qwen3-coder-flash-2025-07-28.

Penyedia Layanan Inferensi

Penyedia layanan inferensi untuk qwen3-coder-flash adalah Alibaba Cloud Model Studio.

Kemampuan Model

  • China (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
KemampuanDukunganKemampuanDukungan

Input Modality

Text

Output Modality

Text

Model Experience

Supported

Function Calling

Supported

Structured Outputs

Unsupported

Web Search

Unsupported

Prefix Completion

Unsupported

Context Caching

Supported

Batch Inference

Unsupported

Fine-tuning

Unsupported

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

997952

Max Output Length

65536

Context Window

1000000

Harga

Halaman ini hanya menampilkan harga standar untuk panggilan API model, tidak termasuk promosi berbatas waktu apa pun. Kunjungi Konsol Model Studio untuk informasi penawaran promosi.
  • China (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)

Input<=32k

Item PenagihanHarga (USD)Unit

Input

0,144

Per 1 juta token

Output

0,574

Per 1 juta token

Input(Implicit Cache)

0,029

Per 1 juta token

Explicit Cache Creation

0,18

Per 1 juta token

Explicit Cache Read

0,014

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,216

Per 1 juta token

Output

0,861

Per 1 juta token

Input(Implicit Cache)

0,044

Per 1 juta token

Explicit Cache Creation

0,27

Per 1 juta token

Explicit Cache Read

0,022

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,359

Per 1 juta token

Output

1,434

Per 1 juta token

Input(Implicit Cache)

0,072

Per 1 juta token

Explicit Cache Creation

0,449

Per 1 juta token

Explicit Cache Read

0,036

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,717

Per 1 juta token

Output

3,584

Per 1 juta token

Input(Implicit Cache)

0,144

Per 1 juta token

Explicit Cache Creation

0,896

Per 1 juta token

Explicit Cache Read

0,072

Per 1 juta token

Batas Laju

  • China (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
ParameterNilai

RPM (Requests Per Minute)

5000

TPM (Tokens Per Minute)

5.000.000

Versi Snapshot

qwen3-coder-flash-2025-07-28

Berdasarkan Qwen3, model generasi kode ini mewarisi kemampuan coding agent dari Qwen3-Coder-Plus dan mendukung interaksi tool multi-turn. Model ini menampilkan optimasi yang difokuskan pada pemahaman tingkat repositori serta peningkatan stabilitas pemanggilan tool. Versi ini merupakan snapshot bertanggal 28 Juli 2025.

Penyedia Layanan Inferensi

Penyedia layanan inferensi untuk qwen3-coder-flash-2025-07-28 adalah Alibaba Cloud Model Studio.

Kemampuan Model

  • China (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
KemampuanDukunganKemampuanDukungan

Input Modality

Text

Output Modality

Text

Model Experience

Supported

Function Calling

Supported

Structured Outputs

Unsupported

Web Search

Unsupported

Prefix Completion

Unsupported

Context Caching

Unsupported

Batch Inference

Unsupported

Fine-tuning

Unsupported

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

997952

Max Output Length

65536

Context Window

1000000

Harga

Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu apa pun. Kunjungi Konsol Model Studio untuk penawaran promosi.
  • China (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)

Input<=32k

Item PenagihanHarga (USD)Unit

Input

0,144

Per 1 juta token

Output

0,574

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,216

Per 1 juta token

Output

0,861

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,359

Per 1 juta token

Output

1,434

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,717

Per 1 juta token

Output

3,584

Per 1 juta token

Batas Laju

  • China (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
ParameterNilai

RPM (Requests Per Minute)

60

TPM (Tokens Per Minute)

1.000.000

Rencana Token (Team Edition)
Model playground
  • Pembuatan audio
  • Pembuatan musik
Statistik dan Pemantauan
Asset Center
Dukungan layanan