Skip to main content
Text Generation

qwen-plus

Qwen-Plus adalah versi yang ditingkatkan dari model bahasa ultra-besar Qwen yang mendukung berbagai bahasa input, termasuk Tionghoa dan Inggris. Dibandingkan dengan versi sebelumnya, model ini menunjukkan peningkatan signifikan dalam kemampuan menghasilkan kode, penalaran logis, serta kemampuan multibahasa—baik dalam bahasa Tionghoa maupun Inggris. Gaya respons telah disesuaikan secara signifikan agar selaras dengan preferensi manusia, dengan peningkatan nyata dalam tingkat detail dan kejelasan respons. Peningkatan khusus juga dilakukan pada penulisan kreatif, kepatuhan terhadap format JSON, dan kemampuan bermain peran. Versi model ini secara fungsional setara dengan snapshot model qwen-plus-2025-07-28.

Kemampuan Model

KemampuanDukunganKemampuanDukungan

Modalitas Input

Text

Modalitas Output

Text

Pengalaman Model

Supported

Function Calling

Supported

Structured Outputs

Supported

Web Search

Supported

Prefix Completion

Supported

Context Caching

Supported

Batch Inference

Supported

Fine-tuning

Unsupported

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

997952

Max Output Length

32768

Context Window

1000000

Max Input Length (Thinking Mode)

995904

Max Output Length (Thinking Mode)

32768

Max Chain-of-Thought Length

81920

Harga

Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Model Studio Console untuk penawaran promosi.
  • Tiongkok (Beijing)
  • Jerman (Frankfurt)
  • AS (Virginia)

Input<=128k

Item PenagihanHarga (USD)Unit

Input

0,115

Per 1 juta token

Output

0,287

Per 1 juta token

Input(Thinking)

0,115

Per 1 juta token

Output(Thinking)

1,147

Per 1 juta token

Input(Implicit Cache)

0,023

Per 1 juta token

Input(Thinking Implicit Cache)

0,023

Per 1 juta token

Thinking Output(Batch File)

0,573

Per 1 juta token

Input(Batch File)

0,057

Per 1 juta token

Output(Batch File)

0,143

Per 1 juta token

Input(Thinking Batch File)

0,057

Per 1 juta token

Explicit Cache Creation

0,144

Per 1 juta token

Explicit Cache Read

0,012

Per 1 juta token

Explicit Cache Creation(Thinking)

0,144

Per 1 juta token

Explicit Cache Read(Thinking)

0,012

Per 1 juta token

Input(Batch Chat)

0,115

Per 1 juta token

Output(Batch Chat)

0,287

Per 1 juta token

Input(Thinking Mode Batch Chat)

0,115

Per 1 juta token

Output(Thinking Mode Batch Chat)

1,147

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,345

Per 1 juta token

Output

2,868

Per 1 juta token

Input(Thinking)

0,345

Per 1 juta token

Output(Thinking)

3,441

Per 1 juta token

Input(Implicit Cache)

0,069

Per 1 juta token

Input(Thinking Implicit Cache)

0,069

Per 1 juta token

Thinking Output(Batch File)

1,72

Per 1 juta token

Input(Batch File)

0,172

Per 1 juta token

Output(Batch File)

1,434

Per 1 juta token

Input(Thinking Batch File)

0,172

Per 1 juta token

Explicit Cache Creation

0,431

Per 1 juta token

Explicit Cache Read

0,035

Per 1 juta token

Explicit Cache Creation(Thinking)

0,431

Per 1 juta token

Explicit Cache Read(Thinking)

0,035

Per 1 juta token

Input(Batch Chat)

0,345

Per 1 juta token

Output(Batch Chat)

2,868

Per 1 juta token

Input(Thinking Mode Batch Chat)

0,345

Per 1 juta token

Output(Thinking Mode Batch Chat)

3,441

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,689

Per 1 juta token

Output

6,881

Per 1 juta token

Input(Thinking)

0,689

Per 1 juta token

Output(Thinking)

9,175

Per 1 juta token

Input(Implicit Cache)

0,138

Per 1 juta token

Input(Thinking Implicit Cache)

0,138

Per 1 juta token

Thinking Output(Batch File)

4,587

Per 1 juta token

Input(Batch File)

0,344

Per 1 juta token

Output(Batch File)

3,44

Per 1 juta token

Input(Thinking Batch File)

0,344

Per 1 juta token

Explicit Cache Creation

0,861

Per 1 juta token

Explicit Cache Read

0,069

Per 1 juta token

Explicit Cache Creation(Thinking)

0,861

Per 1 juta token

Explicit Cache Read(Thinking)

0,069

Per 1 juta token

Input(Batch Chat)

0,689

Per 1 juta token

Output(Batch Chat)

6,881

Per 1 juta token

Input(Thinking Mode Batch Chat)

0,689

Per 1 juta token

Output(Thinking Mode Batch Chat)

9,175

Per 1 juta token

Batas Laju

  • Tiongkok (Beijing)
  • Jerman (Frankfurt)
  • AS (Virginia)
ParameterNilai

RPM (Requests Per Minute)

30.000

TPM (Tokens Per Minute)

5.000.000

Pembaruan Dinamis

qwen-plus-latest

Model seri Qwen yang dioptimalkan untuk keseimbangan performa, menawarkan efisiensi inferensi antara Qwen-Max dan Qwen-Turbo, dirancang untuk menangani tugas-tugas dengan kompleksitas sedang secara efektif. Versi yang diperbarui secara dinamis ini menerapkan perubahan tanpa pemberitahuan sebelumnya.

Kemampuan Model

KemampuanDukunganKemampuanDukungan

Modalitas Input

Text

Modalitas Output

Text

Pengalaman Model

Supported

Function Calling

Supported

Structured Outputs

Supported

Web Search

Supported

Prefix Completion

Supported

Context Caching

Unsupported

Batch Inference

Supported

Fine-tuning

Unsupported

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

995904

Max Output Length

32768

Context Window

1000000

Harga

Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Model Studio Console untuk penawaran promosi.
  • Tiongkok (Beijing)

Input<=128k

Item PenagihanHarga (USD)Unit

Input

0,115

Per 1 juta token

Output

0,287

Per 1 juta token

Input(Thinking)

0,115

Per 1 juta token

Output(Thinking)

1,147

Per 1 juta token

Thinking Output(Batch File)

0,573

Per 1 juta token

Input(Batch File)

0,057

Per 1 juta token

Output(Batch File)

0,143

Per 1 juta token

Input(Thinking Batch File)

0,057

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,345

Per 1 juta token

Output

2,868

Per 1 juta token

Input(Thinking)

0,345

Per 1 juta token

Output(Thinking)

3,441

Per 1 juta token

Thinking Output(Batch File)

1,72

Per 1 juta token

Input(Batch File)

0,172

Per 1 juta token

Output(Batch File)

1,434

Per 1 juta token

Input(Thinking Batch File)

0,172

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,689

Per 1 juta token

Output

6,881

Per 1 juta token

Input(Thinking)

0,689

Per 1 juta token

Output(Thinking)

9,175

Per 1 juta token

Thinking Output(Batch File)

4,587

Per 1 juta token

Input(Batch File)

0,344

Per 1 juta token

Output(Batch File)

3,44

Per 1 juta token

Input(Thinking Batch File)

0,344

Per 1 juta token

Batas Laju

  • Tiongkok (Beijing)
ParameterNilai

RPM (Requests Per Minute)

15.000

TPM (Tokens Per Minute)

1.200.000

Versi Snapshot

qwen-plus-2025-12-01

Versi ini merupakan snapshot per 1 Desember 2025 dan menampilkan peningkatan kemampuan penalaran dibandingkan snapshot 28 Juli. Kemampuan agen dan kemampuan pemanggilan alat multi-turn telah ditingkatkan lebih lanjut, serta performa pada tugas kreatif subjektif meningkat secara signifikan. Model ini mendukung panjang konteks hingga 1 juta token, dengan harga bertingkat berdasarkan panjang konteks.

Kemampuan Model

KemampuanDukunganKemampuanDukungan

Modalitas Input

Text

Modalitas Output

Text

Pengalaman Model

Supported

Function Calling

Supported

Structured Outputs

Supported

Web Search

Supported

Prefix Completion

Supported

Context Caching

Unsupported

Batch Inference

Unsupported

Fine-tuning

Unsupported

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

997952

Max Output Length

32768

Context Window

1000000

Max Input Length (Thinking Mode)

995904

Max Output Length (Thinking Mode)

32768

Harga

Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Model Studio Console untuk penawaran promosi.
  • Tiongkok (Beijing)
  • Jerman (Frankfurt)
  • AS (Virginia)

Input<=128k

Item PenagihanHarga (USD)Unit

Input

0,115

Per 1 juta token

Output

0,287

Per 1 juta token

Input(Thinking)

0,115

Per 1 juta token

Output(Thinking)

1,147

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,345

Per 1 juta token

Output

2,868

Per 1 juta token

Input(Thinking)

0,345

Per 1 juta token

Output(Thinking)

3,441

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,689

Per 1 juta token

Output

6,881

Per 1 juta token

Input(Thinking)

0,689

Per 1 juta token

Output(Thinking)

9,175

Per 1 juta token

Batas Laju

  • Tiongkok (Beijing)
  • Jerman (Frankfurt)
  • AS (Virginia)
ParameterNilai

RPM (Requests Per Minute)

120

TPM (Tokens Per Minute)

1.000.000

qwen-plus-2025-09-11

Berdasarkan snapshot 11 September 2025, rilis ini menampilkan peningkatan dalam mengikuti instruksi dan respons ringkas yang disederhanakan dalam mode thinking. Mode non-thinking menyediakan pemahaman teks Tionghoa yang unggul dan kemampuan penalaran logis yang ditingkatkan. Model ini mendukung panjang konteks 1 juta dengan harga bertingkat.

Kemampuan Model

KemampuanDukunganKemampuanDukungan

Modalitas Input

Text

Modalitas Output

Text

Pengalaman Model

Unsupported

Function Calling

Unsupported

Structured Outputs

Unsupported

Web Search

Unsupported

Prefix Completion

Unsupported

Context Caching

Unsupported

Batch Inference

Unsupported

Fine-tuning

Unsupported

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

995904

Max Output Length

32768

Context Window

1000000

Harga

Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Model Studio Console untuk penawaran promosi.
  • Tiongkok (Beijing)
  • Jerman (Frankfurt)
  • AS (Virginia)

Input<=128k

Item PenagihanHarga (USD)Unit

Input

0,115

Per 1 juta token

Output

0,287

Per 1 juta token

Input(Thinking)

0,115

Per 1 juta token

Output(Thinking)

1,147

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,345

Per 1 juta token

Output

2,868

Per 1 juta token

Input(Thinking)

0,345

Per 1 juta token

Output(Thinking)

3,441

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,689

Per 1 juta token

Output

6,881

Per 1 juta token

Input(Thinking)

0,689

Per 1 juta token

Output(Thinking)

9,175

Per 1 juta token

Batas Laju

  • Tiongkok (Beijing)
  • Jerman (Frankfurt)
  • AS (Virginia)
ParameterNilai

RPM (Requests Per Minute)

60

TPM (Tokens Per Minute)

1.000.000

qwen-plus-2025-07-28

Model Plus seri Qwen3 mengintegrasikan mode thinking dan non-thinking serta dapat beralih mode selama dialog. Dibandingkan dengan versi sebelumnya, model ini menambahkan peningkatan khusus untuk kemampuan Tionghoa & Inggris dan pemanggilan alat. Ini adalah snapshot tanggal 28 Juli 2025; yang pertama mendukung panjang konteks 1 juta dan menggunakan harga bertingkat.

Kemampuan Model

KemampuanDukunganKemampuanDukungan

Modalitas Input

Text

Modalitas Output

Text

Pengalaman Model

Supported

Function Calling

Supported

Structured Outputs

Supported

Web Search

Supported

Prefix Completion

Supported

Context Caching

Unsupported

Batch Inference

Unsupported

Fine-tuning

Unsupported

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

995904

Max Output Length

32768

Context Window

1000000

Harga

Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Model Studio Console untuk penawaran promosi.
  • Tiongkok (Beijing)
  • Jerman (Frankfurt)
  • AS (Virginia)

Input<=128k

Item PenagihanHarga (USD)Unit

Input

0,115

Per 1 juta token

Output

0,287

Per 1 juta token

Input(Thinking)

0,115

Per 1 juta token

Output(Thinking)

1,147

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,345

Per 1 juta token

Output

2,868

Per 1 juta token

Input(Thinking)

0,345

Per 1 juta token

Output(Thinking)

3,441

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,689

Per 1 juta token

Output

6,881

Per 1 juta token

Input(Thinking)

0,689

Per 1 juta token

Output(Thinking)

9,175

Per 1 juta token

Batas Laju

  • Tiongkok (Beijing)
  • Jerman (Frankfurt)
  • AS (Virginia)
ParameterNilai

RPM (Requests Per Minute)

60

TPM (Tokens Per Minute)

1.000.000

qwen-plus-2025-07-14

Model Plus dari Seri Qwen3 secara efektif mengintegrasikan mode thinking dan non-thinking, memungkinkan peralihan mode selama percakapan. Ini adalah snapshot tanggal 14 Juli 2025. Dibandingkan dengan versi sebelumnya, terdapat peningkatan signifikan dalam kemampuan Tionghoa dan Inggris di bawah mode non-thinking, dengan kemampuan pemanggilan alat yang ditingkatkan.

Kemampuan Model

KemampuanDukunganKemampuanDukungan

Modalitas Input

Text

Modalitas Output

Text

Pengalaman Model

Supported

Function Calling

Supported

Structured Outputs

Supported

Web Search

Supported

Prefix Completion

Supported

Context Caching

Unsupported

Batch Inference

Unsupported

Fine-tuning

Unsupported

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

98304

Max Output Length

16384

Context Window

131072

Harga

Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Model Studio Console untuk penawaran promosi.
  • Tiongkok (Beijing)
Item PenagihanHarga (USD)Unit

Input

0,115

Per 1 juta token

Output

0,287

Per 1 juta token

Input(Thinking)

0,115

Per 1 juta token

Output(Thinking)

1,147

Per 1 juta token

Batas Laju

  • Tiongkok (Beijing)
ParameterNilai

RPM (Requests Per Minute)

60

TPM (Tokens Per Minute)

100.000

qwen-plus-2025-04-28

Model Plus seri Qwen3 secara efektif mengintegrasikan mode thinking dan non-thinking, memungkinkan peralihan mode selama percakapan. Kemampuan penalarannya secara signifikan melampaui QwQ, dan kemampuan umumnya secara nyata melebihi Qwen2.5-Plus, mencapai tingkat SOTA dalam skala yang sama di industri. Model ini merupakan snapshot tanggal 28 April 2025.

Kemampuan Model

KemampuanDukunganKemampuanDukungan

Modalitas Input

Text

Modalitas Output

Text

Pengalaman Model

Supported

Function Calling

Supported

Structured Outputs

Supported

Web Search

Unsupported

Prefix Completion

Supported

Context Caching

Unsupported

Batch Inference

Unsupported

Fine-tuning

Unsupported

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

98304

Max Output Length

16384

Context Window

131072

Harga

Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Model Studio Console untuk penawaran promosi.
  • Tiongkok (Beijing)
Item PenagihanHarga (USD)Unit

Input

0,115

Per 1 juta token

Output

0,287

Per 1 juta token

Input(Thinking)

0,115

Per 1 juta token

Output(Thinking)

1,147

Per 1 juta token

Batas Laju

  • Tiongkok (Beijing)
ParameterNilai

RPM (Requests Per Minute)

60

TPM (Tokens Per Minute)

1.000.000

qwen-plus-2025-01-25

Model seri Qwen yang seimbang dalam kemampuan, menawarkan performa dan kecepatan penalaran yang berada di antara Qwen-Max dan Qwen-Turbo, sehingga cocok untuk tugas-tugas dengan kompleksitas sedang. Dibandingkan dengan versi sebelumnya, model ini menunjukkan peningkatan signifikan dalam kemampuan menghasilkan kode, penalaran logis, serta kemampuan multibahasa—baik dalam bahasa Tionghoa maupun Inggris. Gaya respons telah disesuaikan secara signifikan agar selaras dengan preferensi manusia, dengan peningkatan nyata dalam tingkat detail dan kejelasan respons. Peningkatan khusus juga dilakukan pada penulisan kreatif, kepatuhan terhadap format JSON, dan kemampuan bermain peran.

Kemampuan Model

KemampuanDukunganKemampuanDukungan

Modalitas Input

Text

Modalitas Output

Text

Pengalaman Model

Supported

Function Calling

Supported

Structured Outputs

Supported

Web Search

Unsupported

Prefix Completion

Supported

Context Caching

Unsupported

Batch Inference

Unsupported

Fine-tuning

Unsupported

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

129024

Max Output Length

8192

Context Window

131072

Harga

Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Model Studio Console untuk penawaran promosi.
  • Tiongkok (Beijing)
Item PenagihanHarga (USD)Unit

Input

0,115

Per 1 juta token

Output

0,287

Per 1 juta token

Batas Laju

  • Tiongkok (Beijing)
ParameterNilai

RPM (Requests Per Minute)

60

TPM (Tokens Per Minute)

150.000

qwen-plus-0112

Model seri Qwen yang seimbang dalam kemampuan, menawarkan performa dan kecepatan penalaran yang berada di antara Qwen-Max dan Qwen-Turbo, sehingga cocok untuk tugas-tugas dengan kompleksitas sedang. Dibandingkan dengan versi qwen-plus-2024-1220, model ini menunjukkan peningkatan dalam kemampuan keseluruhan bahasa Tionghoa dan Inggris, terutama dalam pengetahuan umum dan pemahaman membaca. Fenomena code-switch juga mengalami perbaikan signifikan dibandingkan versi sebelumnya, serta kemampuan mengikuti instruksi dalam bahasa Tionghoa meningkat secara nyata.

Kemampuan Model

KemampuanDukunganKemampuanDukungan

Modalitas Input

Text

Modalitas Output

Text

Pengalaman Model

Supported

Function Calling

Unsupported

Structured Outputs

Unsupported

Web Search

Unsupported

Prefix Completion

Unsupported

Context Caching

Unsupported

Batch Inference

Unsupported

Fine-tuning

Unsupported

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

129024

Max Output Length

8192

Context Window

131072

Harga

Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Model Studio Console untuk penawaran promosi.
  • Tiongkok (Beijing)
Item PenagihanHarga (USD)Unit

Input

0,115

Per 1 juta token

Output

0,287

Per 1 juta token

Batas Laju

  • Tiongkok (Beijing)
ParameterNilai

RPM (Requests Per Minute)

60

TPM (Tokens Per Minute)

150.000

qwen-plus-1220

Model seri Qwen yang seimbang dalam kemampuan, menawarkan performa dan kecepatan penalaran yang berada di antara Qwen-Max dan Qwen-Turbo, sehingga cocok untuk tugas-tugas dengan kompleksitas sedang. Dibandingkan dengan versi qwen-plus-1125, model ini menunjukkan peningkatan dalam kemampuan keseluruhan bahasa Tionghoa dan Inggris, terutama dalam pengetahuan umum dan pemahaman membaca. Fenomena code-switch juga mengalami perbaikan signifikan dibandingkan versi sebelumnya, serta kemampuan mengikuti instruksi dalam bahasa Tionghoa meningkat secara nyata.

Kemampuan Model

KemampuanDukunganKemampuanDukungan

Modalitas Input

Text

Modalitas Output

Text

Pengalaman Model

Supported

Function Calling

Unsupported

Structured Outputs

Unsupported

Web Search

Unsupported

Prefix Completion

Unsupported

Context Caching

Unsupported

Batch Inference

Unsupported

Fine-tuning

Unsupported

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

129024

Max Output Length

8192

Context Window

131072

Harga

Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Model Studio Console untuk penawaran promosi.
  • Tiongkok (Beijing)
Item PenagihanHarga (USD)Unit

Input

0,115

Per 1 juta token

Output

0,287

Per 1 juta token

Batas Laju

  • Tiongkok (Beijing)
ParameterNilai

RPM (Requests Per Minute)

60

TPM (Tokens Per Minute)

150.000

Rencana Token (Team Edition)
Model playground
  • Pembuatan audio
  • Pembuatan musik
Statistik dan Pemantauan
Asset Center
Dukungan layanan