Skip to main content
Text Generation

qwen3-max

Model Max dalam seri Qwen 3 telah mengalami peningkatan khusus dalam pemrograman agen dan pemanggilan tool dibandingkan dengan versi pratinjau. Model yang dirilis secara resmi kali ini telah mencapai performa state-of-the-art (SOTA) di bidangnya dan lebih cocok untuk memenuhi kebutuhan agen yang beroperasi dalam skenario lebih kompleks. Versi ini secara fungsional setara dengan snapshot model qwen3-max-2026-01-23.

Penyedia Layanan Inferensi

Penyedia layanan inferensi untuk qwen3-max adalah Alibaba Cloud Model Studio.

Kemampuan Model

  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
  • Hong Kong (Tiongkok)
KemampuanDukunganKemampuanDukungan

Input Modality

Text

Output Modality

Text

Model Experience

Didukung

Function Calling

Didukung

Structured Outputs

Didukung

Web Search

Didukung

Prefix Completion

Didukung

Context Caching

Didukung

Batch Inference

Didukung

Fine-tuning

Tidak didukung

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

258048

Max Output Length

65536

Context Window

262144

Max Input Length (Thinking Mode)

258048

Max Output Length (Thinking Mode)

32768

Max Chain-of-Thought Length

81920

Harga

Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
  • Hong Kong (Tiongkok)

Input<=32k

Item PenagihanHarga (USD)Unit

Input

0,359

Per 1 juta token

Output

1,434

Per 1 juta token

Input(Implicit Cache)

0,072

Per 1 juta token

Input(Batch File)

0,18

Per 1 juta token

Output(Batch File)

0,717

Per 1 juta token

Explicit Cache Creation

0,448

Per 1 juta token

Explicit Cache Read

0,036

Per 1 juta token

Input(Batch Chat)

0,359

Per 1 juta token

Output(Batch Chat)

1,434

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,574

Per 1 juta token

Output

2,294

Per 1 juta token

Input(Implicit Cache)

0,115

Per 1 juta token

Input(Batch File)

0,287

Per 1 juta token

Output(Batch File)

1,147

Per 1 juta token

Explicit Cache Creation

0,717

Per 1 juta token

Explicit Cache Read

0,058

Per 1 juta token

Input(Batch Chat)

0,574

Per 1 juta token

Output(Batch Chat)

2,294

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

1,004

Per 1 juta token

Output

4,014

Per 1 juta token

Input(Implicit Cache)

0,201

Per 1 juta token

Input(Batch File)

0,502

Per 1 juta token

Output(Batch File)

2,007

Per 1 juta token

Explicit Cache Creation

1,255

Per 1 juta token

Explicit Cache Read

0,101

Per 1 juta token

Input(Batch Chat)

1,004

Per 1 juta token

Output(Batch Chat)

4,014

Per 1 juta token

Batas Laju

  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
  • Hong Kong (Tiongkok)
ParameterNilai

RPM (Requests Per Minute)

30000

TPM (Tokens Per Minute)

5.000.000

Versi Snapshot

qwen3-max-preview

Versi pratinjau Model Max dalam seri Qwen 3 mencapai integrasi efektif antara mode berpikir dan non-berpikir. Dalam mode berpikir, terdapat peningkatan signifikan dalam kemampuan seperti pemrograman agen cerdas, penalaran akal sehat, serta penalaran lintas bidang matematika, sains, dan umum.

Penyedia Layanan Inferensi

Penyedia layanan inferensi untuk qwen3-max-preview adalah Alibaba Cloud Model Studio.

Kemampuan Model

  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
KemampuanDukunganKemampuanDukungan

Input Modality

Text

Output Modality

Text

Model Experience

Didukung

Function Calling

Tidak didukung

Structured Outputs

Tidak didukung

Web Search

Tidak didukung

Prefix Completion

Tidak didukung

Context Caching

Didukung

Batch Inference

Tidak didukung

Fine-tuning

Tidak didukung

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

258048

Max Output Length

65536

Context Window

262144

Max Input Length (Thinking Mode)

258048

Max Output Length (Thinking Mode)

32768

Max Chain-of-Thought Length

81920

Harga

Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)

Input<=32k

Item PenagihanHarga (USD)Unit

Input

0,861

Per 1 juta token

Output

3,441

Per 1 juta token

Input(Implicit Cache)

0,173

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

1,434

Per 1 juta token

Output

5,735

Per 1 juta token

Input(Implicit Cache)

0,287

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

2,151

Per 1 juta token

Output

8,602

Per 1 juta token

Input(Implicit Cache)

0,431

Per 1 juta token

Batas Laju

  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
ParameterNilai

RPM (Requests Per Minute)

600

TPM (Tokens Per Minute)

1.000.000

qwen3-max-2026-01-23

Dibandingkan dengan snapshot per 23 September 2025, Model Max seri Qwen 3 pada rilis ini mencapai integrasi efektif antara mode berpikir dan non-berpikir, menghasilkan peningkatan komprehensif dan substansial dalam performa keseluruhan model. Dalam mode berpikir, model secara simultan mendukung pencarian web, ekstraksi informasi web, dan tool interpreter kode, memungkinkannya menangani masalah yang lebih kompleks dan menantang dengan akurasi lebih tinggi melalui pemanfaatan tool eksternal disertai penalaran deliberatif yang lambat. Versi ini berdasarkan snapshot yang diambil pada 23 Januari 2026.

Penyedia Layanan Inferensi

Penyedia layanan inferensi untuk qwen3-max-2026-01-23 adalah Alibaba Cloud Model Studio.

Kemampuan Model

  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • Hong Kong (Tiongkok)
KemampuanDukunganKemampuanDukungan

Input Modality

Text

Output Modality

Text

Model Experience

Didukung

Function Calling

Didukung

Structured Outputs

Didukung

Web Search

Didukung

Prefix Completion

Didukung

Context Caching

Tidak didukung

Batch Inference

Tidak didukung

Fine-tuning

Tidak didukung

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

258048

Max Output Length

65536

Context Window

262144

Max Input Length (Thinking Mode)

258048

Max Output Length (Thinking Mode)

32768

Max Chain-of-Thought Length

81920

Harga

Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • Hong Kong (Tiongkok)

Input<=32k

Item PenagihanHarga (USD)Unit

Input

0,359

Per 1 juta token

Output

1,434

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,574

Per 1 juta token

Output

2,294

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

1,004

Per 1 juta token

Output

4,014

Per 1 juta token

Batas Laju

  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • Hong Kong (Tiongkok)
ParameterNilai

RPM (Requests Per Minute)

600

TPM (Tokens Per Minute)

1.000.000

qwen3-max-2025-09-23

Model Max dalam seri Qwen 3 telah mengalami peningkatan khusus dalam pemrograman agen dan pemanggilan tool dibandingkan dengan versi pratinjau. Model yang dirilis secara resmi kali ini telah mencapai performa state-of-the-art (SOTA) di bidangnya dan lebih cocok untuk memenuhi kebutuhan agen yang beroperasi dalam skenario lebih kompleks. Versi ini merupakan snapshot per 23 September 2025.

Penyedia Layanan Inferensi

Penyedia layanan inferensi untuk qwen3-max-2025-09-23 adalah Alibaba Cloud Model Studio.

Kemampuan Model

  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
KemampuanDukunganKemampuanDukungan

Input Modality

Text

Output Modality

Text

Model Experience

Didukung

Function Calling

Didukung

Structured Outputs

Didukung

Web Search

Didukung

Prefix Completion

Didukung

Context Caching

Tidak didukung

Batch Inference

Tidak didukung

Fine-tuning

Tidak didukung

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

258048

Max Output Length

32768

Context Window

262144

Harga

Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)

Input<=32k

Item PenagihanHarga (USD)Unit

Input

0,86

Per 1 juta token

Output

3,44

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

1,434

Per 1 juta token

Output

5,734

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

2,15

Per 1 juta token

Output

8,601

Per 1 juta token

Batas Laju

  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
ParameterNilai

RPM (Requests Per Minute)

60

TPM (Tokens Per Minute)

100.000

Rencana Token (Team Edition)
Model playground
  • Pembuatan audio
  • Pembuatan musik
Statistik dan Pemantauan
Asset Center
Dukungan layanan