Skip to main content
Text Generation

qwen3.8-2.4t-a95b

Qwen3.8-2.4T-A95B adalah rilis open-source dari model andalan terbaru Qwen, yang diluncurkan pada Agustus 2026. Arsitektur MoE sparse-nya memiliki total 2,4 triliun parameter dengan ~95 miliar parameter yang diaktifkan per langkah, dipadukan dengan attention hibrida dan jendela konteks 1 juta token. Benchmark utama: GPQA Diamond 92,6, PaperBench 93,0, OSWorld 86,1, BabyVision 82,0. Peringkat ke-4 di CodeArena.

Penyedia Layanan Inferensi

Penyedia layanan inferensi untuk qwen3.8-2.4t-a95b adalah Alibaba Cloud Model Studio.

Kemampuan Model

KemampuanDukunganKemampuanDukungan

Modalitas Input

Teks

Modalitas Output

Teks

Pengalaman Model

Didukung

Function Calling

Didukung

Output Terstruktur

Didukung

Pencarian Web

Didukung

Kompleksi Prefiks

Didukung

Caching Konteks

Didukung

Inferensi Batch

Tidak Didukung

Fine-tuning

Tidak Didukung

Batas Konteks

Parameter

Nilai

Parameter

Nilai

Panjang Input Maksimum

991808

Panjang Output Maksimum

131072

Panjang Konteks

1000000

Panjang Input Maksimum (Mode Berpikir)

983616

Panjang Output Maksimum (Mode Berpikir)

131072

Panjang Chain-of-Thought Maksimum

131072

Harga

Halaman ini hanya menampilkan harga asli untuk pemanggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
  • China (Beijing)
  • Singapura
Item PenagihanHarga (USD)Unit

Input

1.65

Per 1 juta token

Output

4.951

Per 1 juta token

Input (Cache Hit)

0.206

Per 1 juta token

Pembuatan Cache Eksplisit

2.063

Per 1 juta token

Cache Hit Eksplisit

0.137

Per 1 juta token

Batas Laju

  • China (Beijing)
  • Singapura
ParameterNilai

RPM (Permintaan Per Menit)

5000

TPM (Token Per Menit)

5,000,000

Rencana Token (Team Edition)
Model playground
  • Pembuatan audio
  • Pembuatan musik
Statistik dan Pemantauan
Asset Center
Dukungan layanan