Skip to main content
Text Generation

qwen3-30b-a3b

Model ini mencapai integrasi efektif antara mode berpikir dan tidak berpikir, memungkinkan peralihan mode selama percakapan. Kemampuan reasoning-nya menyaingi QwQ-32B meskipun memiliki ukuran parameter yang lebih kecil, serta kemampuan umumnya secara signifikan melampaui Qwen2.5-14B, mencapai tingkat SOTA pada skala industri yang setara.

Penyedia Layanan Inferensi

Penyedia layanan inferensi untuk qwen3-30b-a3b adalah Alibaba Cloud Model Studio.

Kemampuan Model

  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
KemampuanDukunganKemampuanDukungan

Input Modality

Text

Output Modality

Text

Model Experience

Didukung

Function Calling

Didukung

Structured Outputs

Didukung

Web Search

Tidak Didukung

Prefix Completion

Didukung

Context Caching

Tidak Didukung

Batch Inference

Tidak Didukung

Fine-tuning

Tidak Didukung

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

98304

Max Output Length

8192

Context Window

131072

Harga

Halaman ini hanya menampilkan harga dasar untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
Item PenagihanHarga (USD)Unit

Input

0,108

Per 1 juta token

Output

0,431

Per 1 juta token

Input(Thinking)

0,108

Per 1 juta token

Output(Thinking)

1,076

Per 1 juta token

Batas Laju

  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
ParameterNilai

RPM (Requests Per Minute)

600

TPM (Tokens Per Minute)

1.000.000

Rencana Token (Team Edition)
Model playground
  • Pembuatan audio
  • Pembuatan musik
Statistik dan Pemantauan
Asset Center
Dukungan layanan