Skip to main content
Text Generation

qwen-turbo

Model Turbo dari seri Qwen3 yang secara efektif mengintegrasikan mode berpikir dan non-berpikir, memungkinkan peralihan mode selama percakapan. Kemampuan reasoning-nya setara dengan QwQ-32B meskipun memiliki ukuran parameter yang lebih kecil, sedangkan kemampuan umumnya jauh melampaui Qwen2.5-Turbo dan mencapai tingkat SOTA dalam skala yang sama di industri. Versi model ini secara fungsional setara dengan model snapshot qwen-turbo-2025-04-28.

Inference Service Provider

Penyedia layanan inferensi untuk qwen-turbo adalah Alibaba Cloud Model Studio.

Model Capabilities

  • China (Beijing)
  • Singapore
CapabilitySupportCapabilitySupport

Input Modality

Text

Output Modality

Text

Model Experience

Supported

Function Calling

Unsupported

Structured Outputs

Supported

Web Search

Unsupported

Prefix Completion

Unsupported

Context Caching

Supported

Batch Inference

Unsupported

Fine-tuning

Unsupported

Context Limits

ParameterValueParameterValue

Max Input Length

98304

Max Output Length

16384

Context Window

131072

Pricing

Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi terbatas waktu apa pun. Kunjungi Model Studio Console untuk penawaran promosi.
  • China (Beijing)
  • Singapore
Billing ItemPrice (USD)Unit

Input

0,044

Per 1M tokens

Output

0,087

Per 1M tokens

Input(Thinking)

0,044

Per 1M tokens

Output(Thinking)

0,431

Per 1M tokens

Input(Implicit Cache)

0,009

Per 1M tokens

Input(Thinking Implicit Cache)

0,009

Per 1M tokens

Rate Limits

  • China (Beijing)
  • Singapore
ParameterValue

RPM (Requests Per Minute)

1200

TPM (Tokens Per Minute)

5.000.000

Rencana Token (Team Edition)
Model playground
  • Pembuatan audio
  • Pembuatan musik
Statistik dan Pemantauan
Asset Center
Dukungan layanan