Skip to main content
Text Generation

qwen3.5-35b-a3b

Qwen3.5 Series 35B-A3B adalah model vision-language native yang dirancang dengan arsitektur hibrida, mengintegrasikan mekanisme perhatian linear dan model sparse mixture-of-experts untuk mencapai efisiensi inferensi yang lebih tinggi. Performa keseluruhannya setara dengan Qwen3.5-27B.

Penyedia Layanan Inferensi

Penyedia layanan inferensi untuk qwen3.5-35b-a3b adalah Alibaba Cloud Model Studio.

Kemampuan Model

  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
KemampuanDukunganKemampuanDukungan

Input Modality

Text Image Video

Output Modality

Text

Model Experience

Didukung

Function Calling

Didukung

Structured Outputs

Didukung

Web Search

Didukung

Prefix Completion

Didukung

Context Caching

Tidak Didukung

Batch Inference

Tidak Didukung

Fine-tuning

Tidak Didukung

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

260096

Max Output Length

65536

Context Window

262144

Max Input Length (Thinking Mode)

258048

Max Output Length (Thinking Mode)

65536

Max Chain-of-Thought Length

81920

Harga

Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)

Input<=128k

Item PenagihanHarga (USD)Unit

Input

0,057

Per 1 juta token

Output

0,459

Per 1 juta token

Item PenagihanHarga (USD)Unit

Input

0,229

Per 1 juta token

Output

1,835

Per 1 juta token

Batas Laju

  • Tiongkok (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
ParameterNilai

RPM (Requests Per Minute)

600

TPM (Tokens Per Minute)

1.000.000

Rencana Token (Team Edition)
Model playground
  • Pembuatan audio
  • Pembuatan musik
Statistik dan Pemantauan
Asset Center
Dukungan layanan