Qwen-Plus adalah versi yang ditingkatkan dari model bahasa ultra-besar Qwen yang mendukung berbagai bahasa input, termasuk Tionghoa dan Inggris. Dibandingkan dengan versi sebelumnya, model ini menunjukkan peningkatan signifikan dalam kemampuan menghasilkan kode, penalaran logis, serta kemampuan multibahasa—baik dalam bahasa Tionghoa maupun Inggris. Gaya respons telah disesuaikan secara signifikan agar selaras dengan preferensi manusia, dengan peningkatan nyata dalam tingkat detail dan kejelasan respons. Peningkatan khusus juga dilakukan pada penulisan kreatif, kepatuhan terhadap format JSON, dan kemampuan bermain peran. Versi model ini secara fungsional setara dengan snapshot model qwen-plus-2025-07-28.
Kemampuan Model
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Modalitas Input | Text | Modalitas Output | Text |
Pengalaman Model | Supported | Function Calling | Supported |
Structured Outputs | Supported | Web Search | Supported |
Prefix Completion | Supported | Context Caching | Supported |
Batch Inference | Supported | Fine-tuning | Unsupported |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 997952 | Max Output Length | 32768 |
Context Window | 1000000 | Max Input Length (Thinking Mode) | 995904 |
Max Output Length (Thinking Mode) | 32768 | Max Chain-of-Thought Length | 81920 |
Harga
Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Model Studio Console untuk penawaran promosi.
- Tiongkok (Beijing)
- Jerman (Frankfurt)
- AS (Virginia)
Input<=128k
Input<=128k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,115 | Per 1 juta token |
Output | 0,287 | Per 1 juta token |
Input(Thinking) | 0,115 | Per 1 juta token |
Output(Thinking) | 1,147 | Per 1 juta token |
Input(Implicit Cache) | 0,023 | Per 1 juta token |
Input(Thinking Implicit Cache) | 0,023 | Per 1 juta token |
Thinking Output(Batch File) | 0,573 | Per 1 juta token |
Input(Batch File) | 0,057 | Per 1 juta token |
Output(Batch File) | 0,143 | Per 1 juta token |
Input(Thinking Batch File) | 0,057 | Per 1 juta token |
Explicit Cache Creation | 0,144 | Per 1 juta token |
Explicit Cache Read | 0,012 | Per 1 juta token |
Explicit Cache Creation(Thinking) | 0,144 | Per 1 juta token |
Explicit Cache Read(Thinking) | 0,012 | Per 1 juta token |
Input(Batch Chat) | 0,115 | Per 1 juta token |
Output(Batch Chat) | 0,287 | Per 1 juta token |
Input(Thinking Mode Batch Chat) | 0,115 | Per 1 juta token |
Output(Thinking Mode Batch Chat) | 1,147 | Per 1 juta token |
128k<Input<=256k
128k<Input<=256k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,345 | Per 1 juta token |
Output | 2,868 | Per 1 juta token |
Input(Thinking) | 0,345 | Per 1 juta token |
Output(Thinking) | 3,441 | Per 1 juta token |
Input(Implicit Cache) | 0,069 | Per 1 juta token |
Input(Thinking Implicit Cache) | 0,069 | Per 1 juta token |
Thinking Output(Batch File) | 1,72 | Per 1 juta token |
Input(Batch File) | 0,172 | Per 1 juta token |
Output(Batch File) | 1,434 | Per 1 juta token |
Input(Thinking Batch File) | 0,172 | Per 1 juta token |
Explicit Cache Creation | 0,431 | Per 1 juta token |
Explicit Cache Read | 0,035 | Per 1 juta token |
Explicit Cache Creation(Thinking) | 0,431 | Per 1 juta token |
Explicit Cache Read(Thinking) | 0,035 | Per 1 juta token |
Input(Batch Chat) | 0,345 | Per 1 juta token |
Output(Batch Chat) | 2,868 | Per 1 juta token |
Input(Thinking Mode Batch Chat) | 0,345 | Per 1 juta token |
Output(Thinking Mode Batch Chat) | 3,441 | Per 1 juta token |
256k<Input<=1m
256k<Input<=1m
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,689 | Per 1 juta token |
Output | 6,881 | Per 1 juta token |
Input(Thinking) | 0,689 | Per 1 juta token |
Output(Thinking) | 9,175 | Per 1 juta token |
Input(Implicit Cache) | 0,138 | Per 1 juta token |
Input(Thinking Implicit Cache) | 0,138 | Per 1 juta token |
Thinking Output(Batch File) | 4,587 | Per 1 juta token |
Input(Batch File) | 0,344 | Per 1 juta token |
Output(Batch File) | 3,44 | Per 1 juta token |
Input(Thinking Batch File) | 0,344 | Per 1 juta token |
Explicit Cache Creation | 0,861 | Per 1 juta token |
Explicit Cache Read | 0,069 | Per 1 juta token |
Explicit Cache Creation(Thinking) | 0,861 | Per 1 juta token |
Explicit Cache Read(Thinking) | 0,069 | Per 1 juta token |
Input(Batch Chat) | 0,689 | Per 1 juta token |
Output(Batch Chat) | 6,881 | Per 1 juta token |
Input(Thinking Mode Batch Chat) | 0,689 | Per 1 juta token |
Output(Thinking Mode Batch Chat) | 9,175 | Per 1 juta token |
Batas Laju
- Tiongkok (Beijing)
- Jerman (Frankfurt)
- AS (Virginia)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 30.000 |
TPM (Tokens Per Minute) | 5.000.000 |
Pembaruan Dinamis
qwen-plus-latest
Model seri Qwen yang dioptimalkan untuk keseimbangan performa, menawarkan efisiensi inferensi antara Qwen-Max dan Qwen-Turbo, dirancang untuk menangani tugas-tugas dengan kompleksitas sedang secara efektif. Versi yang diperbarui secara dinamis ini menerapkan perubahan tanpa pemberitahuan sebelumnya.
Kemampuan Model
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Modalitas Input | Text | Modalitas Output | Text |
Pengalaman Model | Supported | Function Calling | Supported |
Structured Outputs | Supported | Web Search | Supported |
Prefix Completion | Supported | Context Caching | Unsupported |
Batch Inference | Supported | Fine-tuning | Unsupported |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 995904 | Max Output Length | 32768 |
Context Window | 1000000 |
Harga
Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Model Studio Console untuk penawaran promosi.
- Tiongkok (Beijing)
Input<=128k
Input<=128k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,115 | Per 1 juta token |
Output | 0,287 | Per 1 juta token |
Input(Thinking) | 0,115 | Per 1 juta token |
Output(Thinking) | 1,147 | Per 1 juta token |
Thinking Output(Batch File) | 0,573 | Per 1 juta token |
Input(Batch File) | 0,057 | Per 1 juta token |
Output(Batch File) | 0,143 | Per 1 juta token |
Input(Thinking Batch File) | 0,057 | Per 1 juta token |
128k<Input<=256k
128k<Input<=256k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,345 | Per 1 juta token |
Output | 2,868 | Per 1 juta token |
Input(Thinking) | 0,345 | Per 1 juta token |
Output(Thinking) | 3,441 | Per 1 juta token |
Thinking Output(Batch File) | 1,72 | Per 1 juta token |
Input(Batch File) | 0,172 | Per 1 juta token |
Output(Batch File) | 1,434 | Per 1 juta token |
Input(Thinking Batch File) | 0,172 | Per 1 juta token |
256k<Input<=1m
256k<Input<=1m
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,689 | Per 1 juta token |
Output | 6,881 | Per 1 juta token |
Input(Thinking) | 0,689 | Per 1 juta token |
Output(Thinking) | 9,175 | Per 1 juta token |
Thinking Output(Batch File) | 4,587 | Per 1 juta token |
Input(Batch File) | 0,344 | Per 1 juta token |
Output(Batch File) | 3,44 | Per 1 juta token |
Input(Thinking Batch File) | 0,344 | Per 1 juta token |
Batas Laju
- Tiongkok (Beijing)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 15.000 |
TPM (Tokens Per Minute) | 1.200.000 |
Versi Snapshot
qwen-plus-2025-12-01
Versi ini merupakan snapshot per 1 Desember 2025 dan menampilkan peningkatan kemampuan penalaran dibandingkan snapshot 28 Juli. Kemampuan agen dan kemampuan pemanggilan alat multi-turn telah ditingkatkan lebih lanjut, serta performa pada tugas kreatif subjektif meningkat secara signifikan. Model ini mendukung panjang konteks hingga 1 juta token, dengan harga bertingkat berdasarkan panjang konteks.
Kemampuan Model
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Modalitas Input | Text | Modalitas Output | Text |
Pengalaman Model | Supported | Function Calling | Supported |
Structured Outputs | Supported | Web Search | Supported |
Prefix Completion | Supported | Context Caching | Unsupported |
Batch Inference | Unsupported | Fine-tuning | Unsupported |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 997952 | Max Output Length | 32768 |
Context Window | 1000000 | Max Input Length (Thinking Mode) | 995904 |
Max Output Length (Thinking Mode) | 32768 |
Harga
Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Model Studio Console untuk penawaran promosi.
- Tiongkok (Beijing)
- Jerman (Frankfurt)
- AS (Virginia)
Input<=128k
Input<=128k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,115 | Per 1 juta token |
Output | 0,287 | Per 1 juta token |
Input(Thinking) | 0,115 | Per 1 juta token |
Output(Thinking) | 1,147 | Per 1 juta token |
128k<Input<=256k
128k<Input<=256k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,345 | Per 1 juta token |
Output | 2,868 | Per 1 juta token |
Input(Thinking) | 0,345 | Per 1 juta token |
Output(Thinking) | 3,441 | Per 1 juta token |
256k<Input<=1m
256k<Input<=1m
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,689 | Per 1 juta token |
Output | 6,881 | Per 1 juta token |
Input(Thinking) | 0,689 | Per 1 juta token |
Output(Thinking) | 9,175 | Per 1 juta token |
Batas Laju
- Tiongkok (Beijing)
- Jerman (Frankfurt)
- AS (Virginia)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 120 |
TPM (Tokens Per Minute) | 1.000.000 |
qwen-plus-2025-09-11
Berdasarkan snapshot 11 September 2025, rilis ini menampilkan peningkatan dalam mengikuti instruksi dan respons ringkas yang disederhanakan dalam mode thinking. Mode non-thinking menyediakan pemahaman teks Tionghoa yang unggul dan kemampuan penalaran logis yang ditingkatkan. Model ini mendukung panjang konteks 1 juta dengan harga bertingkat.
Kemampuan Model
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Modalitas Input | Text | Modalitas Output | Text |
Pengalaman Model | Unsupported | Function Calling | Unsupported |
Structured Outputs | Unsupported | Web Search | Unsupported |
Prefix Completion | Unsupported | Context Caching | Unsupported |
Batch Inference | Unsupported | Fine-tuning | Unsupported |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 995904 | Max Output Length | 32768 |
Context Window | 1000000 |
Harga
Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Model Studio Console untuk penawaran promosi.
- Tiongkok (Beijing)
- Jerman (Frankfurt)
- AS (Virginia)
Input<=128k
Input<=128k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,115 | Per 1 juta token |
Output | 0,287 | Per 1 juta token |
Input(Thinking) | 0,115 | Per 1 juta token |
Output(Thinking) | 1,147 | Per 1 juta token |
128k<Input<=256k
128k<Input<=256k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,345 | Per 1 juta token |
Output | 2,868 | Per 1 juta token |
Input(Thinking) | 0,345 | Per 1 juta token |
Output(Thinking) | 3,441 | Per 1 juta token |
256k<Input<=1m
256k<Input<=1m
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,689 | Per 1 juta token |
Output | 6,881 | Per 1 juta token |
Input(Thinking) | 0,689 | Per 1 juta token |
Output(Thinking) | 9,175 | Per 1 juta token |
Batas Laju
- Tiongkok (Beijing)
- Jerman (Frankfurt)
- AS (Virginia)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 60 |
TPM (Tokens Per Minute) | 1.000.000 |
qwen-plus-2025-07-28
Model Plus seri Qwen3 mengintegrasikan mode thinking dan non-thinking serta dapat beralih mode selama dialog. Dibandingkan dengan versi sebelumnya, model ini menambahkan peningkatan khusus untuk kemampuan Tionghoa & Inggris dan pemanggilan alat. Ini adalah snapshot tanggal 28 Juli 2025; yang pertama mendukung panjang konteks 1 juta dan menggunakan harga bertingkat.
Kemampuan Model
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Modalitas Input | Text | Modalitas Output | Text |
Pengalaman Model | Supported | Function Calling | Supported |
Structured Outputs | Supported | Web Search | Supported |
Prefix Completion | Supported | Context Caching | Unsupported |
Batch Inference | Unsupported | Fine-tuning | Unsupported |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 995904 | Max Output Length | 32768 |
Context Window | 1000000 |
Harga
Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Model Studio Console untuk penawaran promosi.
- Tiongkok (Beijing)
- Jerman (Frankfurt)
- AS (Virginia)
Input<=128k
Input<=128k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,115 | Per 1 juta token |
Output | 0,287 | Per 1 juta token |
Input(Thinking) | 0,115 | Per 1 juta token |
Output(Thinking) | 1,147 | Per 1 juta token |
128k<Input<=256k
128k<Input<=256k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,345 | Per 1 juta token |
Output | 2,868 | Per 1 juta token |
Input(Thinking) | 0,345 | Per 1 juta token |
Output(Thinking) | 3,441 | Per 1 juta token |
256k<Input<=1m
256k<Input<=1m
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,689 | Per 1 juta token |
Output | 6,881 | Per 1 juta token |
Input(Thinking) | 0,689 | Per 1 juta token |
Output(Thinking) | 9,175 | Per 1 juta token |
Batas Laju
- Tiongkok (Beijing)
- Jerman (Frankfurt)
- AS (Virginia)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 60 |
TPM (Tokens Per Minute) | 1.000.000 |
qwen-plus-2025-07-14
Model Plus dari Seri Qwen3 secara efektif mengintegrasikan mode thinking dan non-thinking, memungkinkan peralihan mode selama percakapan. Ini adalah snapshot tanggal 14 Juli 2025. Dibandingkan dengan versi sebelumnya, terdapat peningkatan signifikan dalam kemampuan Tionghoa dan Inggris di bawah mode non-thinking, dengan kemampuan pemanggilan alat yang ditingkatkan.
Kemampuan Model
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Modalitas Input | Text | Modalitas Output | Text |
Pengalaman Model | Supported | Function Calling | Supported |
Structured Outputs | Supported | Web Search | Supported |
Prefix Completion | Supported | Context Caching | Unsupported |
Batch Inference | Unsupported | Fine-tuning | Unsupported |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 98304 | Max Output Length | 16384 |
Context Window | 131072 |
Harga
Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Model Studio Console untuk penawaran promosi.
- Tiongkok (Beijing)
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,115 | Per 1 juta token |
Output | 0,287 | Per 1 juta token |
Input(Thinking) | 0,115 | Per 1 juta token |
Output(Thinking) | 1,147 | Per 1 juta token |
Batas Laju
- Tiongkok (Beijing)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 60 |
TPM (Tokens Per Minute) | 100.000 |
qwen-plus-2025-04-28
Model Plus seri Qwen3 secara efektif mengintegrasikan mode thinking dan non-thinking, memungkinkan peralihan mode selama percakapan. Kemampuan penalarannya secara signifikan melampaui QwQ, dan kemampuan umumnya secara nyata melebihi Qwen2.5-Plus, mencapai tingkat SOTA dalam skala yang sama di industri. Model ini merupakan snapshot tanggal 28 April 2025.
Kemampuan Model
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Modalitas Input | Text | Modalitas Output | Text |
Pengalaman Model | Supported | Function Calling | Supported |
Structured Outputs | Supported | Web Search | Unsupported |
Prefix Completion | Supported | Context Caching | Unsupported |
Batch Inference | Unsupported | Fine-tuning | Unsupported |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 98304 | Max Output Length | 16384 |
Context Window | 131072 |
Harga
Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Model Studio Console untuk penawaran promosi.
- Tiongkok (Beijing)
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,115 | Per 1 juta token |
Output | 0,287 | Per 1 juta token |
Input(Thinking) | 0,115 | Per 1 juta token |
Output(Thinking) | 1,147 | Per 1 juta token |
Batas Laju
- Tiongkok (Beijing)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 60 |
TPM (Tokens Per Minute) | 1.000.000 |
qwen-plus-2025-01-25
Model seri Qwen yang seimbang dalam kemampuan, menawarkan performa dan kecepatan penalaran yang berada di antara Qwen-Max dan Qwen-Turbo, sehingga cocok untuk tugas-tugas dengan kompleksitas sedang. Dibandingkan dengan versi sebelumnya, model ini menunjukkan peningkatan signifikan dalam kemampuan menghasilkan kode, penalaran logis, serta kemampuan multibahasa—baik dalam bahasa Tionghoa maupun Inggris. Gaya respons telah disesuaikan secara signifikan agar selaras dengan preferensi manusia, dengan peningkatan nyata dalam tingkat detail dan kejelasan respons. Peningkatan khusus juga dilakukan pada penulisan kreatif, kepatuhan terhadap format JSON, dan kemampuan bermain peran.
Kemampuan Model
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Modalitas Input | Text | Modalitas Output | Text |
Pengalaman Model | Supported | Function Calling | Supported |
Structured Outputs | Supported | Web Search | Unsupported |
Prefix Completion | Supported | Context Caching | Unsupported |
Batch Inference | Unsupported | Fine-tuning | Unsupported |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 129024 | Max Output Length | 8192 |
Context Window | 131072 |
Harga
Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Model Studio Console untuk penawaran promosi.
- Tiongkok (Beijing)
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,115 | Per 1 juta token |
Output | 0,287 | Per 1 juta token |
Batas Laju
- Tiongkok (Beijing)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 60 |
TPM (Tokens Per Minute) | 150.000 |
qwen-plus-0112
Model seri Qwen yang seimbang dalam kemampuan, menawarkan performa dan kecepatan penalaran yang berada di antara Qwen-Max dan Qwen-Turbo, sehingga cocok untuk tugas-tugas dengan kompleksitas sedang. Dibandingkan dengan versi qwen-plus-2024-1220, model ini menunjukkan peningkatan dalam kemampuan keseluruhan bahasa Tionghoa dan Inggris, terutama dalam pengetahuan umum dan pemahaman membaca. Fenomena code-switch juga mengalami perbaikan signifikan dibandingkan versi sebelumnya, serta kemampuan mengikuti instruksi dalam bahasa Tionghoa meningkat secara nyata.
Kemampuan Model
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Modalitas Input | Text | Modalitas Output | Text |
Pengalaman Model | Supported | Function Calling | Unsupported |
Structured Outputs | Unsupported | Web Search | Unsupported |
Prefix Completion | Unsupported | Context Caching | Unsupported |
Batch Inference | Unsupported | Fine-tuning | Unsupported |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 129024 | Max Output Length | 8192 |
Context Window | 131072 |
Harga
Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Model Studio Console untuk penawaran promosi.
- Tiongkok (Beijing)
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,115 | Per 1 juta token |
Output | 0,287 | Per 1 juta token |
Batas Laju
- Tiongkok (Beijing)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 60 |
TPM (Tokens Per Minute) | 150.000 |
qwen-plus-1220
Model seri Qwen yang seimbang dalam kemampuan, menawarkan performa dan kecepatan penalaran yang berada di antara Qwen-Max dan Qwen-Turbo, sehingga cocok untuk tugas-tugas dengan kompleksitas sedang. Dibandingkan dengan versi qwen-plus-1125, model ini menunjukkan peningkatan dalam kemampuan keseluruhan bahasa Tionghoa dan Inggris, terutama dalam pengetahuan umum dan pemahaman membaca. Fenomena code-switch juga mengalami perbaikan signifikan dibandingkan versi sebelumnya, serta kemampuan mengikuti instruksi dalam bahasa Tionghoa meningkat secara nyata.
Kemampuan Model
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Modalitas Input | Text | Modalitas Output | Text |
Pengalaman Model | Supported | Function Calling | Unsupported |
Structured Outputs | Unsupported | Web Search | Unsupported |
Prefix Completion | Unsupported | Context Caching | Unsupported |
Batch Inference | Unsupported | Fine-tuning | Unsupported |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 129024 | Max Output Length | 8192 |
Context Window | 131072 |
Harga
Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Model Studio Console untuk penawaran promosi.
- Tiongkok (Beijing)
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,115 | Per 1 juta token |
Output | 0,287 | Per 1 juta token |
Batas Laju
- Tiongkok (Beijing)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 60 |
TPM (Tokens Per Minute) | 150.000 |