Qwen3系列Flash模型,實現思考模式和非思考模式的有效融合,可在對話中切換模式。複雜推理類任務效能優秀,指令遵循、文本理解等能力顯著提高。支援1M上下文長度,按照上下文長度進行階梯計費。該模型版本功能等同於快照模型 qwen-flash-2025-07-28-us。
推理服務供應商
qwen-flash-us模型的推理服務供應商為阿里雲百鍊。
模型能力
| 能力項 | 支援情況 | 能力項 | 支援情況 |
|---|---|---|---|
輸入模態 | Text | 輸出模態 | Text |
模型體驗 | 支援 | Function Calling | 不支援 |
結構化輸出 | 支援 | 連網搜尋 | 不支援 |
首碼續寫 | 支援 | 上下文緩衝 | 支援 |
批量推理 | 不支援 | 模型調優 | 不支援 |
上下文限制
| 參數 | 值 | 參數 | 值 |
|---|---|---|---|
最大輸入長度 | 995904 | 最大輸出長度 | 32768 |
上下文長度 | 1000000 |
模型價格
本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
- 美國(維吉尼亞)
輸入<=256k
輸入<=256k
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入 | 0.05 | 每百萬tokens |
輸出 | 0.4 | 每百萬tokens |
輸入(快取命中) | 0.01 | 每百萬tokens |
256k<輸入<=1m
256k<輸入<=1m
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入 | 0.25 | 每百萬tokens |
輸出 | 2 | 每百萬tokens |
輸入(快取命中) | 0.05 | 每百萬tokens |
限流
- 美國(維吉尼亞)
| 參數 | 值 |
|---|---|
RPM(每分鐘請求數) | 30000 |
TPM(每分鐘tokens) | 10,000,000 |
快照版本
qwen-flash-2025-07-28-us
Qwen3系列Flash模型,實現思考模式和非思考模式的有效融合,可在對話中切換模式。複雜推理類任務效能優秀,指令遵循、文本理解等能力顯著提高。支援1M上下文長度,按照上下文長度進行階梯計費。本版本為2025年7月28日快照。
推理服務供應商
qwen-flash-2025-07-28-us模型的推理服務供應商為阿里雲百鍊。
模型能力
| 能力項 | 支援情況 | 能力項 | 支援情況 |
|---|---|---|---|
輸入模態 | Text | 輸出模態 | Text |
模型體驗 | 支援 | Function Calling | 不支援 |
結構化輸出 | 支援 | 連網搜尋 | 不支援 |
首碼續寫 | 支援 | 上下文緩衝 | 不支援 |
批量推理 | 不支援 | 模型調優 | 不支援 |
上下文限制
| 參數 | 值 | 參數 | 值 |
|---|---|---|---|
最大輸入長度 | 995904 | 最大輸出長度 | 32768 |
上下文長度 | 1000000 |
模型價格
本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
- 美國(維吉尼亞)
輸入<=256k
輸入<=256k
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入 | 0.05 | 每百萬tokens |
輸出 | 0.4 | 每百萬tokens |
256k<輸入<=1m
256k<輸入<=1m
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入 | 0.25 | 每百萬tokens |
輸出 | 2 | 每百萬tokens |
限流
- 美國(維吉尼亞)
| 參數 | 值 |
|---|---|
RPM(每分鐘請求數) | 30000 |
TPM(每分鐘tokens) | 10,000,000 |