Qwen3系列小尺寸視覺理解模型,實現思考模式和非思考模式的有效融合,效果優於開源版Qwen3-VL-30B-A3B,響應速度快。全面升級映像/視頻理解,支援長視頻長文檔等超長上下文、空間感知與萬物識別;具備視覺2D/3D定位能力,勝任複雜現實任務。該模型版本功能等同於快照模型 qwen3-vl-flash-2026-01-22。
推理服務供應商
qwen3-vl-flash模型的推理服務供應商為阿里雲百鍊。
模型能力
- 華北2(北京)
- 新加坡
- 德國(法蘭克福)
- 美國(維吉尼亞)
| 能力項 | 支援情況 | 能力項 | 支援情況 |
|---|---|---|---|
輸入模態 | Text Image Video | 輸出模態 | Text |
模型體驗 | 支援 | Function Calling | 支援 |
結構化輸出 | 支援 | 連網搜尋 | 不支援 |
首碼續寫 | 支援 | 上下文緩衝 | 支援 |
批量推理 | 不支援 | 模型調優 | 不支援 |
上下文限制
| 參數 | 值 | 參數 | 值 |
|---|---|---|---|
最大輸入長度 | 260096 | 最大輸出長度 | 32768 |
上下文長度 | 262144 | 最大輸入長度(思考模式下) | 258048 |
最大輸出長度(思考模式下) | 32768 | 最大思維鏈長度 | 81920 |
模型價格
本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
- 華北2(北京)
- 新加坡
- 德國(法蘭克福)
- 美國(維吉尼亞)
輸入<=32k
輸入<=32k
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入 | 0.022 | 每百萬tokens |
輸出 | 0.215 | 每百萬tokens |
輸入(快取命中) | 0.005 | 每百萬tokens |
輸入(Batch File) | 0.011 | 每百萬tokens |
輸出(Batch File) | 0.108 | 每百萬tokens |
顯式緩衝建立 | 0.028 | 每百萬tokens |
顯式快取命中 | 0.002 | 每百萬tokens |
輸入(Batch Chat) | 0.022 | 每百萬tokens |
輸出(Batch Chat) | 0.215 | 每百萬tokens |
32k<輸入<=128k
32k<輸入<=128k
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入 | 0.043 | 每百萬tokens |
輸出 | 0.43 | 每百萬tokens |
輸入(快取命中) | 0.009 | 每百萬tokens |
輸入(Batch File) | 0.022 | 每百萬tokens |
輸出(Batch File) | 0.215 | 每百萬tokens |
顯式緩衝建立 | 0.054 | 每百萬tokens |
顯式快取命中 | 0.004 | 每百萬tokens |
輸入(Batch Chat) | 0.043 | 每百萬tokens |
輸出(Batch Chat) | 0.43 | 每百萬tokens |
128k<輸入<=256k
128k<輸入<=256k
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入 | 0.086 | 每百萬tokens |
輸出 | 0.859 | 每百萬tokens |
輸入(快取命中) | 0.018 | 每百萬tokens |
輸入(Batch File) | 0.043 | 每百萬tokens |
輸出(Batch File) | 0.43 | 每百萬tokens |
顯式緩衝建立 | 0.108 | 每百萬tokens |
顯式快取命中 | 0.009 | 每百萬tokens |
輸入(Batch Chat) | 0.086 | 每百萬tokens |
輸出(Batch Chat) | 0.859 | 每百萬tokens |
限流
- 華北2(北京)
- 新加坡
- 德國(法蘭克福)
- 美國(維吉尼亞)
| 參數 | 值 |
|---|---|
RPM(每分鐘請求數) | 3000 |
TPM(每分鐘tokens) | 5,000,000 |
快照版本
qwen3-vl-flash-2026-01-22
Qwen3系列小尺寸視覺理解模型,實現思考模式和非思考模式的有效融合,相較於2025年10月15日快照,模型整體效果有大幅提升:在通用視覺識別與推理方面有增強;在安防、巡店、巡檢、拍照解題等業務情境識別效果上提升顯著。此版本為2026年1月22日快照版本。
推理服務供應商
qwen3-vl-flash-2026-01-22模型的推理服務供應商為阿里雲百鍊。
模型能力
| 能力項 | 支援情況 | 能力項 | 支援情況 |
|---|---|---|---|
輸入模態 | Text Image Video | 輸出模態 | Text |
模型體驗 | 支援 | Function Calling | 不支援 |
結構化輸出 | 不支援 | 連網搜尋 | 不支援 |
首碼續寫 | 不支援 | 上下文緩衝 | 不支援 |
批量推理 | 不支援 | 模型調優 | 不支援 |
上下文限制
| 參數 | 值 | 參數 | 值 |
|---|---|---|---|
最大輸入長度 | 258048 | 最大輸出長度 | 32768 |
上下文長度 | 262144 | 最大輸入長度(思考模式下) | 258048 |
最大輸出長度(思考模式下) | 32768 | 最大思維鏈長度 | 81920 |
模型價格
本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
- 華北2(北京)
- 新加坡
- 德國(法蘭克福)
輸入<=32k
輸入<=32k
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入 | 0.022 | 每百萬tokens |
輸出 | 0.215 | 每百萬tokens |
32k<輸入<=128k
32k<輸入<=128k
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入 | 0.043 | 每百萬tokens |
輸出 | 0.43 | 每百萬tokens |
128k<輸入<=256k
128k<輸入<=256k
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入 | 0.086 | 每百萬tokens |
輸出 | 0.859 | 每百萬tokens |
限流
- 華北2(北京)
- 新加坡
- 德國(法蘭克福)
| 參數 | 值 |
|---|---|
RPM(每分鐘請求數) | 60 |
TPM(每分鐘tokens) | 100,000 |
qwen3-vl-flash-2025-10-15
Qwen3系列小尺寸視覺理解模型,實現思考模式和非思考模式的有效融合,效果優於開源版Qwen3-VL-30B-A3B,響應速度快。全面升級映像/視頻理解,支援長視頻長文檔等超長上下文、空間感知與萬物識別;具備視覺2D/3D定位能力,勝任複雜現實任務。此版本為2025年10月15日快照版本。
推理服務供應商
qwen3-vl-flash-2025-10-15模型的推理服務供應商為阿里雲百鍊。
模型能力
- 華北2(北京)
- 新加坡
- 德國(法蘭克福)
- 美國(維吉尼亞)
| 能力項 | 支援情況 | 能力項 | 支援情況 |
|---|---|---|---|
輸入模態 | Text Image Video | 輸出模態 | Text |
模型體驗 | 支援 | Function Calling | 支援 |
結構化輸出 | 支援 | 連網搜尋 | 不支援 |
首碼續寫 | 支援 | 上下文緩衝 | 不支援 |
批量推理 | 不支援 | 模型調優 | 不支援 |
上下文限制
| 參數 | 值 | 參數 | 值 |
|---|---|---|---|
最大輸入長度 | 260096 | 最大輸出長度 | 32768 |
上下文長度 | 262144 | 最大輸入長度(思考模式下) | 258048 |
最大輸出長度(思考模式下) | 32768 | 最大思維鏈長度 | 81920 |
模型價格
本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
- 華北2(北京)
- 新加坡
- 德國(法蘭克福)
- 美國(維吉尼亞)
輸入<=32k
輸入<=32k
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入 | 0.022 | 每百萬tokens |
輸出 | 0.215 | 每百萬tokens |
32k<輸入<=128k
32k<輸入<=128k
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入 | 0.043 | 每百萬tokens |
輸出 | 0.43 | 每百萬tokens |
128k<輸入<=256k
128k<輸入<=256k
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入 | 0.086 | 每百萬tokens |
輸出 | 0.859 | 每百萬tokens |
限流
- 華北2(北京)
- 新加坡
- 德國(法蘭克福)
- 美國(維吉尼亞)
| 參數 | 值 |
|---|---|
RPM(每分鐘請求數) | 60 |
TPM(每分鐘tokens) | 100,000 |