Qwen3.7原生視覺語言系列Flash模型,相較3.6-Flash全面提升多模態理解與Agent執行能力。重點強化多模態基礎能力、萬物識別能力更強,真實世界感知與空間智能進一步提升,Search Agent、CI Agent等多模態Agent情境能力顯著升級、端到端任務執行更穩定,多模態Coding能力最佳化、vibe coding 體驗更加流暢。
推理服務供應商
qwen3.7-flash模型的推理服務供應商為阿里雲百鍊。
模型能力
- 華北2(北京)
- 新加坡
- 德國(法蘭克福)
- 美國(維吉尼亞)
- 日本(東京)
- 中國香港
| 能力項 | 支援情況 | 能力項 | 支援情況 |
|---|---|---|---|
輸入模態 | Image Text Video | 輸出模態 | Text |
模型體驗 | 支援 | Function Calling | 支援 |
結構化輸出 | 支援 | 連網搜尋 | 支援 |
首碼續寫 | 支援 | 上下文緩衝 | 支援 |
批量推理 | 支援 | 模型調優 | 不支援 |
上下文限制
| 參數 | 值 | 參數 | 值 |
|---|---|---|---|
最大輸入長度 | 991808 | 最大輸出長度 | 131072 |
上下文長度 | 1000000 | 最大輸入長度(思考模式下) | 983616 |
最大輸出長度(思考模式下) | 131072 | 最大思維鏈長度 | 262144 |
模型價格
本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
- 華北2(北京)
- 新加坡
- 德國(法蘭克福)
- 美國(維吉尼亞)
- 日本(東京)
- 中國香港
輸入<=32k
輸入<=32k
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入 | 0.028 | 每百萬tokens |
輸出 | 0.11 | 每百萬tokens |
輸入(快取命中) | 0.006 | 每百萬tokens |
輸入(Batch File) | 0.014 | 每百萬tokens |
輸出(Batch File) | 0.055 | 每百萬tokens |
顯式緩衝建立 | 0.034 | 每百萬tokens |
顯式快取命中 | 0.003 | 每百萬tokens |
輸入(Batch Chat) | 0.028 | 每百萬tokens |
輸出(Batch Chat) | 0.11 | 每百萬tokens |
32k<輸入<=256k
32k<輸入<=256k
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入 | 0.083 | 每百萬tokens |
輸出 | 0.33 | 每百萬tokens |
輸入(快取命中) | 0.017 | 每百萬tokens |
輸入(Batch File) | 0.041 | 每百萬tokens |
輸出(Batch File) | 0.165 | 每百萬tokens |
顯式緩衝建立 | 0.103 | 每百萬tokens |
顯式快取命中 | 0.008 | 每百萬tokens |
輸入(Batch Chat) | 0.083 | 每百萬tokens |
輸出(Batch Chat) | 0.33 | 每百萬tokens |
256k<輸入<=1m
256k<輸入<=1m
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入 | 0.165 | 每百萬tokens |
輸出 | 0.66 | 每百萬tokens |
輸入(快取命中) | 0.033 | 每百萬tokens |
輸入(Batch File) | 0.083 | 每百萬tokens |
輸出(Batch File) | 0.33 | 每百萬tokens |
顯式緩衝建立 | 0.206 | 每百萬tokens |
顯式快取命中 | 0.017 | 每百萬tokens |
輸入(Batch Chat) | 0.165 | 每百萬tokens |
輸出(Batch Chat) | 0.66 | 每百萬tokens |
限流
- 華北2(北京)
- 新加坡
- 德國(法蘭克福)
- 日本(東京)
- 中國香港
| 參數 | 值 |
|---|---|
RPM(每分鐘請求數) | 30000 |
TPM(每分鐘tokens) | 5,000,000 |
快照版本
qwen3.7-flash-2026-07-15
Qwen3.7原生視覺語言系列Flash模型,相較3.6-Flash全面提升多模態理解與Agent執行能力。重點強化多模態基礎能力、萬物識別能力更強,真實世界感知與空間智能進一步提升,Search Agent、CI Agent等多模態Agent情境能力顯著升級、端到端任務執行更穩定,多模態Coding能力最佳化、vibe coding 體驗更加流暢。該版本為2026年7月15日快照。
推理服務供應商
qwen3.7-flash-2026-07-15模型的推理服務供應商為阿里雲百鍊。
模型能力
- 華北2(北京)
- 新加坡
- 德國(法蘭克福)
- 美國(維吉尼亞)
- 日本(東京)
- 中國香港
| 能力項 | 支援情況 | 能力項 | 支援情況 |
|---|---|---|---|
輸入模態 | Image Text Video | 輸出模態 | Text |
模型體驗 | 支援 | Function Calling | 支援 |
結構化輸出 | 支援 | 連網搜尋 | 支援 |
首碼續寫 | 支援 | 上下文緩衝 | 支援 |
批量推理 | 不支援 | 模型調優 | 不支援 |
上下文限制
| 參數 | 值 | 參數 | 值 |
|---|---|---|---|
最大輸入長度 | 991808 | 最大輸出長度 | 131072 |
上下文長度 | 1000000 | 最大輸入長度(思考模式下) | 983616 |
最大輸出長度(思考模式下) | 131072 | 最大思維鏈長度 | 262144 |
模型價格
本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
- 華北2(北京)
- 新加坡
- 德國(法蘭克福)
- 美國(維吉尼亞)
- 日本(東京)
- 中國香港
輸入<=32k
輸入<=32k
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入 | 0.028 | 每百萬tokens |
輸出 | 0.11 | 每百萬tokens |
輸入(快取命中) | 0.006 | 每百萬tokens |
顯式緩衝建立 | 0.034 | 每百萬tokens |
顯式快取命中 | 0.003 | 每百萬tokens |
32k<輸入<=256k
32k<輸入<=256k
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入 | 0.083 | 每百萬tokens |
輸出 | 0.33 | 每百萬tokens |
輸入(快取命中) | 0.017 | 每百萬tokens |
顯式緩衝建立 | 0.103 | 每百萬tokens |
顯式快取命中 | 0.008 | 每百萬tokens |
256k<輸入<=1m
256k<輸入<=1m
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入 | 0.165 | 每百萬tokens |
輸出 | 0.66 | 每百萬tokens |
輸入(快取命中) | 0.033 | 每百萬tokens |
顯式緩衝建立 | 0.206 | 每百萬tokens |
顯式快取命中 | 0.017 | 每百萬tokens |
限流
- 華北2(北京)
- 新加坡
- 德國(法蘭克福)
- 日本(東京)
- 中國香港
| 參數 | 值 |
|---|---|
RPM(每分鐘請求數) | 30000 |
TPM(每分鐘tokens) | 5,000,000 |