Skip to main content
視覺理解

qwen3-vl-flash

Qwen3系列小尺寸視覺理解模型,實現思考模式和非思考模式的有效融合,效果優於開源版Qwen3-VL-30B-A3B,響應速度快。全面升級映像/視頻理解,支援長視頻長文檔等超長上下文、空間感知與萬物識別;具備視覺2D/3D定位能力,勝任複雜現實任務。該模型版本功能等同於快照模型 qwen3-vl-flash-2026-01-22。

推理服務供應商

qwen3-vl-flash模型的推理服務供應商為阿里雲百鍊。

模型能力

  • 華北2(北京)
  • 新加坡
  • 德國(法蘭克福)
  • 美國(維吉尼亞)
能力項支援情況能力項支援情況

輸入模態

Text Image Video

輸出模態

Text

模型體驗

支援

Function Calling

支援

結構化輸出

支援

連網搜尋

不支援

首碼續寫

支援

上下文緩衝

支援

批量推理

不支援

模型調優

不支援

上下文限制

參數參數

最大輸入長度

260096

最大輸出長度

32768

上下文長度

262144

最大輸入長度(思考模式下)

258048

最大輸出長度(思考模式下)

32768

最大思維鏈長度

81920

模型價格

本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
  • 華北2(北京)
  • 新加坡
  • 德國(法蘭克福)
  • 美國(維吉尼亞)

輸入<=32k

計費項目價格(美元)單位

輸入

0.022

每百萬tokens

輸出

0.215

每百萬tokens

輸入(快取命中)

0.005

每百萬tokens

輸入(Batch File)

0.011

每百萬tokens

輸出(Batch File)

0.108

每百萬tokens

顯式緩衝建立

0.028

每百萬tokens

顯式快取命中

0.002

每百萬tokens

輸入(Batch Chat)

0.022

每百萬tokens

輸出(Batch Chat)

0.215

每百萬tokens

計費項目價格(美元)單位

輸入

0.043

每百萬tokens

輸出

0.43

每百萬tokens

輸入(快取命中)

0.009

每百萬tokens

輸入(Batch File)

0.022

每百萬tokens

輸出(Batch File)

0.215

每百萬tokens

顯式緩衝建立

0.054

每百萬tokens

顯式快取命中

0.004

每百萬tokens

輸入(Batch Chat)

0.043

每百萬tokens

輸出(Batch Chat)

0.43

每百萬tokens

計費項目價格(美元)單位

輸入

0.086

每百萬tokens

輸出

0.859

每百萬tokens

輸入(快取命中)

0.018

每百萬tokens

輸入(Batch File)

0.043

每百萬tokens

輸出(Batch File)

0.43

每百萬tokens

顯式緩衝建立

0.108

每百萬tokens

顯式快取命中

0.009

每百萬tokens

輸入(Batch Chat)

0.086

每百萬tokens

輸出(Batch Chat)

0.859

每百萬tokens

限流

  • 華北2(北京)
  • 新加坡
  • 德國(法蘭克福)
  • 美國(維吉尼亞)
參數

RPM(每分鐘請求數)

3000

TPM(每分鐘tokens)

5,000,000

快照版本

qwen3-vl-flash-2026-01-22

Qwen3系列小尺寸視覺理解模型,實現思考模式和非思考模式的有效融合,相較於2025年10月15日快照,模型整體效果有大幅提升:在通用視覺識別與推理方面有增強;在安防、巡店、巡檢、拍照解題等業務情境識別效果上提升顯著。此版本為2026年1月22日快照版本。

推理服務供應商

qwen3-vl-flash-2026-01-22模型的推理服務供應商為阿里雲百鍊。

模型能力

能力項支援情況能力項支援情況

輸入模態

Text Image Video

輸出模態

Text

模型體驗

支援

Function Calling

不支援

結構化輸出

不支援

連網搜尋

不支援

首碼續寫

不支援

上下文緩衝

不支援

批量推理

不支援

模型調優

不支援

上下文限制

參數參數

最大輸入長度

258048

最大輸出長度

32768

上下文長度

262144

最大輸入長度(思考模式下)

258048

最大輸出長度(思考模式下)

32768

最大思維鏈長度

81920

模型價格

本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
  • 華北2(北京)
  • 新加坡
  • 德國(法蘭克福)

輸入<=32k

計費項目價格(美元)單位

輸入

0.022

每百萬tokens

輸出

0.215

每百萬tokens

計費項目價格(美元)單位

輸入

0.043

每百萬tokens

輸出

0.43

每百萬tokens

計費項目價格(美元)單位

輸入

0.086

每百萬tokens

輸出

0.859

每百萬tokens

限流

  • 華北2(北京)
  • 新加坡
  • 德國(法蘭克福)
參數

RPM(每分鐘請求數)

60

TPM(每分鐘tokens)

100,000

qwen3-vl-flash-2025-10-15

Qwen3系列小尺寸視覺理解模型,實現思考模式和非思考模式的有效融合,效果優於開源版Qwen3-VL-30B-A3B,響應速度快。全面升級映像/視頻理解,支援長視頻長文檔等超長上下文、空間感知與萬物識別;具備視覺2D/3D定位能力,勝任複雜現實任務。此版本為2025年10月15日快照版本。

推理服務供應商

qwen3-vl-flash-2025-10-15模型的推理服務供應商為阿里雲百鍊。

模型能力

  • 華北2(北京)
  • 新加坡
  • 德國(法蘭克福)
  • 美國(維吉尼亞)
能力項支援情況能力項支援情況

輸入模態

Text Image Video

輸出模態

Text

模型體驗

支援

Function Calling

支援

結構化輸出

支援

連網搜尋

不支援

首碼續寫

支援

上下文緩衝

不支援

批量推理

不支援

模型調優

不支援

上下文限制

參數參數

最大輸入長度

260096

最大輸出長度

32768

上下文長度

262144

最大輸入長度(思考模式下)

258048

最大輸出長度(思考模式下)

32768

最大思維鏈長度

81920

模型價格

本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
  • 華北2(北京)
  • 新加坡
  • 德國(法蘭克福)
  • 美國(維吉尼亞)

輸入<=32k

計費項目價格(美元)單位

輸入

0.022

每百萬tokens

輸出

0.215

每百萬tokens

計費項目價格(美元)單位

輸入

0.043

每百萬tokens

輸出

0.43

每百萬tokens

計費項目價格(美元)單位

輸入

0.086

每百萬tokens

輸出

0.859

每百萬tokens

限流

  • 華北2(北京)
  • 新加坡
  • 德國(法蘭克福)
  • 美國(維吉尼亞)
參數

RPM(每分鐘請求數)

60

TPM(每分鐘tokens)

100,000

Token Plan
模型體驗
  • 音樂產生
用量統計與效能監控
資產中心