Skip to main content
文本產生

qwen-flash-us

Qwen3系列Flash模型,實現思考模式和非思考模式的有效融合,可在對話中切換模式。複雜推理類任務效能優秀,指令遵循、文本理解等能力顯著提高。支援1M上下文長度,按照上下文長度進行階梯計費。該模型版本功能等同於快照模型 qwen-flash-2025-07-28-us。

推理服務供應商

qwen-flash-us模型的推理服務供應商為阿里雲百鍊。

模型能力

能力項支援情況能力項支援情況

輸入模態

Text

輸出模態

Text

模型體驗

支援

Function Calling

不支援

結構化輸出

支援

連網搜尋

不支援

首碼續寫

支援

上下文緩衝

支援

批量推理

不支援

模型調優

不支援

上下文限制

參數參數

最大輸入長度

995904

最大輸出長度

32768

上下文長度

1000000

模型價格

本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
  • 美國(維吉尼亞)
部署範圍:美國

輸入<=256k

計費項目價格(美元)單位

輸入

0.05

每百萬tokens

輸出

0.4

每百萬tokens

輸入(快取命中)

0.01

每百萬tokens

計費項目價格(美元)單位

輸入

0.25

每百萬tokens

輸出

2

每百萬tokens

輸入(快取命中)

0.05

每百萬tokens

限流

  • 美國(維吉尼亞)
部署範圍:美國
參數

RPM(每分鐘請求數)

30000

TPM(每分鐘tokens)

10,000,000

快照版本

qwen-flash-2025-07-28-us

Qwen3系列Flash模型,實現思考模式和非思考模式的有效融合,可在對話中切換模式。複雜推理類任務效能優秀,指令遵循、文本理解等能力顯著提高。支援1M上下文長度,按照上下文長度進行階梯計費。本版本為2025年7月28日快照。

推理服務供應商

qwen-flash-2025-07-28-us模型的推理服務供應商為阿里雲百鍊。

模型能力

能力項支援情況能力項支援情況

輸入模態

Text

輸出模態

Text

模型體驗

支援

Function Calling

不支援

結構化輸出

支援

連網搜尋

不支援

首碼續寫

支援

上下文緩衝

不支援

批量推理

不支援

模型調優

不支援

上下文限制

參數參數

最大輸入長度

995904

最大輸出長度

32768

上下文長度

1000000

模型價格

本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
  • 美國(維吉尼亞)
部署範圍:美國

輸入<=256k

計費項目價格(美元)單位

輸入

0.05

每百萬tokens

輸出

0.4

每百萬tokens

計費項目價格(美元)單位

輸入

0.25

每百萬tokens

輸出

2

每百萬tokens

限流

  • 美國(維吉尼亞)
部署範圍:美國
參數

RPM(每分鐘請求數)

30000

TPM(每分鐘tokens)

10,000,000

Token Plan
模型體驗
  • 音樂產生
用量統計與效能監控
資產中心
服務支援