Qwen3-ASR-Flash是一款基於大語言模型的高精度、高智能、高魯棒性的多語種語音辨識模型。依託強大的基座模型、海量的文本與多模態資料、千萬小時音頻資料,通義千問3-ASR-Flash實現了高精度的語音辨識功能,能夠自動判斷語種並準確識別 11 個語種的語音,在複雜的音頻環境下能夠保證精確轉錄。該模型版本功能等同於快照模型 qwen3-asr-flash-2025-09-08-us。
推理服務供應商
qwen3-asr-flash-us模型的推理服務供應商為阿里雲百鍊。
模型能力
| 能力項 | 支援情況 | 能力項 | 支援情況 |
|---|---|---|---|
輸入模態 | Audio | 輸出模態 | Text |
模型體驗 | 不支援 | Function Calling | 不支援 |
結構化輸出 | 不支援 | 連網搜尋 | 不支援 |
首碼續寫 | 不支援 | 上下文緩衝 | 不支援 |
批量推理 | 不支援 | 模型調優 | 不支援 |
上下文限制
| 參數 | 值 | 參數 | 值 |
|---|---|---|---|
最大輸入長度 | — | 最大輸出長度 | — |
上下文長度 | — |
模型價格
本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
- 美國(維吉尼亞)
部署範圍:美國
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
音頻時間長度 | 0.000035 | 每秒 |
限流
- 美國(維吉尼亞)
部署範圍:美國
| 參數 | 值 |
|---|---|
RPM(每分鐘請求數) | 100 |
快照版本
qwen3-asr-flash-2025-09-08-us
Qwen3-ASR-Flash是一款基於大語言模型的高精度、高智能、高魯棒性的多語種語音辨識模型。依託強大的基座模型、海量的文本與多模態資料、千萬小時音頻資料,Qwen3-ASR-Flash實現了高精度的語音辨識功能,能夠自動判斷語種並準確識別 11 個語種的語音,在複雜的音頻環境下能夠保證精確轉錄。此版本為2025年9月8日的快照版本。
推理服務供應商
qwen3-asr-flash-2025-09-08-us模型的推理服務供應商為阿里雲百鍊。
模型能力
| 能力項 | 支援情況 | 能力項 | 支援情況 |
|---|---|---|---|
輸入模態 | Audio | 輸出模態 | Text |
模型體驗 | 不支援 | Function Calling | 不支援 |
結構化輸出 | 不支援 | 連網搜尋 | 不支援 |
首碼續寫 | 不支援 | 上下文緩衝 | 不支援 |
批量推理 | 不支援 | 模型調優 | 不支援 |
上下文限制
| 參數 | 值 | 參數 | 值 |
|---|---|---|---|
最大輸入長度 | — | 最大輸出長度 | — |
上下文長度 | — |
模型價格
本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
- 美國(維吉尼亞)
部署範圍:美國
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
音頻時間長度 | 0.000035 | 每秒 |
限流
- 美國(維吉尼亞)
部署範圍:美國
| 參數 | 值 |
|---|---|
RPM(每分鐘請求數) | 100 |