千問3-Omni-Flash多模態大模型的即時版,基於Thinker–Talker混合專家(MoE)架構,支援文本、映像、音頻、視頻的高效理解與語音產生能力,可進行119種語言文本互動和20種語言語音互動,產生類人語音實現跨語言精準溝通。模型具備強大指令跟隨與系統提示定製功能,靈活適配對話風格與角色設定,廣泛應用於文本創作、語音助手、多媒體分析等情境,提供自然流暢的多模態互動體驗。該模型版本功能等同於快照模型 qwen3-omni-flash-realtime-2025-12-01。
推理服務供應商
qwen3-omni-flash-realtime模型的推理服務供應商為阿里雲百鍊。
模型能力
| 能力項 | 支援情況 | 能力項 | 支援情況 |
|---|---|---|---|
輸入模態 | Text Image Video Audio | 輸出模態 | Text Audio |
模型體驗 | 不支援 | Function Calling | 不支援 |
結構化輸出 | 不支援 | 連網搜尋 | 不支援 |
首碼續寫 | 不支援 | 上下文緩衝 | 不支援 |
批量推理 | 不支援 | 模型調優 | 不支援 |
上下文限制
| 參數 | 值 | 參數 | 值 |
|---|---|---|---|
最大輸入長度 | 49152 | 最大輸出長度 | 16384 |
上下文長度 | 65536 |
模型價格
本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
- 華北2(北京)
- 新加坡
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入:文本 | 0.315 | 每百萬tokens |
輸入:音頻 | 2.709 | 每百萬tokens |
輸入:圖片/視頻 | 0.559 | 每百萬tokens |
輸出:文本(輸入僅包含文本時) | 1.19 | 每百萬tokens |
輸出:文本(輸入包含圖片/音頻/視頻時) | 2.179 | 每百萬tokens |
輸出:文本+音頻(輸出的文本不計費) | 10.766 | 每百萬tokens |
限流
- 華北2(北京)
- 新加坡
| 參數 | 值 |
|---|---|
RPM(每分鐘請求數) | 60 |
TPM(每分鐘tokens) | 100,000 |
快照版本
qwen3-omni-flash-realtime-2025-12-01
千問3-Omni-Flash多模態大模型的即時版,基於Thinker–Talker混合專家(MoE)架構,支援文本、映像、音頻、視頻的高效理解與語音產生能力,可進行119種語言文本互動和20種語言語音互動,支援49種語音音色,產生類人語音實現跨語言精準溝通。模型具備強大指令跟隨與系統提示定製功能,靈活適配對話風格與角色設定,廣泛應用於文本創作、語音助手、多媒體分析等情境,提供自然流暢的多模態互動體驗。此版本為2025年12月01日的快照版本。
推理服務供應商
qwen3-omni-flash-realtime-2025-12-01模型的推理服務供應商為阿里雲百鍊。
模型能力
| 能力項 | 支援情況 | 能力項 | 支援情況 |
|---|---|---|---|
輸入模態 | Text Image Audio Video | 輸出模態 | Text Audio |
模型體驗 | 不支援 | Function Calling | 不支援 |
結構化輸出 | 不支援 | 連網搜尋 | 不支援 |
首碼續寫 | 不支援 | 上下文緩衝 | 不支援 |
批量推理 | 不支援 | 模型調優 | 不支援 |
上下文限制
| 參數 | 值 | 參數 | 值 |
|---|---|---|---|
最大輸入長度 | 49152 | 最大輸出長度 | 16384 |
上下文長度 | 65536 |
模型價格
本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
- 華北2(北京)
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入:文本 | 0.315 | 每百萬tokens |
輸入:音頻 | 2.709 | 每百萬tokens |
輸入:圖片/視頻 | 0.559 | 每百萬tokens |
輸出:文本(輸入僅包含文本時) | 1.19 | 每百萬tokens |
輸出:文本(輸入包含圖片/音頻/視頻時) | 2.179 | 每百萬tokens |
輸出:文本+音頻(輸出的文本不計費) | 10.766 | 每百萬tokens |
限流
- 華北2(北京)
- 新加坡
| 參數 | 值 |
|---|---|
RPM(每分鐘請求數) | 60 |
TPM(每分鐘tokens) | 100,000 |
qwen3-omni-flash-realtime-2025-09-15
千問3-Omni-Flash多模態大模型的即時版,基於Thinker–Talker混合專家(MoE)架構,支援文本、映像、音頻、視頻的高效理解與語音產生能力,可進行119種語言文本互動和20種語言語音互動,產生類人語音實現跨語言精準溝通。模型具備強大指令跟隨與系統提示定製功能,靈活適配對話風格與角色設定,廣泛應用於文本創作、語音助手、多媒體分析等情境,提供自然流暢的多模態互動體驗。此版本為2025年9月15日的快照版本。
推理服務供應商
qwen3-omni-flash-realtime-2025-09-15模型的推理服務供應商為阿里雲百鍊。
模型能力
- 華北2(北京)
- 新加坡
| 能力項 | 支援情況 | 能力項 | 支援情況 |
|---|---|---|---|
輸入模態 | Text Image Video Audio | 輸出模態 | Text Audio |
模型體驗 | 不支援 | Function Calling | 不支援 |
結構化輸出 | 不支援 | 連網搜尋 | 不支援 |
首碼續寫 | 不支援 | 上下文緩衝 | 不支援 |
批量推理 | 不支援 | 模型調優 | 不支援 |
上下文限制
| 參數 | 值 | 參數 | 值 |
|---|---|---|---|
最大輸入長度 | 49152 | 最大輸出長度 | 16384 |
上下文長度 | 65536 |
模型價格
本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
- 華北2(北京)
- 新加坡
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
輸入:文本 | 0.315 | 每百萬tokens |
輸入:音頻 | 2.709 | 每百萬tokens |
輸入:圖片/視頻 | 0.559 | 每百萬tokens |
輸出:文本(輸入僅包含文本時) | 1.19 | 每百萬tokens |
輸出:文本(輸入包含圖片/音頻/視頻時) | 2.179 | 每百萬tokens |
輸出:文本+音頻(輸出的文本不計費) | 10.766 | 每百萬tokens |
限流
- 華北2(北京)
- 新加坡
| 參數 | 值 |
|---|---|
RPM(每分鐘請求數) | 60 |
TPM(每分鐘tokens) | 100,000 |