Skip to main content
全模態

qwen3-omni-flash-realtime

千問3-Omni-Flash多模態大模型的即時版,基於Thinker–Talker混合專家(MoE)架構,支援文本、映像、音頻、視頻的高效理解與語音產生能力,可進行119種語言文本互動和20種語言語音互動,產生類人語音實現跨語言精準溝通。模型具備強大指令跟隨與系統提示定製功能,靈活適配對話風格與角色設定,廣泛應用於文本創作、語音助手、多媒體分析等情境,提供自然流暢的多模態互動體驗。該模型版本功能等同於快照模型 qwen3-omni-flash-realtime-2025-12-01。

推理服務供應商

qwen3-omni-flash-realtime模型的推理服務供應商為阿里雲百鍊。

模型能力

能力項支援情況能力項支援情況

輸入模態

Text Image Video Audio

輸出模態

Text Audio

模型體驗

不支援

Function Calling

不支援

結構化輸出

不支援

連網搜尋

不支援

首碼續寫

不支援

上下文緩衝

不支援

批量推理

不支援

模型調優

不支援

上下文限制

參數參數

最大輸入長度

49152

最大輸出長度

16384

上下文長度

65536

模型價格

本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
  • 華北2(北京)
  • 新加坡
計費項目價格(美元)單位

輸入:文本

0.315

每百萬tokens

輸入:音頻

2.709

每百萬tokens

輸入:圖片/視頻

0.559

每百萬tokens

輸出:文本(輸入僅包含文本時)

1.19

每百萬tokens

輸出:文本(輸入包含圖片/音頻/視頻時)

2.179

每百萬tokens

輸出:文本+音頻(輸出的文本不計費)

10.766

每百萬tokens

限流

  • 華北2(北京)
  • 新加坡
參數

RPM(每分鐘請求數)

60

TPM(每分鐘tokens)

100,000

快照版本

qwen3-omni-flash-realtime-2025-12-01

千問3-Omni-Flash多模態大模型的即時版,基於Thinker–Talker混合專家(MoE)架構,支援文本、映像、音頻、視頻的高效理解與語音產生能力,可進行119種語言文本互動和20種語言語音互動,支援49種語音音色,產生類人語音實現跨語言精準溝通。模型具備強大指令跟隨與系統提示定製功能,靈活適配對話風格與角色設定,廣泛應用於文本創作、語音助手、多媒體分析等情境,提供自然流暢的多模態互動體驗。此版本為2025年12月01日的快照版本。

推理服務供應商

qwen3-omni-flash-realtime-2025-12-01模型的推理服務供應商為阿里雲百鍊。

模型能力

能力項支援情況能力項支援情況

輸入模態

Text Image Audio Video

輸出模態

Text Audio

模型體驗

不支援

Function Calling

不支援

結構化輸出

不支援

連網搜尋

不支援

首碼續寫

不支援

上下文緩衝

不支援

批量推理

不支援

模型調優

不支援

上下文限制

參數參數

最大輸入長度

49152

最大輸出長度

16384

上下文長度

65536

模型價格

本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
  • 華北2(北京)
計費項目價格(美元)單位

輸入:文本

0.315

每百萬tokens

輸入:音頻

2.709

每百萬tokens

輸入:圖片/視頻

0.559

每百萬tokens

輸出:文本(輸入僅包含文本時)

1.19

每百萬tokens

輸出:文本(輸入包含圖片/音頻/視頻時)

2.179

每百萬tokens

輸出:文本+音頻(輸出的文本不計費)

10.766

每百萬tokens

限流

  • 華北2(北京)
  • 新加坡
參數

RPM(每分鐘請求數)

60

TPM(每分鐘tokens)

100,000

qwen3-omni-flash-realtime-2025-09-15

千問3-Omni-Flash多模態大模型的即時版,基於Thinker–Talker混合專家(MoE)架構,支援文本、映像、音頻、視頻的高效理解與語音產生能力,可進行119種語言文本互動和20種語言語音互動,產生類人語音實現跨語言精準溝通。模型具備強大指令跟隨與系統提示定製功能,靈活適配對話風格與角色設定,廣泛應用於文本創作、語音助手、多媒體分析等情境,提供自然流暢的多模態互動體驗。此版本為2025年9月15日的快照版本。

推理服務供應商

qwen3-omni-flash-realtime-2025-09-15模型的推理服務供應商為阿里雲百鍊。

模型能力

  • 華北2(北京)
  • 新加坡
能力項支援情況能力項支援情況

輸入模態

Text Image Video Audio

輸出模態

Text Audio

模型體驗

不支援

Function Calling

不支援

結構化輸出

不支援

連網搜尋

不支援

首碼續寫

不支援

上下文緩衝

不支援

批量推理

不支援

模型調優

不支援

上下文限制

參數參數

最大輸入長度

49152

最大輸出長度

16384

上下文長度

65536

模型價格

本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
  • 華北2(北京)
  • 新加坡
計費項目價格(美元)單位

輸入:文本

0.315

每百萬tokens

輸入:音頻

2.709

每百萬tokens

輸入:圖片/視頻

0.559

每百萬tokens

輸出:文本(輸入僅包含文本時)

1.19

每百萬tokens

輸出:文本(輸入包含圖片/音頻/視頻時)

2.179

每百萬tokens

輸出:文本+音頻(輸出的文本不計費)

10.766

每百萬tokens

限流

  • 華北2(北京)
  • 新加坡
參數

RPM(每分鐘請求數)

60

TPM(每分鐘tokens)

100,000

Token Plan
模型體驗
  • 音樂產生
用量統計與效能監控
資產中心
qwen3-omni-flash-realtime - Alibaba Cloud Model Studio