通義實驗室新一代端到端語音辨識大模型的即時版,基於領先的自研語音技術,具備卓越的上下文感知和高精度語音轉寫能力。基於端到端架構,Fun-ASR 整合了創新的 RAG 技術,支援大規模熱詞自訂、敏感/語氣詞自動過濾、ITN 正常化、標點預測等多維功能,顯著提升了整體識別準確率和語境貼合度。同時,Fun-ASR 支援中英文自由切換,多地區方言覆蓋,具備更強的雜訊魯棒性,適應多樣複雜環境。
推理服務供應商
fun-asr-realtime模型的推理服務供應商為阿里雲百鍊。
模型能力
| 能力項 | 支援情況 | 能力項 | 支援情況 |
|---|---|---|---|
輸入模態 | Audio | 輸出模態 | Text |
模型體驗 | 不支援 | Function Calling | 不支援 |
結構化輸出 | 不支援 | 連網搜尋 | 不支援 |
首碼續寫 | 不支援 | 上下文緩衝 | 不支援 |
批量推理 | 不支援 | 模型調優 | 不支援 |
上下文限制
| 參數 | 值 | 參數 | 值 |
|---|---|---|---|
最大輸入長度 | — | 最大輸出長度 | — |
上下文長度 | — |
模型價格
本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
- 華北2(北京)
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
音頻時間長度 | 0.000047 | 每秒 |
限流
- 華北2(北京)
- 新加坡
| 參數 | 值 |
|---|---|
RPM(每分鐘請求數) | 1200 |
快照版本
fun-asr-realtime-2026-02-28
通義百聆推出的新一代輕量級即時語音辨識模型,依託自研的先進語音技術架構,具備強大的上下文理解能力。專為中文電話客服情境設計:覆蓋多地區方言口音,在低採樣率、低信噪比環境下實現低延遲、高準確率的流式轉寫,滿足高效部署需求。此版本為2026年2月28日的快照版本,在近場VAD方面進行了最佳化。
推理服務供應商
fun-asr-realtime-2026-02-28模型的推理服務供應商為阿里雲百鍊。
模型能力
| 能力項 | 支援情況 | 能力項 | 支援情況 |
|---|---|---|---|
輸入模態 | Audio | 輸出模態 | Text |
模型體驗 | 不支援 | Function Calling | 不支援 |
結構化輸出 | 不支援 | 連網搜尋 | 不支援 |
首碼續寫 | 不支援 | 上下文緩衝 | 不支援 |
批量推理 | 不支援 | 模型調優 | 不支援 |
上下文限制
| 參數 | 值 | 參數 | 值 |
|---|---|---|---|
最大輸入長度 | — | 最大輸出長度 | — |
上下文長度 | — |
模型價格
本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
- 華北2(北京)
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
音頻時間長度 | 0.000047 | 每秒 |
限流
- 華北2(北京)
| 參數 | 值 |
|---|---|
RPM(每分鐘請求數) | 1200 |
fun-asr-realtime-2025-11-07
通義實驗室新一代端到端語音辨識大模型的即時版,基於領先的自研語音技術,具備卓越的上下文感知和高精度語音轉寫能力。基於端到端架構,Fun-ASR 整合了創新的 RAG 技術,支援大規模熱詞自訂、敏感/語氣詞自動過濾、ITN 正常化、標點預測等多維功能,顯著提升了整體識別準確率和語境貼合度。同時,Fun-ASR 支援中英文自由切換,多地區方言覆蓋,具備更強的雜訊魯棒性,適應多樣複雜環境。此版本為2025年11月7日的快照版本。
推理服務供應商
fun-asr-realtime-2025-11-07模型的推理服務供應商為阿里雲百鍊。
模型能力
| 能力項 | 支援情況 | 能力項 | 支援情況 |
|---|---|---|---|
輸入模態 | Audio | 輸出模態 | Text |
模型體驗 | 不支援 | Function Calling | 不支援 |
結構化輸出 | 不支援 | 連網搜尋 | 不支援 |
首碼續寫 | 不支援 | 上下文緩衝 | 不支援 |
批量推理 | 不支援 | 模型調優 | 不支援 |
上下文限制
| 參數 | 值 | 參數 | 值 |
|---|---|---|---|
最大輸入長度 | — | 最大輸出長度 | — |
上下文長度 | — |
模型價格
本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
- 華北2(北京)
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
音頻時間長度 | 0.000047 | 每秒 |
限流
- 華北2(北京)
- 新加坡
| 參數 | 值 |
|---|---|
RPM(每分鐘請求數) | 1200 |
fun-asr-realtime-2025-09-15
通義實驗室新一代端到端語音辨識大模型的即時版,基於領先的自研語音技術,具備卓越的上下文感知和高精度語音轉寫能力。基於端到端架構,Fun-ASR 整合了創新的 RAG 技術,支援大規模熱詞自訂、敏感/語氣詞自動過濾、ITN 正常化、標點預測等多維功能,顯著提升了整體識別準確率和語境貼合度。同時,Fun-ASR 支援中英文自由切換,多地區方言覆蓋,具備更強的雜訊魯棒性,適應多樣複雜環境。此版本為2025年9月15日的快照版本。
推理服務供應商
fun-asr-realtime-2025-09-15模型的推理服務供應商為阿里雲百鍊。
模型能力
| 能力項 | 支援情況 | 能力項 | 支援情況 |
|---|---|---|---|
輸入模態 | Audio | 輸出模態 | Text |
模型體驗 | 不支援 | Function Calling | 不支援 |
結構化輸出 | 不支援 | 連網搜尋 | 不支援 |
首碼續寫 | 不支援 | 上下文緩衝 | 不支援 |
批量推理 | 不支援 | 模型調優 | 不支援 |
上下文限制
| 參數 | 值 | 參數 | 值 |
|---|---|---|---|
最大輸入長度 | — | 最大輸出長度 | — |
上下文長度 | — |
模型價格
本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
- 華北2(北京)
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
音頻時間長度 | 0.000047 | 每秒 |
限流
- 華北2(北京)
| 參數 | 值 |
|---|---|
RPM(每分鐘請求數) | 1200 |