Skip to main content
语音识别

qwen-audio-3.1-asr-flash-message

Qwen-Audio-3.1-ASR-Flash-Message 是面向语音消息、输入法和企业业务场景优化的生成式语音识别模型,支持中文、英文及多语言识别,重点优化印尼语、日语、泰语、菲律宾语、越南语、韩语和马来语。模型支持流式上屏、P0/P1 热词、文本归一化、结合前文转写和业务上下文识别,以及可开关的原生润色,并增强了多人声、背景对话、远场及环境噪声下的识别稳定性。支持自动识别或指定目标语种,中文方言可输出方言原文或转换为普通话文本。

推理服务供应商

qwen-audio-3.1-asr-flash-message模型的推理服务供应商为阿里云百炼。

模型能力

能力项支持情况能力项支持情况
输入模态Audio输出模态Text
模型体验不支持Function Calling不支持
结构化输出支持联网搜索不支持
前缀续写不支持上下文缓存不支持
批量推理不支持模型调优不支持

上下文限制

参数参数
最大输入长度7168 Token最大输出长度1024 Token
上下文长度8192 Token

模型价格

本文仅展示模型调用原价,不包含限时优惠等活动信息,请前往百炼控制台查看活动优惠。
  • 华北2(北京)
  • 新加坡
计费项价格(美元)单位
输入0.848每百万Token
输出0.636每百万Token

限流

  • 华北2(北京)
  • 新加坡
参数
RPM(每分钟请求数)1200

调用方式

Token Plan
模型体验
  • 音频生成
  • 音乐生成
用量统计与性能监控
资产中心