Skip to main content
语音识别

gummy-realtime-v1

多语言语音转写及翻译的多模态大模型。本模型提供长时间、高准确率、实时转写中/英/日/韩等10个混合语种的服务。同时支持中英日韩互译,以其他6个语种翻译成中文或英文。

推理服务供应商

gummy-realtime-v1模型的推理服务供应商为阿里云百炼。

模型能力

能力项支持情况能力项支持情况

输入模态

Audio

输出模态

Text

模型体验

支持

Function Calling

不支持

结构化输出

不支持

联网搜索

不支持

前缀续写

不支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

上下文限制

参数参数

最大输入长度

最大输出长度

上下文长度

限流

  • 华北2(北京)
参数

RPM(每分钟请求数)

600

Token Plan
模型体验
  • 音乐生成
用量统计与性能监控
资产中心