7月21日消息,阿里云日前发布语音合成大模型Qwen-Audio-3.0-TTS。在细粒度标签控制、freestyle指令遵循、多语种与方言覆盖及复杂声学鲁棒性方面升级,包含面向实时交互的Flash版本(首包延时300ms级别)和面向高质量生成的Plus版本。目前,在全球第三方权威榜单Artificial Analysis,Qwen-Audio-3.0-TTS-Plus斩获冠军,其预览版Fun-Realtime-TTS也曾在一个月前登顶该榜单。
阿里云发布语音合成大模型Qwen-Audio-3.0-TTS
2026-07-21 10:09:16
24小时热榜
