具身之家快讯
阿里千问推出大模型 Qwen-Audio-3.0-TTS
2026-07-21 18:34:15
7 月 20 日,阿里千问发布语音合成大模型 Qwen-Audio-3.0-TTS,包含两大版本:适配实时交互的 Flash 版本,首包延时可达 300ms 级别;主打高品质音频生成的 Plus 版本。
新模型在细粒度标签调控、自由指令遵从、多语种及方言支持、复杂环境声学稳定性上实现全面升级,推动合成语音实现情感化表达。在第三方权威榜单 Artificial Analysis 中,Qwen-Audio-3.0-TTS-Plus 拿下第一名。