幻兹快讯
阿里云发布语音合成大模型Qwen-Audio-3.0-TTS
幻兹快讯
2026年07月21日
阅读 12 次

7月21日,阿里云正式发布语音合成大模型Qwen-Audio-3.0-TTS。该模型在细粒度标签控制、freestyle指令遵循、多语种与方言支持及复杂声学鲁棒性方面实现升级,提供面向实时交互的Flash版(首包延时约300ms)和面向高质量生成的Plus版。Qwen-Audio-3.0-TTS-Plus近日登顶全球第三方权威榜单Artificial Analysis,其预览版Fun-Realtime-TTS此前已获该榜冠军。

Copyright © 幻兹网 All Rights Reserved粤ICP备2026034579号粤公网安备44030002012995号