幻兹快讯
阿里发布Qwen-Audio-3.0-TTS语音合成大模型
幻兹快讯
2026年07月20日
阅读 46 次

2026年7月20日,阿里巴巴正式发布语音合成大模型Qwen-Audio-3.0-TTS。该模型包含Flash(首包延时约300ms)和Plus(全球权威榜单Artificial Analysis冠军)两个版本。模型支持结构化标签控制情绪与语气,覆盖16种语言、20种方言,音频采样率提升至48KHz,单次合成最长3分钟。配套精品音色库已开放,面向全球开发者提供即用型语音能力。

Copyright © 幻兹网 All Rights Reserved粤ICP备2026034579号粤公网安备44030002012995号