阿里发布Qwen-Audio-3.0-TTS语音合成大模型

2026年7月20日,阿里巴巴正式发布语音合成大模型Qwen-Audio-3.0-TTS。该模型包含Flash(首包延时约300ms)和Plus(全球权威榜单Artificial Analysis冠军)两个版本。模型支持结构化标签控制情绪与语气,覆盖16种语言、20种方言,音频采样率提升至48KHz,单次合成最长3分钟。配套精品音色库已开放,面向全球开发者提供即用型语音能力。

免责声明:本文内容由开放的智能模型自动生成,仅供参考。

最新文章
Copyright © DoNews 2000-2026 All Rights Reserved
京ICP备2025120072号