-
从"能说话"到"会表达":阿里发布 Qwen-Audio-3.0-TTS 语音合成大模型
2026年7月20日,阿里通义千问团队正式发布新一代实时语音合成大模型 Qwen-Audio-3.0-TTS,官方以"从能说话到会表达"概括本次升级的核心方向。新模型围绕开发者在生产环境中真正会遇到的问题展开优化,在更广的语言覆盖、更自然的指令控制、更精细的标签控制以及参考音频不清晰时的鲁棒性四个维度实现系统性提升。据官方披露,在全球第三方权威榜单 Artificial Ana…- 285
- 0
-
Qwen-Audio-3.0-TTS:阿里推出的新一代实时语音合成大模型
Qwen-Audio-3.0-TTS 是阿里通义千问新一代实时语音合成大模型,支持自然语言指令与标签控情绪、16 种语言 20 种方言、48kHz 影视级音质与复杂环境语音克隆,Plus 版登顶 Artificial Analysis 榜单。- 270
- 0
-
Speech 02:MiniMax 推出的新一代语音TTS模型,支持高质量多语种语音合成
MiniMax-Speech-02 支持多语言、高拟真语音生成,广泛应用于配音制作、虚拟人、教育、语音定制与无障碍沟通等场景,助力个性化语音内容高效生成与全球化传播。- 7.8k
- 0
-
ElevenLabs-在线文字转语音+语音翻译平台
ElevenLabs 是一款最真实的文本转语音和语音克隆软件,为寻求最终故事讲述工具的创作者和出版商带来最引人入胜、丰富和逼真的声音。- 47.6k
- 0





