阿里巴巴发布语音合成大模型Qwen-Audio-3.0-TTS 文章

36kr 快讯2026-07-20NEWSzh

详细信息

来源站点
36kr 快讯
文章类型
NEWS
语言
zh
发布日期
2026-07-20

摘要

36氪获悉,7月20日,阿里巴巴发布语音合成大模型Qwen-Audio-3.0-TTS,在细粒度标签控制、freestyle指令遵循、多语种与方言覆盖以及复杂声学鲁棒性等方面系统性提升,包含面向实时交互的Flash版本(首包延时300ms级别)和面向高质量生成的Plus版本,让合成语音从“能说话”走向“会表达”。目前,在全球第三方榜单Artificial Analysis,Qwen-Audio-3.0-TTS-Plus登顶,其预览版Fun-Realtime-TTS也曾在一个月前登顶该榜单。

相关事件

暂无数据

相关公司查看全部 (3)

相关人物

暂无数据

相关技术

暂无数据