EN 提交工具
模型

通义实验室发布 Qwen-Audio-3.0-TTS 实时语音合成模型

发布时间: 信源:公众号:通义实验室(千问)

分享XFacebook微博

通义实验室发布 Qwen-Audio-3.0-TTS,含 Flash(首包延迟约300ms)和 Plus 两个版本。Plus 版本在 Artificial Analysis 榜单夺冠,支持16种语言和20种中文方言,平均 WER/CER 低至3.87(Flash),说话人相似度最高达82.75(Plus)。

阅读原文 (在新窗口打开)

资讯动态数据由 AI HOT 聚合提供

相关资讯同类最新动态
· X:Rohan Paul (@rohanpaul_ai)
· X:Kim (@kimmonismus)
· X:Rohan Paul (@rohanpaul_ai)