EN 提交工具
模型

阿里千问发布语音合成大模型 Qwen-Audio-3.0-TTS

发布时间: 信源:IT之家(RSS)

分享XFacebook微博

阿里千问发布语音合成大模型 Qwen-Audio-3.0-TTS,包含首包延时300ms级别的Flash版本和面向高质量生成的Plus版本,后者在Artificial Analysis榜单夺冠。新模型支持文本嵌入【gasp】等标签调控语气,音频输出提升至48KHz,覆盖16种语言及20种方言,现已全面开放。

阅读原文 (在新窗口打开)

资讯动态数据由 AI HOT 聚合提供

相关资讯同类最新动态
· X:Artificial Analysis (@ArtificialAnlys)
· IT之家(RSS)
· X:Rohan Paul (@rohanpaul_ai)
· X:Kim (@kimmonismus)