模型
阿里千问发布语音合成大模型 Qwen-Audio-3.0-TTS
阿里千问发布语音合成大模型 Qwen-Audio-3.0-TTS,包含首包延时300ms级别的Flash版本和面向高质量生成的Plus版本,后者在Artificial Analysis榜单夺冠。新模型支持文本嵌入【gasp】等标签调控语气,音频输出提升至48KHz,覆盖16种语言及20种方言,现已全面开放。
资讯动态数据由 AI HOT 聚合提供
阿里千问发布语音合成大模型 Qwen-Audio-3.0-TTS,包含首包延时300ms级别的Flash版本和面向高质量生成的Plus版本,后者在Artificial Analysis榜单夺冠。新模型支持文本嵌入【gasp】等标签调控语气,音频输出提升至48KHz,覆盖16种语言及20种方言,现已全面开放。
资讯动态数据由 AI HOT 聚合提供