EN 提交工具

Gemini 3.1 Flash TTS Preview

日耗榜 #293 google

google/gemini-3.1-flash-tts-preview

用量数据日期 2026-07-27 · 每日更新

用量与规格

日耗榜排名#293
日 Tokens222.9M
日请求500.1K
日变化 +22.4%
上下文窗口32.8K

Gemini 3.1 Flash TTS Preview 是什么

模型:Gemini 3.1 Flash TTS Preview 介绍:Gemini 3.1 Flash TTS Preview 是谷歌推出的文本转语音模型,相比 Gemini 2.5 Flash TTS 实现了显著的代际升级。该模型支持将文本输入转化为音频输出,覆盖 70 多种语言——语言支持范围是前代产品的近 3 倍。 核心新增功能是一套包含 200 多种内联音频标签(例如 `[whispers]`、`[laughs]`、`[excited]`)的系统,让开发者能够在句子中间控制表达方式、情感和节奏;同时,Google AI Studio 中新增了“导演椅”工作流,用于定义每个角色的音频配置文件和场景级上下文。该模型支持最多两个说话人,每个说话人可独立配置声音和风格,输出 24 kHz / 16-bit 单声道 PCM 音频,并使用 SynthID 自动为所有输出添加水印。上下文窗口为 32k tokens。

用这个模型的工具