Gemini 3.1 Flash TTS(文字转语音)预览版

Gemini 3.1 Flash TTS 预览版模型具备强大的低延迟语音生成能力,可生成自然的语音输出,支持可控的提示,并提供富有表现力的音频标记,以便精准控制旁白。

文档

Gemini 3.1 Flash TTS 预览版模型引入了富有表现力的音频标记,可用于控制旁白,并全面提升了自然度、可控性和多语言能力。

如需全面了解功能和特性,请参阅文字转语音指南。

gemini-3.1-flash-tts-preview

属性 说明
模型代码 gemini-3.1-flash-tts-preview
支持的数据类型

输入源

文本

输出

音频

令牌限制[*]

输入 token 限制

8192

输出 token 限制

16384

功能

音频生成

支持

缓存

不受支持

代码执行

不受支持

文件搜索

不支持

函数调用

不受支持

Grounding with Google Maps

不受支持

图片生成

不受支持

Live API

不受支持

搜索接地

不受支持

结构化输出

不受支持

思考

不受支持

网址上下文

不受支持

使用选项

Batch API

支持

Flex 推理

不受支持

优先级推断

不受支持

版本
如需了解详情,请参阅模型版本模式。
  • gemini-3.1-flash-tts-preview
最新更新 2026 年 4 月
模型卡片 模型卡片