对于大多数低延迟语音代理体验和实时对话,Gemini 3.8 Live 是默认选项,不会因推理而产生延迟。它支持交错推理、异步函数调用、完整会话客户端内容更新和内置音频流式传输。
文档
如需全面了解功能和能力,请参阅 Live API 指南。
gemini-3.8-live
| 属性 | 说明 |
|---|---|
| 模型代码 |
gemini-3.8-live
|
| 支持的数据类型 |
输入源 文字、图片、音频、视频 输出 文字和音频 |
| 令牌限制[*] |
输入 token 限制 131,072 输出 token 限制 65536 |
| 功能 |
支持 不受支持 不受支持 不受支持 支持 不受支持 不受支持 支持 支持 不受支持 支持(交错推理) 不受支持 |
| 使用选项 |
不受支持 |
| 版本 |
|
| 最新更新 | 2026 年 9 月 |
| 模型卡片 | 模型卡片 |
从 Gemini 3.1 Flash Live 迁移
Gemini 3.8 Live 可实现超低延迟的音频到音频互动,并扩展了对异步工作流的支持。从 gemini-3.1-flash-live-preview 迁移时,请查看以下更新:
- 模型字符串:将模型字符串从
gemini-3.1-flash-live-preview更新为gemini-3.8-live。 - 思考等级:
thinking_level不支持gemini-3.8-live。 在会议设置中省略thinking_level(或thinking_config)。 - 异步函数调用:异步执行 (
behavior: NON_BLOCKING) 现在是默认的函数调用模式。为了实现向后兼容性,您仍然可以使用同步阻塞模式,只需在工具声明中设置behavior: BLOCKING即可。支持函数调度(SILENT、WHEN_IDLE、INTERRUPTED)。 - 客户端内容更新:在整个会话生命周期内,
send_client_content均受支持,并具有明确的角色(user或model)。设置turn_complete=true会无条件中断活跃的模型生成。如果您发送的内容不含turn_complete,服务器会等待后续消息,然后才做出响应。 - 主动音频:主动音频现已永久启用。设置
proactive_audio: false会返回错误。 - 共情对话:已从 API 中移除共情对话。从代码中移除所有
enable_affective_dialog配置。 - 覆盖率:默认值为
TURN_INCLUDES_AUDIO_ACTIVITY_AND_ALL_VIDEO。默认情况下,视频帧会发送给模型,因此只有在需要管理上下文和费用时才发送帧。 - 回答模态:支持音频回答模态。如果您的应用需要文本转写,请启用输出音频转写。
如需比较所有 Live API 模型的功能,请参阅模型对比表。