Gemini 3.8 Live Extended Thinking 是一款高推理音频转音频模型,建议在实时语音互动期间需要更强的后台推理能力来解决复杂的多步骤问题时使用。在流式传输连续音频响应的同时,处理后台推理和异步工具调用。
文档
如需全面了解功能和能力,请参阅 Live API 指南。
gemini-3.8-live-extended-thinking
| 属性 | 说明 |
|---|---|
| 模型代码 |
gemini-3.8-live-extended-thinking
|
| 支持的数据类型 |
输入源 文字、图片、音频、视频 输出 文字和音频 |
| 令牌限制[*] |
输入 token 限制 131,072 输出 token 限制 65536 |
| 功能 |
支持 不受支持 不受支持 不受支持 支持(仅限异步) 不受支持 不受支持 支持 支持 不受支持 支持 不受支持 |
| 使用选项 |
不受支持 |
| 版本 |
|
| 最新更新 | 2026 年 9 月 |
| 模型卡片 | 模型卡片 |
升级到 Gemini 3.8 Live(扩展思考)
Gemini 3.8 Live Extended Thinking 在实时音频会话期间引入了后台推理功能。集成此模型时,请更新客户端状态管理,以处理异步推理信号:
- 异步推理协议:与使用异步推理的模型互动时,
turnComplete: true不再表示模型处于空闲状态。服务器可能会继续处理后台推理或工具调用。在收到turnComplete: true后,客户端必须继续侦听后续服务器消息(例如工具调用或音频帧)。 - 监控
interaction_status:使用传入服务器消息中的interaction_status字段来确定当前服务器状态:IN_PROGRESS:服务器正在积极处理用户输入、运行后台推理或等待异步工具调用的响应。 之后可能会有更多模型输出或工具调用。IDLE:服务器已完成所有处理、推理和工具调用。 会话处于空闲状态,正在等待用户输入。
- 异步函数调用:仅支持异步非阻塞执行 (
behavior: NON_BLOCKING)。不支持同步阻塞模式,并会返回严重错误。不支持函数调度配置。 - 思考配置:在设置配置(
thinking_level:low、medium或high)中使用thinking_config配置后台推理。请注意,不支持MINIMAL。 - 客户端内容更新:在整个会话生命周期内,
send_client_content均受支持,并具有明确的角色(user或model)。设置turn_complete=true会立即中断正在进行的生成操作。 - 主动音频:永久启用。设置
proactive_audio: false会返回错误。
如需比较所有 Live API 模型的功能,请参阅模型对比表。