Gemini 3.8 Live(扩展思考)

Gemini 3.8 Live Extended Thinking 是一款高推理音频转音频模型,建议在实时语音互动期间需要更强的后台推理能力来解决复杂的多步骤问题时使用。在流式传输连续音频响应的同时,处理后台推理和异步工具调用。

文档

如需全面了解功能和能力,请参阅 Live API 指南。

gemini-3.8-live-extended-thinking

属性 说明
模型代码 gemini-3.8-live-extended-thinking
支持的数据类型

输入源

文字、图片、音频、视频

输出

文字和音频

令牌限制[*]

输入 token 限制

131,072

输出 token 限制

65536

功能

音频生成

支持

缓存

不受支持

代码执行

不受支持

文件搜索

不受支持

函数调用

支持(仅限异步)

Grounding with Google Maps

不受支持

图片生成

不受支持

Live API

支持

搜索接地

支持

结构化输出

不受支持

思考

支持

网址上下文

不受支持

使用选项

Batch API

不受支持

版本
如需了解详情,请参阅模型版本模式
  • 稳定版:gemini-3.8-live-extended-thinking
最新更新 2026 年 9 月
模型卡片 模型卡片

升级到 Gemini 3.8 Live(扩展思考)

Gemini 3.8 Live Extended Thinking 在实时音频会话期间引入了后台推理功能。集成此模型时,请更新客户端状态管理,以处理异步推理信号:

  • 异步推理协议:与使用异步推理的模型互动时,turnComplete: true 不再表示模型处于空闲状态。服务器可能会继续处理后台推理或工具调用。在收到 turnComplete: true 后,客户端必须继续侦听后续服务器消息(例如工具调用或音频帧)。
  • 监控 interaction_status:使用传入服务器消息中的 interaction_status 字段来确定当前服务器状态:
    • IN_PROGRESS:服务器正在积极处理用户输入、运行后台推理或等待异步工具调用的响应。 之后可能会有更多模型输出或工具调用。
    • IDLE:服务器已完成所有处理、推理和工具调用。 会话处于空闲状态,正在等待用户输入。
  • 异步函数调用:仅支持异步非阻塞执行 (behavior: NON_BLOCKING)。不支持同步阻塞模式,并会返回严重错误。不支持函数调度配置。
  • 思考配置:在设置配置(thinking_levellowmediumhigh)中使用 thinking_config 配置后台推理。请注意,不支持 MINIMAL
  • 客户端内容更新:在整个会话生命周期内,send_client_content 均受支持,并具有明确的角色(usermodel)。设置 turn_complete=true 会立即中断正在进行的生成操作。
  • 主动音频:永久启用。设置 proactive_audio: false 会返回错误。

如需比较所有 Live API 模型的功能,请参阅模型对比表。