Gemini 3.8 Live

对于大多数低延迟语音代理体验和实时对话,Gemini 3.8 Live 是默认选项,不会因推理而产生延迟。它支持交错推理、异步函数调用、完整会话客户端内容更新和内置音频流式传输。

文档

如需全面了解功能和能力,请参阅 Live API 指南。

gemini-3.8-live

属性 说明
模型代码 gemini-3.8-live
支持的数据类型

输入源

文字、图片、音频、视频

输出

文字和音频

令牌限制[*]

输入 token 限制

131,072

输出 token 限制

65536

功能

音频生成

支持

缓存

不受支持

代码执行

不受支持

文件搜索

不受支持

函数调用

支持

Grounding with Google Maps

不受支持

图片生成

不受支持

Live API

支持

搜索接地

支持

结构化输出

不受支持

思考

支持(交错推理)

网址上下文

不受支持

使用选项

Batch API

不受支持

版本
如需了解详情,请参阅模型版本模式
  • 稳定版:gemini-3.8-live
最新更新 2026 年 9 月
模型卡片 模型卡片

从 Gemini 3.1 Flash Live 迁移

Gemini 3.8 Live 可实现超低延迟的音频到音频互动,并扩展了对异步工作流的支持。从 gemini-3.1-flash-live-preview 迁移时,请查看以下更新:

  • 模型字符串:将模型字符串从 gemini-3.1-flash-live-preview 更新为 gemini-3.8-live
  • 思考等级thinking_level 不支持 gemini-3.8-live。 在会议设置中省略 thinking_level(或 thinking_config)。
  • 异步函数调用:异步执行 (behavior: NON_BLOCKING) 现在是默认的函数调用模式。为了实现向后兼容性,您仍然可以使用同步阻塞模式,只需在工具声明中设置 behavior: BLOCKING 即可。支持函数调度(SILENTWHEN_IDLEINTERRUPTED)。
  • 客户端内容更新:在整个会话生命周期内,send_client_content 均受支持,并具有明确的角色(usermodel)。设置 turn_complete=true 会无条件中断活跃的模型生成。如果您发送的内容不含 turn_complete,服务器会等待后续消息,然后才做出响应。
  • 主动音频:主动音频现已永久启用。设置 proactive_audio: false 会返回错误。
  • 共情对话:已从 API 中移除共情对话。从代码中移除所有 enable_affective_dialog 配置。
  • 覆盖率:默认值为 TURN_INCLUDES_AUDIO_ACTIVITY_AND_ALL_VIDEO。默认情况下,视频帧会发送给模型,因此只有在需要管理上下文和费用时才发送帧。
  • 回答模态:支持音频回答模态。如果您的应用需要文本转写,请启用输出音频转写。

如需比较所有 Live API 模型的功能,请参阅模型对比表。