Gemini 3.8 Live

Gemini 3.8 Live 是大多數低延遲語音代理程式體驗的預設選項,可進行即時對話,不會因推理而延遲。支援交錯推論、非同步函式呼叫、完整工作階段用戶端內容更新,以及內建音訊串流。

說明文件

如要全面瞭解功能,請參閱 Live API 指南。

gemini-3.8-live

屬性 說明
模型代碼 gemini-3.8-live
支援的資料類型

輸入裝置

文字、圖片、音訊、影片

輸出內容

文字和音訊

代幣限制[*]

輸入權杖限制

131,072

輸出詞元限制

65,536

功能

生成音訊

支援

快取

不支援

執行程式碼

不支援

檔案搜尋

不支援

函式呼叫

支援

利用 Google 地圖建立基準

不支援

圖像生成

不支援

Live API

支援

以搜尋為基準

支援

結構化輸出內容

不支援

思考

支援 (交錯推理)

網址內容

不支援

計費方案

批次 API

不支援

個版本
如要瞭解詳情,請參閱模型版本模式
  • 穩定:gemini-3.8-live
最新更新 2026 年 9 月
模型資訊卡 模型資訊卡

從 Gemini 3.1 Flash Live 遷移

Gemini 3.8 Live 提供超低延遲的語音對語音互動,並擴大支援非同步工作流程。從 gemini-3.1-flash-live-preview 遷移時,請詳閱下列異動內容:

  • 模型字串:將模型字串從 gemini-3.1-flash-live-preview 更新為 gemini-3.8-live
  • 思考程度gemini-3.8-live 不支援 thinking_level。 在工作階段設定中省略 thinking_level (或 thinking_config)。
  • 非同步函式呼叫:非同步執行 (behavior: NON_BLOCKING) 現在是預設的函式呼叫模式。如要實現回溯相容性,您仍可為工具宣告設定 behavior: BLOCKING,使用同步封鎖模式。支援函式排程 (SILENTWHEN_IDLEINTERRUPTED)。
  • 用戶端內容更新:在整個工作階段生命週期中,系統都支援 send_client_content,並提供明確的角色 (usermodel)。無條件設定 turn_complete=true 會中斷模型生成作業。如果傳送的內容沒有 turn_complete,伺服器會等待後續訊息,再傳回回應。
  • 主動式音訊:主動式音訊現已永久啟用。設定 proactive_audio: false 會傳回錯誤。
  • 情緒感知對話:API 已移除情緒感知對話。從程式碼中移除所有 enable_affective_dialog 設定。
  • 開啟涵蓋範圍:預設為 TURN_INCLUDES_AUDIO_ACTIVITY_AND_ALL_VIDEO。根據預設,系統會將影片影格傳送至模型,因此請只在需要管理內容和費用時傳送影格。
  • 回覆模態:支援音訊回覆模態。如果應用程式需要文字轉錄稿,請啟用輸出音訊轉錄功能。

如要比較所有 Live API 模型的各項功能,請參閱「模式比較」表格。