Gemini 3.8 Live Extended Thinking

Gemini 3.8 Live Extended Thinking 是高推論能力的語音轉語音模型,建議在即時語音互動期間,需要較高的背景推論能力來解決複雜的多步驟問題時使用。這項功能會在串流處理連續音訊回應時,處理背景推論和非同步工具呼叫。

說明文件

如要全面瞭解功能,請參閱 Live API 指南。

gemini-3.8-live-extended-thinking

屬性 說明
模型代碼 gemini-3.8-live-extended-thinking
支援的資料類型

輸入裝置

文字、圖片、音訊、影片

輸出內容

文字和音訊

代幣限制[*]

輸入權杖限制

131,072

輸出詞元限制

65,536

功能

生成音訊

支援

快取

不支援

執行程式碼

不支援

檔案搜尋

不支援

函式呼叫

支援 (僅限非同步)

利用 Google 地圖建立基準

不支援

圖像生成

不支援

Live API

支援

以搜尋為基準

支援

結構化輸出內容

不支援

思考

支援

網址內容

不支援

計費方案

批次 API

不支援

個版本
如要瞭解詳情,請參閱模型版本模式
  • 穩定:gemini-3.8-live-extended-thinking
最新更新 2026 年 9 月
模型資訊卡 模型資訊卡

升級至 Gemini 3.8 Live Extended Thinking

Gemini 3.8 Live Extended Thinking 推出即時語音工作階段的背景推論功能。整合這個模型時,請更新用戶端狀態管理,以處理非同步推論信號:

  • 非同步推論通訊協定:與使用非同步推論的模型互動時,turnComplete: true 不再表示模型處於閒置狀態。伺服器可能會繼續處理背景推論或工具呼叫。在 turnComplete: true 抵達後,用戶端必須繼續監聽後續的伺服器訊息 (例如工具呼叫或音訊影格)。
  • 監控 interaction_status:使用傳入伺服器訊息中的 interaction_status 欄位,判斷目前的伺服器狀態:
    • IN_PROGRESS:伺服器正在積極處理使用者輸入內容、執行背景推論,或等待非同步工具呼叫的回覆。後續可能會產生其他模型輸出內容或工具呼叫。
    • IDLE:伺服器已完成所有處理、推論和工具呼叫。工作階段處於閒置狀態,等待使用者輸入內容。
  • 非同步函式呼叫:僅支援非同步非封鎖執行 (behavior: NON_BLOCKING)。系統不支援同步封鎖模式,且會傳回嚴重錯誤。不支援函式排程設定。
  • 思考設定:在設定配置中使用 thinking_config 設定背景推理 (thinking_levellowmediumhigh)。請注意,系統不支援 MINIMAL
  • 用戶端內容更新:在整個工作階段生命週期中,系統都支援 send_client_content,並提供明確的角色 (usermodel)。 設定 turn_complete=true 會立即中斷正在進行的生成作業。
  • 主動式音訊:永久啟用。設定 proactive_audio: false 會傳回錯誤。

如要比較所有 Live API 模型的各項功能,請參閱「模式比較」表格。