Gemini 3.8 Live Extended Thinking 是高推論能力的語音轉語音模型,建議在即時語音互動期間,需要較高的背景推論能力來解決複雜的多步驟問題時使用。這項功能會在串流處理連續音訊回應時,處理背景推論和非同步工具呼叫。
說明文件
如要全面瞭解功能,請參閱 Live API 指南。
gemini-3.8-live-extended-thinking
| 屬性 | 說明 |
|---|---|
| 模型代碼 |
gemini-3.8-live-extended-thinking
|
| 支援的資料類型 |
輸入裝置 文字、圖片、音訊、影片 輸出內容 文字和音訊 |
| 代幣限制[*] |
輸入權杖限制 131,072 輸出詞元限制 65,536 |
| 功能 |
支援 不支援 不支援 不支援 支援 (僅限非同步) 不支援 不支援 支援 支援 不支援 支援 不支援 |
| 計費方案 |
不支援 |
| 個版本 |
|
| 最新更新 | 2026 年 9 月 |
| 模型資訊卡 | 模型資訊卡 |
升級至 Gemini 3.8 Live Extended Thinking
Gemini 3.8 Live Extended Thinking 推出即時語音工作階段的背景推論功能。整合這個模型時,請更新用戶端狀態管理,以處理非同步推論信號:
- 非同步推論通訊協定:與使用非同步推論的模型互動時,
turnComplete: true不再表示模型處於閒置狀態。伺服器可能會繼續處理背景推論或工具呼叫。在turnComplete: true抵達後,用戶端必須繼續監聽後續的伺服器訊息 (例如工具呼叫或音訊影格)。 - 監控
interaction_status:使用傳入伺服器訊息中的interaction_status欄位,判斷目前的伺服器狀態:IN_PROGRESS:伺服器正在積極處理使用者輸入內容、執行背景推論,或等待非同步工具呼叫的回覆。後續可能會產生其他模型輸出內容或工具呼叫。IDLE:伺服器已完成所有處理、推論和工具呼叫。工作階段處於閒置狀態,等待使用者輸入內容。
- 非同步函式呼叫:僅支援非同步非封鎖執行 (
behavior: NON_BLOCKING)。系統不支援同步封鎖模式,且會傳回嚴重錯誤。不支援函式排程設定。 - 思考設定:在設定配置中使用
thinking_config設定背景推理 (thinking_level:low、medium或high)。請注意,系統不支援MINIMAL。 - 用戶端內容更新:在整個工作階段生命週期中,系統都支援
send_client_content,並提供明確的角色 (user或model)。 設定turn_complete=true會立即中斷正在進行的生成作業。 - 主動式音訊:永久啟用。設定
proactive_audio: false會傳回錯誤。
如要比較所有 Live API 模型的各項功能,請參閱「模式比較」表格。