Gemini 3.8 Live 是大多數低延遲語音代理程式體驗的預設選項,可進行即時對話,不會因推理而延遲。支援交錯推論、非同步函式呼叫、完整工作階段用戶端內容更新,以及內建音訊串流。
說明文件
如要全面瞭解功能,請參閱 Live API 指南。
gemini-3.8-live
| 屬性 | 說明 |
|---|---|
| 模型代碼 |
gemini-3.8-live
|
| 支援的資料類型 |
輸入裝置 文字、圖片、音訊、影片 輸出內容 文字和音訊 |
| 代幣限制[*] |
輸入權杖限制 131,072 輸出詞元限制 65,536 |
| 功能 |
支援 不支援 不支援 不支援 支援 不支援 不支援 支援 支援 不支援 支援 (交錯推理) 不支援 |
| 計費方案 |
不支援 |
| 個版本 |
|
| 最新更新 | 2026 年 9 月 |
| 模型資訊卡 | 模型資訊卡 |
從 Gemini 3.1 Flash Live 遷移
Gemini 3.8 Live 提供超低延遲的語音對語音互動,並擴大支援非同步工作流程。從 gemini-3.1-flash-live-preview 遷移時,請詳閱下列異動內容:
- 模型字串:將模型字串從
gemini-3.1-flash-live-preview更新為gemini-3.8-live。 - 思考程度:
gemini-3.8-live不支援thinking_level。 在工作階段設定中省略thinking_level(或thinking_config)。 - 非同步函式呼叫:非同步執行 (
behavior: NON_BLOCKING) 現在是預設的函式呼叫模式。如要實現回溯相容性,您仍可為工具宣告設定behavior: BLOCKING,使用同步封鎖模式。支援函式排程 (SILENT、WHEN_IDLE、INTERRUPTED)。 - 用戶端內容更新:在整個工作階段生命週期中,系統都支援
send_client_content,並提供明確的角色 (user或model)。無條件設定turn_complete=true會中斷模型生成作業。如果傳送的內容沒有turn_complete,伺服器會等待後續訊息,再傳回回應。 - 主動式音訊:主動式音訊現已永久啟用。設定
proactive_audio: false會傳回錯誤。 - 情緒感知對話:API 已移除情緒感知對話。從程式碼中移除所有
enable_affective_dialog設定。 - 開啟涵蓋範圍:預設為
TURN_INCLUDES_AUDIO_ACTIVITY_AND_ALL_VIDEO。根據預設,系統會將影片影格傳送至模型,因此請只在需要管理內容和費用時傳送影格。 - 回覆模態:支援音訊回覆模態。如果應用程式需要文字轉錄稿,請啟用輸出音訊轉錄功能。
如要比較所有 Live API 模型的各項功能,請參閱「模式比較」表格。