Gemini 3.8 Live Extended Thinking は、リアルタイムの音声インタラクション中に複雑な複数ステップの問題を解決するために、より高度なバックグラウンド推論が必要な場合に推奨される、高度な推論能力を持つ音声対音声モデルです。継続的な音声レスポンスをストリーミングしながら、バックグラウンドの推論と非同期のツール呼び出しを処理します。
ドキュメント
機能と機能の詳細については、Live API ガイドをご覧ください。
gemini-3.8-live-extended-thinking
| プロパティ | 説明 |
|---|---|
| モデルコード |
gemini-3.8-live-extended-thinking
|
| でサポートされているデータ型 |
入力 テキスト、画像、音声、動画 出力 テキストと音声 |
| トークンの上限[*] |
入力トークンの上限 131,072 出力トークンの上限 65,536 |
| 機能 |
サポート対象 サポート対象外 サポート対象外 サポート対象外 サポート対象(非同期のみ) サポート対象外 サポート対象外 サポート対象 サポート対象 サポート対象外 サポート対象 サポート対象外 |
| 使用オプション |
サポート対象外 |
| バージョン |
|
| 最終更新日 | 2026 年 9 月 |
| モデルカード | モデルカード |
Gemini 3.8 Live Extended Thinking へのアップグレード
Gemini 3.8 Live Extended Thinking では、ライブ音声セッション中にバックグラウンドで推論が行われるようになりました。このモデルを統合する際は、非同期の推論シグナルを処理するようにクライアントの状態管理を更新します。
- 非同期推論プロトコル: 非同期推論を使用するモデルとやり取りする場合、
turnComplete: trueはモデルがアイドル状態であることを示さなくなりました。サーバーは、バックグラウンドの推論やツール呼び出しの処理を続行できます。クライアントは、turnComplete: trueが到着した後も、後続のサーバー メッセージ(ツール呼び出しや音声フレームなど)をリッスンし続ける必要があります。 interaction_statusのモニタリング: 受信したサーバー メッセージのinteraction_statusフィールドを使用して、現在のサーバーの状態を特定します。IN_PROGRESS: サーバーがユーザー入力をアクティブに処理しているか、バックグラウンドで推論を実行しているか、非同期ツール呼び出しのレスポンスを待機しています。追加のモデル出力やツール呼び出しが続く場合があります。IDLE: サーバーがすべての処理、推論、ツール呼び出しを完了しました。セッションはアイドル状態で、ユーザー入力を待機しています。
- 非同期関数呼び出し: 非同期の非ブロッキング実行(
behavior: NON_BLOCKING)のみがサポートされています。同期ブロッキング モードはサポートされておらず、ハードエラーが返されます。関数スケジューリング構成はサポートされていません。 - 思考構成: セットアップ構成(
thinking_level:low、medium、またはhigh)でthinking_configを使用してバックグラウンド推論を構成します。MINIMALはサポートされていません。 - クライアント コンテンツの更新:
send_client_contentは、明示的なロール(userまたはmodel)を使用して、セッションのライフサイクル全体でサポートされます。turn_complete=trueを設定すると、アクティブな生成が直ちに中断されます。 - プロアクティブ音声: 常に有効です。
proactive_audio: falseを設定すると、エラーが返されます。
すべての Live API モデルの機能の比較については、モデル比較の表をご覧ください。