Gemini 3.8 Live Extended Thinking

Gemini 3.8 Live Extended Thinking은 실시간 음성 상호작용 중에 복잡한 다단계 문제 해결을 위해 더 높은 배경 추론이 필요한 경우에 권장되는 추론 능력이 뛰어난 오디오 간 변환 모델입니다. 연속 오디오 응답을 스트리밍하는 동안 백그라운드 추론과 비동기 도구 호출을 처리합니다.

문서

기능 및 기능에 관한 전체 내용은 Live API 가이드를 참고하세요.

gemini-3.8-live-extended-thinking

속성 설명
모델 코드 gemini-3.8-live-extended-thinking
지원되는 데이터 유형

입력

텍스트, 이미지, 오디오, 동영상

출력

텍스트 및 오디오

토큰 한도[*]

입력 토큰 한도

131,072

출력 토큰 한도

65,536

기능

오디오 생성

지원됨

캐싱

지원되지 않음

코드 실행

지원되지 않음

파일 검색

지원되지 않음

함수 호출

지원됨 (비동기만 해당)

Google 지도 기반 그라운딩

지원되지 않음

이미지 생성

지원되지 않음

Live API

지원됨

검색 그라운딩

지원됨

구조화된 출력

지원되지 않음

사고

지원됨

URL 컨텍스트

지원되지 않음

소비 옵션

Batch API

지원되지 않음

버전
자세한 내용은 모델 버전 패턴을 참고하세요.
  • 안정화 버전: gemini-3.8-live-extended-thinking
최신 업데이트 2026년 9월
모델 카드 모델 카드

Gemini 3.8 Live Extended Thinking으로 업그레이드

Gemini 3.8 Live Extended Thinking은 라이브 오디오 세션 중에 백그라운드 추론을 도입합니다. 이 모델을 통합할 때는 비동기 추론 신호를 처리하도록 클라이언트 상태 관리를 업데이트하세요.

  • 비동기 추론 프로토콜: 비동기 추론을 사용하는 모델과 상호작용할 때 turnComplete: true는 더 이상 모델이 유휴 상태임을 나타내지 않습니다. 서버는 백그라운드 추론 또는 도구 호출을 계속 처리할 수 있습니다. 클라이언트는 turnComplete: true가 도착한 후 후속 서버 메시지 (예: 도구 호출 또는 오디오 프레임)를 계속 수신해야 합니다.
  • 모니터링 interaction_status: 수신 서버 메시지의 interaction_status 필드를 사용하여 현재 서버 상태를 확인합니다.
    • IN_PROGRESS: 서버가 사용자 입력을 적극적으로 처리하거나, 백그라운드 추론을 실행하거나, 비동기 도구 호출에 대한 응답을 기다리고 있습니다. 추가 모델 출력 또는 도구 호출이 이어질 수 있습니다.
    • IDLE: 서버가 모든 처리, 추론, 도구 호출을 완료했습니다. 세션이 유휴 상태이며 사용자 입력을 기다리고 있습니다.
  • 비동기 함수 호출: 비동기 비차단 실행(behavior: NON_BLOCKING)만 지원됩니다. 동기 차단 모드는 지원되지 않으며 심각한 오류를 반환합니다. 함수 예약 구성은 지원되지 않습니다.
  • 사고 구성: 설정 구성 (thinking_level: low, medium 또는 high)에서 thinking_config를 사용하여 백그라운드 추론을 구성합니다. MINIMAL은 지원되지 않습니다.
  • 클라이언트 콘텐츠 업데이트: send_client_content는 명시적 역할 (user 또는 model)을 사용하여 전체 세션 수명 주기에서 지원됩니다. turn_complete=true를 설정하면 활성 생성이 즉시 중단됩니다.
  • 능동적 오디오: 영구적으로 사용 설정됩니다. proactive_audio: false를 설정하면 오류가 반환됩니다.

모든 Live API 모델의 기능 비교는 모델 비교 표를 참고하세요.