Gemini 3.8 Live Extended Thinking

Gemini 3.8 Live Extended Thinking es nuestro modelo de audio a audio con alta capacidad de razonamiento recomendado cuando se requiere un mayor razonamiento en segundo plano para la resolución de problemas complejos de varios pasos durante las interacciones por voz en tiempo real. Procesa el razonamiento en segundo plano y las llamadas a herramientas asíncronas mientras transmite respuestas de audio continuas.

Documentación

Visita la guía de la API en vivo para obtener una cobertura completa de las funciones y capacidades.

gemini-3.8-live-extended-thinking

Propiedad Descripción
Código del modelo gemini-3.8-live-extended-thinking
Tipos de datos admitidos

Entradas

Texto, imágenes, audio y video

Resultado

Texto y audio

Límites de tokens[*]

Límite de tokens de entrada

131,072

Límite de tokens de salida

65,536

Funciones

Generación de audio

Admitido

Almacenamiento en caché

No compatible

Ejecución de código

No compatible

Búsqueda de archivos

No compatible

Llamada a función

Admitido (solo de forma asíncrona)

Fundamentación con Google Maps

No compatible

Generación de imágenes

No compatible

API de Live

Admitido

Fundamentación con la Búsqueda

Admitido

Resultados estructurados

No compatible

Pensamiento

Admitido

Contexto de la URL

No compatible

Opciones de consumo

API de Batch

No compatible

Versiones de
Lee los patrones de versiones de modelos para obtener más detalles.
  • Estable: gemini-3.8-live-extended-thinking
Última actualización Septiembre de 2026
Ficha del modelo de Ficha del modelo

Actualización a Gemini 3.8 Live Extended Thinking

Gemini 3.8 Live Extended Thinking introduce el razonamiento en segundo plano durante las sesiones de audio en vivo. Cuando integres este modelo, actualiza la administración del estado del cliente para controlar los indicadores de razonamiento asíncronos:

  • Protocolo de razonamiento asíncrono: Cuando interactúas con modelos que usan razonamiento asíncrono, turnComplete: true ya no indica que el modelo está inactivo. El servidor puede seguir procesando el razonamiento en segundo plano o las llamadas a herramientas. Tu cliente debe seguir escuchando los mensajes posteriores del servidor (como llamadas a herramientas o fotogramas de audio) después de que llegue turnComplete: true.
  • Supervisión interaction_status: Usa el campo interaction_status en los mensajes entrantes del servidor para determinar el estado actual del servidor:
    • IN_PROGRESS: El servidor está procesando activamente la entrada del usuario, ejecutando razonamiento en segundo plano o esperando respuestas para las llamadas a herramientas asíncronas. Es posible que se generen resultados adicionales del modelo o llamadas a herramientas.
    • IDLE: El servidor finalizó todo el procesamiento, el razonamiento y las llamadas a herramientas. La sesión está inactiva y espera la entrada del usuario.
  • Llamada a función asíncrona: Solo se admite la ejecución asíncrona no bloqueante (behavior: NON_BLOCKING). No se admite el modo de bloqueo síncrono y se devuelve un error grave. No se admiten las configuraciones de programación de funciones.
  • Configuración de pensamiento: Configura el razonamiento en segundo plano con thinking_config en la configuración de tu equipo (thinking_level: low, medium o high). Ten en cuenta que MINIMAL no es compatible.
  • Actualizaciones de contenido del cliente: send_client_content se admite durante todo el ciclo de vida de la sesión con roles explícitos (user o model). Establecer turn_complete=true interrumpe de inmediato la generación activa.
  • Audio proactivo: Está habilitado de forma permanente. Si se configura proactive_audio: false, se muestra un error.

Para ver una comparación de las funciones en todos los modelos de la API de Live, consulta la tabla de comparación de modelos.