Gemini 3.8 Live

Gemini 3.8 Live es la opción predeterminada para la mayoría de las experiencias de agentes de voz de baja latencia y los diálogos en tiempo real sin demoras inducidas por el razonamiento. Admite el razonamiento intercalado, las llamadas a funciones asíncronas, las actualizaciones completas del contenido del cliente de la sesión y la transmisión de audio integrada.

Documentación

Visita la guía de la API en vivo para obtener una cobertura completa de las funciones y capacidades.

gemini-3.8-live

Propiedad Descripción
Código del modelo gemini-3.8-live
Tipos de datos admitidos

Entradas

Texto, imágenes, audio y video

Resultado

Texto y audio

Límites de tokens[*]

Límite de tokens de entrada

131,072

Límite de tokens de salida

65,536

Funciones

Generación de audio

Admitido

Almacenamiento en caché

No compatible

Ejecución de código

No compatible

Búsqueda de archivos

No compatible

Llamada a función

Admitido

Fundamentación con Google Maps

No compatible

Generación de imágenes

No compatible

API de Live

Admitido

Fundamentación con la Búsqueda

Admitido

Resultados estructurados

No compatible

Pensamiento

Admitido (razonamiento intercalado)

Contexto de la URL

No compatible

Opciones de consumo

API de Batch

No compatible

Versiones de
Lee los patrones de versiones de modelos para obtener más detalles.
  • Estable: gemini-3.8-live
Última actualización Septiembre de 2026
Ficha del modelo de Ficha del modelo

Migración desde Gemini 3.1 Flash Live

Gemini 3.8 Live ofrece interacciones de audio a audio con latencia ultrabaja y amplía la compatibilidad con flujos de trabajo asíncronos. Cuando migres desde gemini-3.1-flash-live-preview, revisa las siguientes actualizaciones:

  • Cadena del modelo: Actualiza la cadena del modelo de gemini-3.1-flash-live-preview a gemini-3.8-live.
  • Nivel de pensamiento: thinking_level no se admite para gemini-3.8-live. Omite thinking_level (o thinking_config) de la configuración de la sesión.
  • Llamada a función asíncrona: La ejecución asíncrona (behavior: NON_BLOCKING) ahora es el modo predeterminado de llamada a función. Aún puedes usar el modo de bloqueo síncrono para la retrocompatibilidad. Para ello, establece behavior: BLOCKING en las declaraciones de tu herramienta. Se admite la programación de funciones (SILENT, WHEN_IDLE, INTERRUPTED).
  • Actualizaciones de contenido del cliente: send_client_content se admite durante todo el ciclo de vida de la sesión con roles explícitos (user o model). Establecer turn_complete=true incondicionalmente interrumpe la generación activa del modelo. Si envías contenido sin turn_complete, el servidor espera mensajes posteriores antes de responder.
  • Audio proactivo: El audio proactivo ahora está habilitado de forma permanente. Si se configura proactive_audio: false, se muestra un error.
  • Diálogo basado en emociones detectadas: Se quitó el diálogo basado en emociones detectadas de la API. Quita cualquier configuración de enable_affective_dialog de tu código.
  • Cobertura de giros: El valor predeterminado es TURN_INCLUDES_AUDIO_ACTIVITY_AND_ALL_VIDEO. Los fotogramas de video se envían al modelo de forma predeterminada, por lo que solo debes enviarlos cuando sea necesario para administrar el contexto y el costo.
  • Modalidades de respuesta: El audio es la modalidad de respuesta admitida. Habilita la transcripción de audio de salida si tu aplicación requiere una transcripción de texto.

Para ver una comparación de las funciones en todos los modelos de la API de Live, consulta la tabla de comparación de modelos.