Gemini 3.8 Live Extended Thinking es nuestro modelo de audio a audio con alta capacidad de razonamiento recomendado cuando se requiere un mayor razonamiento en segundo plano para la resolución de problemas complejos de varios pasos durante las interacciones por voz en tiempo real. Procesa el razonamiento en segundo plano y las llamadas a herramientas asíncronas mientras transmite respuestas de audio continuas.
Documentación
Visita la guía de la API en vivo para obtener una cobertura completa de las funciones y capacidades.
gemini-3.8-live-extended-thinking
| Propiedad | Descripción |
|---|---|
| Código del modelo |
gemini-3.8-live-extended-thinking
|
| Tipos de datos admitidos |
Entradas Texto, imágenes, audio y video Resultado Texto y audio |
| Límites de tokens[*] |
Límite de tokens de entrada 131,072 Límite de tokens de salida 65,536 |
| Funciones |
Admitido No compatible No compatible No compatible Admitido (solo de forma asíncrona) Fundamentación con Google Maps No compatible No compatible Admitido Fundamentación con la Búsqueda Admitido No compatible Admitido No compatible |
| Opciones de consumo |
No compatible |
| Versiones de |
|
| Última actualización | Septiembre de 2026 |
| Ficha del modelo de | Ficha del modelo |
Actualización a Gemini 3.8 Live Extended Thinking
Gemini 3.8 Live Extended Thinking introduce el razonamiento en segundo plano durante las sesiones de audio en vivo. Cuando integres este modelo, actualiza la administración del estado del cliente para controlar los indicadores de razonamiento asíncronos:
- Protocolo de razonamiento asíncrono: Cuando interactúas con modelos que usan razonamiento asíncrono,
turnComplete: trueya no indica que el modelo está inactivo. El servidor puede seguir procesando el razonamiento en segundo plano o las llamadas a herramientas. Tu cliente debe seguir escuchando los mensajes posteriores del servidor (como llamadas a herramientas o fotogramas de audio) después de que llegueturnComplete: true. - Supervisión
interaction_status: Usa el campointeraction_statusen los mensajes entrantes del servidor para determinar el estado actual del servidor:IN_PROGRESS: El servidor está procesando activamente la entrada del usuario, ejecutando razonamiento en segundo plano o esperando respuestas para las llamadas a herramientas asíncronas. Es posible que se generen resultados adicionales del modelo o llamadas a herramientas.IDLE: El servidor finalizó todo el procesamiento, el razonamiento y las llamadas a herramientas. La sesión está inactiva y espera la entrada del usuario.
- Llamada a función asíncrona: Solo se admite la ejecución asíncrona no bloqueante (
behavior: NON_BLOCKING). No se admite el modo de bloqueo síncrono y se devuelve un error grave. No se admiten las configuraciones de programación de funciones. - Configuración de pensamiento: Configura el razonamiento en segundo plano con
thinking_configen la configuración de tu equipo (thinking_level:low,mediumohigh). Ten en cuenta queMINIMALno es compatible. - Actualizaciones de contenido del cliente:
send_client_contentse admite durante todo el ciclo de vida de la sesión con roles explícitos (useromodel). Establecerturn_complete=trueinterrumpe de inmediato la generación activa. - Audio proactivo: Está habilitado de forma permanente. Si se configura
proactive_audio: false, se muestra un error.
Para ver una comparación de las funciones en todos los modelos de la API de Live, consulta la tabla de comparación de modelos.