O Gemini 3.8 Live Extended Thinking é nosso modelo de raciocínio avançado de áudio para áudio recomendado quando é necessário um raciocínio mais elaborado para resolver problemas complexos e de várias etapas durante interações de voz em tempo real. Ele processa o raciocínio em segundo plano e as chamadas de ferramentas assíncronas enquanto transmite respostas de áudio contínuas.
Documentação
Acesse o guia da API Live para conferir a cobertura completa de recursos e funcionalidades.
gemini-3.8-live-extended-thinking
| Propriedade | Descrição |
|---|---|
| Código do modelo |
gemini-3.8-live-extended-thinking
|
| Tipos de dados aceitos |
Entradas (link em inglês) Texto, imagens, áudio, vídeo Saída Texto e áudio |
| Limites de token[*] |
Limite de tokens de entrada 131.072 Limite de token de saída 65.536 |
| Recursos |
Compatível incompatível incompatível incompatível Compatível (somente assíncrono) incompatível incompatível Compatível Compatível incompatível Compatível incompatível |
| Opções de consumo |
incompatível |
| Versões |
|
| Última atualização | Setembro de 2026 |
| Card de modelo | Card de modelo |
Upgrade para o Gemini 3.8 Live Extended Thinking
O Gemini 3.8 Live Extended Thinking apresenta o raciocínio em segundo plano durante as sessões de áudio ao vivo. Ao integrar esse modelo, atualize o gerenciamento de estado do cliente para processar indicadores de raciocínio assíncronos:
- Protocolo de raciocínio assíncrono: ao interagir com modelos que usam raciocínio assíncrono, o
turnComplete: truenão indica mais que o modelo está inativo. O servidor pode continuar processando o raciocínio em segundo plano ou chamadas de ferramentas. O cliente precisa continuar detectando mensagens subsequentes do servidor (como chamadas de função ou frames de áudio) depois queturnComplete: truechegar. - Monitoramento
interaction_status: use o campointeraction_statusnas mensagens do servidor recebidas para determinar o estado atual do servidor:IN_PROGRESS: o servidor está processando ativamente a entrada do usuário, executando raciocínio em segundo plano ou aguardando respostas para chamadas de ferramentas assíncronas. Outras saídas do modelo ou chamadas de ferramentas podem aparecer.IDLE: o servidor concluiu todo o processamento, o raciocínio e as chamadas de ferramentas. A sessão está inativa e aguardando a entrada do usuário.
- Chamada de função assíncrona: apenas a execução assíncrona não bloqueadora
(
behavior: NON_BLOCKING) é compatível. O modo de bloqueio síncrono não é aceito e retorna um erro grave. As configurações de programação de funções não são compatíveis. - Configuração de pensamento: configure o raciocínio em segundo plano usando
thinking_configna configuração de configuração (thinking_level:low,mediumouhigh). Observe queMINIMALnão é compatível. - Atualizações de conteúdo do cliente: o
send_client_contenté compatível com todo o ciclo de vida da sessão com funções explícitas (useroumodel). Definirturn_complete=trueinterrompe imediatamente a geração ativa. - Áudio proativo: ativado permanentemente. Definir
proactive_audio: falseretorna um erro.
Para uma comparação de recursos em todos os modelos da API Live, consulte a tabela de Comparação de modelos.