Gemini 3.8 Live Extended Thinking

O Gemini 3.8 Live Extended Thinking é nosso modelo de raciocínio avançado de áudio para áudio recomendado quando é necessário um raciocínio mais elaborado para resolver problemas complexos e de várias etapas durante interações de voz em tempo real. Ele processa o raciocínio em segundo plano e as chamadas de ferramentas assíncronas enquanto transmite respostas de áudio contínuas.

Documentação

Acesse o guia da API Live para conferir a cobertura completa de recursos e funcionalidades.

gemini-3.8-live-extended-thinking

Propriedade Descrição
Código do modelo gemini-3.8-live-extended-thinking
Tipos de dados aceitos

Entradas (link em inglês)

Texto, imagens, áudio, vídeo

Saída

Texto e áudio

Limites de token[*]

Limite de tokens de entrada

131.072

Limite de token de saída

65.536

Recursos

Geração de áudio

Compatível

Armazenamento em cache

incompatível

Execução de código

incompatível

Pesquisa de arquivos

incompatível

Chamada de função

Compatível (somente assíncrono)

Embasamento com o Google Maps

incompatível

Geração de imagens

incompatível

API Live

Compatível

Embasamento da pesquisa

Compatível

Respostas estruturadas

incompatível

Raciocínio

Compatível

Contexto do URL

incompatível

Opções de consumo

API em lote

incompatível

Versões
Leia os padrões de versão do modelo para mais detalhes.
  • Estável: gemini-3.8-live-extended-thinking
Última atualização Setembro de 2026
Card de modelo Card de modelo

Upgrade para o Gemini 3.8 Live Extended Thinking

O Gemini 3.8 Live Extended Thinking apresenta o raciocínio em segundo plano durante as sessões de áudio ao vivo. Ao integrar esse modelo, atualize o gerenciamento de estado do cliente para processar indicadores de raciocínio assíncronos:

  • Protocolo de raciocínio assíncrono: ao interagir com modelos que usam raciocínio assíncrono, o turnComplete: true não indica mais que o modelo está inativo. O servidor pode continuar processando o raciocínio em segundo plano ou chamadas de ferramentas. O cliente precisa continuar detectando mensagens subsequentes do servidor (como chamadas de função ou frames de áudio) depois que turnComplete: true chegar.
  • Monitoramento interaction_status: use o campo interaction_status nas mensagens do servidor recebidas para determinar o estado atual do servidor:
    • IN_PROGRESS: o servidor está processando ativamente a entrada do usuário, executando raciocínio em segundo plano ou aguardando respostas para chamadas de ferramentas assíncronas. Outras saídas do modelo ou chamadas de ferramentas podem aparecer.
    • IDLE: o servidor concluiu todo o processamento, o raciocínio e as chamadas de ferramentas. A sessão está inativa e aguardando a entrada do usuário.
  • Chamada de função assíncrona: apenas a execução assíncrona não bloqueadora (behavior: NON_BLOCKING) é compatível. O modo de bloqueio síncrono não é aceito e retorna um erro grave. As configurações de programação de funções não são compatíveis.
  • Configuração de pensamento: configure o raciocínio em segundo plano usando thinking_config na configuração de configuração (thinking_level: low, medium ou high). Observe que MINIMAL não é compatível.
  • Atualizações de conteúdo do cliente: o send_client_content é compatível com todo o ciclo de vida da sessão com funções explícitas (user ou model). Definir turn_complete=true interrompe imediatamente a geração ativa.
  • Áudio proativo: ativado permanentemente. Definir proactive_audio: false retorna um erro.

Para uma comparação de recursos em todos os modelos da API Live, consulte a tabela de Comparação de modelos.