Gemini 3.8 Live

O Gemini 3.8 Live é a opção padrão para a maioria das experiências de agente de voz de baixa latência e diálogos em tempo real sem atrasos induzidos por raciocínio. Ele oferece suporte a raciocínio intercalado, chamadas de função assíncronas, atualizações de conteúdo completas do cliente de sessão e streaming de áudio integrado.

Documentação

Acesse o guia da API Live para conferir a cobertura completa de recursos e funcionalidades.

gemini-3.8-live

Propriedade Descrição
Código do modelo gemini-3.8-live
Tipos de dados aceitos

Entradas (link em inglês)

Texto, imagens, áudio, vídeo

Saída

Texto e áudio

Limites de token[*]

Limite de tokens de entrada

131.072

Limite de token de saída

65.536

Recursos

Geração de áudio

Compatível

Armazenamento em cache

incompatível

Execução de código

incompatível

Pesquisa de arquivos

incompatível

Chamada de função

Compatível

Embasamento com o Google Maps

incompatível

Geração de imagens

incompatível

API Live

Compatível

Embasamento da pesquisa

Compatível

Respostas estruturadas

incompatível

Raciocínio

Compatível (raciocínio intercalado)

Contexto do URL

incompatível

Opções de consumo

API em lote

incompatível

Versões
Leia os padrões de versão do modelo para mais detalhes.
  • Estável: gemini-3.8-live
Última atualização Setembro de 2026
Card de modelo Card de modelo

Migrar do Gemini 3.1 Flash Live

O Gemini 3.8 Live oferece interações de áudio para áudio com latência ultrabaixa e amplia o suporte a fluxos de trabalho assíncronos. Ao migrar de gemini-3.1-flash-live-preview, confira as seguintes atualizações:

  • String do modelo: atualize a string do modelo de gemini-3.1-flash-live-preview para gemini-3.8-live.
  • Nível de pensamento: thinking_level não é compatível com gemini-3.8-live. Omita thinking_level (ou thinking_config) da configuração da sessão.
  • Chamada de função assíncrona: a execução assíncrona (behavior: NON_BLOCKING) agora é o modo padrão de chamada de função. Você ainda pode usar o modo de bloqueio síncrono para compatibilidade com versões anteriores definindo behavior: BLOCKING nas declarações de ferramentas. O agendamento de funções (SILENT, WHEN_IDLE, INTERRUPTED) é compatível.
  • Atualizações de conteúdo do cliente: o send_client_content é compatível com todo o ciclo de vida da sessão com funções explícitas (user ou model). A definição de turn_complete=true interrompe incondicionalmente a geração de modelos ativos. Se você enviar conteúdo sem turn_complete, o servidor vai aguardar as mensagens subsequentes antes de responder.
  • Áudio proativo: agora o áudio proativo está ativado permanentemente. Definir proactive_audio: false retorna um erro.
  • Computação afetiva: a computação afetiva foi removida da API. Remova todas as configurações de enable_affective_dialog do seu código.
  • Cobertura de conversão: o padrão é TURN_INCLUDES_AUDIO_ACTIVITY_AND_ALL_VIDEO. Os frames de vídeo são enviados ao modelo por padrão. Portanto, só envie frames quando necessário para gerenciar o contexto e o custo.
  • Modalidades de resposta: o áudio é a modalidade de resposta compatível. Ative a transcrição de áudio de saída se o aplicativo exigir uma transcrição de texto.

Para uma comparação de recursos em todos os modelos da API Live, consulte a tabela de Comparação de modelos.