O Gemini 3.8 Live é a opção padrão para a maioria das experiências de agente de voz de baixa latência e diálogos em tempo real sem atrasos induzidos por raciocínio. Ele oferece suporte a raciocínio intercalado, chamadas de função assíncronas, atualizações de conteúdo completas do cliente de sessão e streaming de áudio integrado.
Documentação
Acesse o guia da API Live para conferir a cobertura completa de recursos e funcionalidades.
gemini-3.8-live
| Propriedade | Descrição |
|---|---|
| Código do modelo |
gemini-3.8-live
|
| Tipos de dados aceitos |
Entradas (link em inglês) Texto, imagens, áudio, vídeo Saída Texto e áudio |
| Limites de token[*] |
Limite de tokens de entrada 131.072 Limite de token de saída 65.536 |
| Recursos |
Compatível incompatível incompatível incompatível Compatível incompatível incompatível Compatível Compatível incompatível Compatível (raciocínio intercalado) incompatível |
| Opções de consumo |
incompatível |
| Versões |
|
| Última atualização | Setembro de 2026 |
| Card de modelo | Card de modelo |
Migrar do Gemini 3.1 Flash Live
O Gemini 3.8 Live oferece interações de áudio para áudio com latência ultrabaixa e amplia o suporte a fluxos de trabalho assíncronos. Ao migrar de
gemini-3.1-flash-live-preview, confira as seguintes atualizações:
- String do modelo: atualize a string do modelo de
gemini-3.1-flash-live-previewparagemini-3.8-live. - Nível de pensamento:
thinking_levelnão é compatível comgemini-3.8-live. Omitathinking_level(outhinking_config) da configuração da sessão. - Chamada de função assíncrona: a execução assíncrona (
behavior: NON_BLOCKING) agora é o modo padrão de chamada de função. Você ainda pode usar o modo de bloqueio síncrono para compatibilidade com versões anteriores definindobehavior: BLOCKINGnas declarações de ferramentas. O agendamento de funções (SILENT,WHEN_IDLE,INTERRUPTED) é compatível. - Atualizações de conteúdo do cliente: o
send_client_contenté compatível com todo o ciclo de vida da sessão com funções explícitas (useroumodel). A definição deturn_complete=trueinterrompe incondicionalmente a geração de modelos ativos. Se você enviar conteúdo semturn_complete, o servidor vai aguardar as mensagens subsequentes antes de responder. - Áudio proativo: agora o áudio proativo está ativado permanentemente. Definir
proactive_audio: falseretorna um erro. - Computação afetiva: a computação afetiva foi removida da API. Remova
todas as configurações de
enable_affective_dialogdo seu código. - Cobertura de conversão: o padrão é
TURN_INCLUDES_AUDIO_ACTIVITY_AND_ALL_VIDEO. Os frames de vídeo são enviados ao modelo por padrão. Portanto, só envie frames quando necessário para gerenciar o contexto e o custo. - Modalidades de resposta: o áudio é a modalidade de resposta compatível. Ative a transcrição de áudio de saída se o aplicativo exigir uma transcrição de texto.
Para uma comparação de recursos em todos os modelos da API Live, consulte a tabela de Comparação de modelos.