Prévia dinâmica do Gemini 3.1 Flash

O Gemini 3.1 Flash Live Preview é um modelo legado de pré-lançamento para diálogo em tempo real e aplicativos de IA que priorizam a voz.

Documentação

Acesse o guia da API Live para conferir a cobertura completa de recursos e funcionalidades.

gemini-3.1-flash-live-preview

Propriedade Descrição
Código do modelo gemini-3.1-flash-live-preview
Tipos de dados aceitos

Entradas (link em inglês)

Texto, imagens, áudio, vídeo

Saída

Texto e áudio

Limites de token[*]

Limite de tokens de entrada

131.072

Limite de token de saída

65.536

Recursos

Geração de áudio

Compatível

Armazenamento em cache

incompatível

Execução de código

incompatível

Pesquisa de arquivos

Não disponível

Chamada de função

Compatível

Embasamento com o Google Maps

incompatível

Geração de imagens

incompatível

API Live

Compatível

Embasamento da pesquisa

Compatível

Respostas estruturadas

incompatível

Raciocínio

Compatível

Contexto do URL

incompatível

Opções de consumo

API em lote

incompatível

Versões
Leia os padrões de versão do modelo para mais detalhes.
  • Visualização: gemini-3.1-flash-live-preview
Última atualização Março de 2026
Card de modelo Card de modelo

Migrar do Gemini 2.5 Flash Live

A prévia do Gemini 3.1 Flash Live é otimizada para diálogo em tempo real e com baixa latência. Ao migrar do gemini-2.5-flash-native-audio-preview-12-2025, considere o seguinte:

  • String do modelo: atualize a string do modelo de gemini-2.5-flash-native-audio-preview-12-2025 para gemini-3.1-flash-live-preview.
  • Configuração de pensamento: o Gemini 3.1 usa thinkingLevel (com configurações como minimal, low, medium e high) em vez de thinkingBudget. O padrão é minimal para otimizar a menor latência. Consulte Níveis de pensamento e orçamentos.
  • Eventos do servidor: um único evento BidiGenerateContentServerContent agora pode conter várias partes de conteúdo simultaneamente (por exemplo, trechos de áudio e transcrição). Atualize o código para processar todas as partes em cada evento e evitar a perda de conteúdo.
  • Conteúdo do cliente: o send_client_content tem suporte durante todo o ciclo de vida da sessão com funções explícitas (user ou model). A definição de turn_complete=true interrompe incondicionalmente a geração ativa de modelos. Consulte Atualizações incrementais de conteúdo.
  • Cobertura de curva: o padrão é TURN_INCLUDES_AUDIO_ACTIVITY_AND_ALL_VIDEO em vez de TURN_INCLUDES_ONLY_ACTIVITY. Agora, a vez do modelo inclui a atividade de áudio detectada e todos os frames de vídeo. Se o aplicativo envia um fluxo constante de frames de vídeo, atualize-o para enviar frames somente quando houver atividade de áudio e evitar custos adicionais.
  • Chamada de função assíncrona: ainda não disponível. A chamada de função é síncrona apenas. O modelo só vai começar a responder depois que você enviar a resposta da ferramenta. Consulte Chamada de função assíncrona.
  • Áudio proativo e diálogo afetivo: esses recursos ainda não são compatíveis com o Gemini 3.1 Flash Live. Remova qualquer configuração dessas funcionalidades do seu código. Consulte Áudio proativo e Diálogo afetivo.

Para uma comparação detalhada de recursos, consulte a tabela Comparação de modelos no guia de recursos.