Pré-lançamento do Gemini 3.1 Flash TTS (conversão de texto em voz)

O modelo de prévia do Gemini 3.1 Flash TTS oferece geração de fala eficiente e de baixa latência com saídas naturais, comandos direcionáveis e tags de áudio expressivas para controle preciso da narração.

Documentação

O modelo de prévia do Gemini 3.1 Flash TTS apresenta tags de áudio expressivas para controlar a narração, além de melhorias gerais na naturalidade, na capacidade de controle e no suporte a vários idiomas.

Acesse o guia Text-to-Speech para conferir todos os recursos e funcionalidades.

gemini-3.1-flash-tts-preview

Propriedade Descrição
Código do modelo gemini-3.1-flash-tts-preview
Tipos de dados aceitos

Entradas (link em inglês)

Texto

Saída

Áudio

Limites de tokens [*]

Limite de tokens de entrada

8.192

Limite de token de saída

16.384

Recursos

Geração de áudio

Compatível

Armazenamento em cache

incompatível

Execução de código

incompatível

Pesquisa de arquivos

Não disponível

Chamada de função

incompatível

Embasamento com o Google Maps

incompatível

Geração de imagens

incompatível

API Live

incompatível

Embasamento da pesquisa

incompatível

Respostas estruturadas

incompatível

Raciocínio

incompatível

Contexto do URL

incompatível

Opções de consumo

API em lote

Compatível

Inferência flexível

incompatível

Inferência de prioridade

incompatível

Versões do
Leia os padrões de versão do modelo para mais detalhes.
  • gemini-3.1-flash-tts-preview
Última atualização Abril de 2026
Card de modelo Card de modelo