Pré-lançamento do Gemini 3.1 Flash TTS (conversão de texto em voz)

O modelo de prévia do Gemini 3.1 Flash TTS oferece geração de fala poderosa e de baixa latência com saídas naturais, comandos direcionáveis e novas tags de áudio expressivas para controle preciso da narração.

Documentação

O modelo de prévia do Gemini 3.1 Flash TTS apresenta tags de áudio expressivas para controlar a narração, além de melhorias gerais na naturalidade, no controle e na capacidade multilíngue.

Acesse o guia Text-to-Speech para conferir a cobertura completa de recursos e funcionalidades.

gemini-3.1-flash-tts-preview

Propriedade Descrição
Código do modelo gemini-3.1-flash-tts-preview
Tipos de dados aceitos

Entradas (link em inglês)

Texto

Saída

Áudio

Limites de token[*]

Limite de tokens de entrada

8.192

Limite de token de saída

16.384

Recursos

Geração de áudio

Compatível

Armazenamento em cache

incompatível

Execução de código

incompatível

Pesquisa de arquivos

Não aceito

Chamada de função

incompatível

Embasamento com o Google Maps

incompatível

Geração de imagens

incompatível

API Live

incompatível

Embasamento da pesquisa

incompatível

Respostas estruturadas

incompatível

Raciocínio

incompatível

Contexto do URL

incompatível

Opções de consumo

API em lote

Compatível

Inferência flexível

incompatível

Inferência de prioridade

incompatível

Versões
Leia os padrões de versão do modelo para mais detalhes.
  • gemini-3.1-flash-tts-preview
Última atualização Abril de 2026
Card de modelo Card de modelo