Предварительная версия Gemini 3.1 Flash TTS (преобразование текста в речь)

Модель Gemini 3.1 Flash TTS Preview обеспечивает мощное генерирование речи с низкой задержкой, естественным звучанием, управляемыми запросами и выразительными аудиотегами для точного управления повествованием.

Документация

Модель Gemini 3.1 Flash TTS Preview поддерживает выразительные аудиотеги, которые позволяют управлять повествованием. Кроме того, она стала более естественной, управляемой и многоязычной.

Подробную информацию о функциях и возможностях синтеза речи можно найти в руководстве по синтезу речи.

gemini-3.1-flash-tts-preview

Свойство Описание
Код модели gemini-3.1-flash-tts-preview
Поддерживаемые типы данных

Входные данные

Текст

Выходные данные

Аудио

Ограничения на количество токенов[*]

Лимит на количество входных токенов

8192

Лимит на количество выходных токенов

16 384

Возможности

Генератор аудио

Что пользователь может

Кеширование

Чего пользователь не может

Выполнение кода

Чего пользователь не может

Поиск файлов

Не поддерживается

Вызов функций

Чего пользователь не может

Обоснование с Google Картами

Чего пользователь не может

Генерирование изображений

Чего пользователь не может

Live API

Чего пользователь не может

Находите информацию из надежных источников

Чего пользователь не может

Структурированные выходные данные

Чего пользователь не может

Размышления

Чего пользователь не может

Контекст URL

Чего пользователь не может

Варианты просмотра

Batch API

Что пользователь может

Гибкий инференс

Чего пользователь не может

Определение приоритета

Чего пользователь не может

Версии
Подробнее о шаблонах версий моделей…
  • gemini-3.1-flash-tts-preview
Последнее обновление Апрель 2026 г.
Карточка модели Карточка модели