В этом руководстве представлены все модели, доступные через API Gemini.
Близнецы 3
Стабильный
Вспышка Gemini 3.5
Наиболее интеллектуальная модель для достижения устойчивых результатов в задачах агентного управления и программирования.
Стабильный
В этом руководстве представлены все модели, доступные через API Gemini.
Наиболее интеллектуальная модель для достижения устойчивых результатов в задачах агентного управления и программирования.
Стабильный
Характеристики уровня Frontier, сопоставимые с более крупными моделями, но по гораздо более низкой цене.
Стабильный
Мощная и высокоэффективная программа для создания и редактирования изображений, оптимизированная для быстрой работы и обработки больших объемов данных.
Стабильный
Сверхнизкая задержка и экономичное создание и редактирование изображений, разработанные для интерактивных сценариев с большим объемом данных.
Стабильный
Современные модели генерации и редактирования изображений для создания контекстно-зависимых исходных изображений.
Стабильный
Высокий уровень интеллекта, сложные навыки решения проблем, а также мощные возможности кодирования действий агентов и атмосферы.
Предварительный просмотр
Характеристики уровня Frontier, сопоставимые с более крупными моделями, но по гораздо более низкой цене.
Предварительный просмотр
Модель перевода речи в речь в реальном времени с низкой задержкой, поддерживающая более 70 языков.
Новый предварительный просмотр
Высококачественная модель Live API с низкой задержкой для диалогов в реальном времени и приложений искусственного интеллекта, ориентированных на голосовое управление.
Новый предварительный просмотр
Мощная система генерации речи с низкой задержкой.
Новый предварительный просмотр
Быстрое создание и редактирование видеороликов в разговорном стиле. Преобразуйте текст и изображения в видео и улучшайте результат с помощью естественного языка.
Новый предварительный просмотр
Наша модель с наилучшим соотношением цены и производительности предназначена для задач с низкой задержкой и большим объемом данных, требующих логического мышления.
Современные средства для генерации и редактирования изображений, разработанные для быстрых и эффективных рабочих процессов.
Оптимизировано для диалоговых агентов, работающих в режиме реального времени, с потоковой передачей звука за доли секунды.
Управляемая генерация аудиоконтента из текста с точным контролем стиля и темпа.
Самая быстрая и экономичная мультимодальная модель в семействе 2.5.
Наша самая передовая модель для решения сложных задач, обладающая глубокими возможностями логического мышления и программирования.
Высокоточный синтез речи, оптимизированный для обеспечения высокого качества в структурированных рабочих процессах, таких как подкасты и аудиокниги.
В этом разделе представлены все аудиомодели, включая те, которые могут быть уже перечислены в других разделах.
Наша высококачественная модель передачи аудиосигнала с низкой задержкой (A2A) разработана для диалогов в реальном времени и приложений искусственного интеллекта, ориентированных на голосовую обработку.
Мощная система генерации речи с низкой задержкой, обеспечивающая естественное звучание, управляемые подсказки и новые выразительные аудиометки для точного контроля над повествованием.
Наша флагманская модель Live API для голосовых и видеоагентов с низкой задержкой и двунаправленным воспроизведением звука.
Быстрое и управляемое преобразование текста в речь для приложений с низкой задержкой, экономичных приложений и голосовых помощников в режиме реального времени.
Высокоточный синтез речи, оптимизированный для обеспечения высокого качества в структурированных рабочих процессах, таких как подкасты и аудиокниги.
В этом разделе представлены все модели генеративного медиаконтента, включая те, которые могут быть уже перечислены в других разделах.
Высокоэффективное создание визуальных образов в промышленных масштабах, сочетающее в себе интеллектуальные возможности серии Gemini 3 с молниеносной скоростью генерации.
Разработанный как высокоэффективный инструмент в семействе программ для генерации изображений, он предлагает сверхнизкую задержку и экономичное создание и редактирование изображений.
Современные средства создания кинематографического видео с расширенными возможностями творческого управления и синхронизированным звуком.
Профессиональный движок для дизайна с логическим ядром, обеспечивающий визуализацию студийного качества 4K, сложные макеты и точную отрисовку текста.
Высокоэффективное, недорогое и ориентированное на разработчиков решение для создания, редактирования видео и управления кинематографическим процессом от семейства Veo 3.1.
Быстрое создание и редактирование видеороликов в разговорном стиле. Преобразуйте текст и изображения в видео и улучшайте результат с помощью естественного языка.
Современные средства для генерации и редактирования изображений, разработанные для быстрых и эффективных рабочих процессов.
Модель преобразования текста в изображение, отличающаяся быстрой и сверхбыстрой генерацией и исключительной четкостью до разрешения 2K.
В этом разделе представлены все модели генерации музыки, включая те, которые могут быть уже перечислены в других разделах.
Наша флагманская модель генерации музыки, оптимизированная для полноформатных композиций со сложной структурной целостностью.
Оптимизировано для создания коротких музыкальных клипов, зацикленных фрагментов и превью продолжительностью до 30 секунд.
Высокоточная модель генерации музыки, обеспечивающая детальный творческий контроль и возможности потоковой передачи в реальном времени.
Специализированная модель, способная «видеть» цифровой экран и выполнять действия пользовательского интерфейса, такие как щелчки мышью, ввод текста и навигация, для автоматизации сложных задач в браузере.
Агентная модель, которая автономно планирует и выполняет многоэтапное исследование сотен источников для создания интерактивных отчетов со ссылками на источники.
Максимальная полнота охвата для автоматизированного сбора и анализа контекста на основе сотен источников.
Универсальный управляемый агент, который автономно планирует, анализирует, выполняет код, управляет файлами и просматривает веб-страницы в защищенной, изолированной среде Linux.
Наша первая мультимодальная модель встраивания, отображающая текст, изображения, видео, аудио и PDF-файлы в единое пространство встраивания для продвинутых систем семантического поиска и RAG-систем.
Многомерные векторные представления для продвинутого семантического поиска, классификации текста и систем RAG.
Усовершенствованная модель воплощенного мышления, которая понимает физическое пространство и планирует многоэтапные задачи для роботизированных агентов, обладающих новыми возможностями, такими как считывание показаний приборов, улучшенное пространственное и физическое мышление.
Наша рабочая лошадка второго поколения с функциями нового поколения и улучшенными возможностями, включая превосходную скорость, использование встроенных инструментов и контекстное окно для 1 миллиона токенов.
Наша самая быстрая модель второго поколения, оптимизированная для экономичности и низкой задержки.
Наша наиболее экономичная многомодальная модель, обеспечивающая самую высокую производительность для часто выполняемых задач с небольшим весом.
Наша передовая модель рассуждений с расширенным многомодальным пониманием.
Модели Gemini доступны в стабильной , предварительной , последней и экспериментальной версиях.
Указывает на конкретную стабильную модель. Стабильные модели обычно не меняются. Большинство приложений, используемых в производственной среде, должны использовать конкретную стабильную модель.
Например: gemini-3.5-flash .
Указывает на предварительную модель, которая может использоваться в производственной среде. В предварительных моделях обычно включена оплата, могут быть более жесткие ограничения по количеству запросов, и они будут выведены из эксплуатации как минимум за 2 недели.
Например: gemini-2.5-flash-preview-09-2025 .
Указывает на последнюю версию для конкретного варианта модели. Это может быть стабильная, предварительная или экспериментальная версия. Этот псевдоним будет автоматически заменяться при каждом новом выпуске конкретного варианта модели. В случае критических изменений, за две недели до изменения версии, отстающей от последней, будет отправлено уведомление по электронной почте.
Например: gemini-flash-latest .
Это указывает на экспериментальную модель, которая, как правило, не подходит для использования в производственной среде и имеет более жесткие ограничения по количеству запросов. Мы выпускаем экспериментальные модели, чтобы собрать отзывы и быстро предоставить разработчикам наши последние обновления.
Экспериментальные модели нестабильны, и доступность конечных точек модели может меняться.
Для получения информации об устаревших моделях посетите страницу устаревания Gemini .
Если не указано иное, контент на этой странице предоставляется по лицензии Creative Commons "С указанием авторства 4.0", а примеры кода – по лицензии Apache 2.0. Подробнее об этом написано в правилах сайта. Java – это зарегистрированный товарный знак корпорации Oracle и ее аффилированных лиц.
Последнее обновление: 2026-07-20 UTC.