Ограничение частоты запросов

Ограничения частоты запросов регулируют число запросов, которые вы можете отправлять к Gemini API за определенный период времени. Ограничения помогают поддерживать справедливое использование, защищать от злоупотреблений и обеспечивать производительность системы для всех пользователей.

Как посмотреть действующие ограничения частоты запросов в AI Studio

Как работают ограничения частоты запросов

Ограничения частоты запросов обычно измеряются по трем параметрам:

  • Запросы в минуту (RPM)
  • Токенов в минуту (входные данные) (TPM)
  • Запросов в день (RPD)

Ваше использование оценивается по каждому ограничению, и превышение любого из них приведет к ошибке ограничения частоты запросов. Например, если ограничение RPM составляет 20, то при отправке 21 запроса в течение минуты возникнет ошибка, даже если вы не превысили ограничение TPM или другие лимиты.

Ограничения частоты запросов применяются для каждого проекта, а не для каждого ключа API. Квоты на количество запросов в день (RPD) сбрасываются в полночь по тихоокеанскому времени.

Лимиты зависят от используемой модели. Некоторые лимиты применяются только к определенным моделям. Например, показатель "Изображений в минуту" (IPM) рассчитывается только для моделей, способных генерировать изображения (Nano Banana), но концептуально похож на TPM. Для других моделей может действовать ограничение на количество токенов в день.

Для экспериментальных и предварительных моделей действуют более строгие ограничения на количество запросов.

Ограничения частоты запросов на основе расходов

Помимо лимитов на количество запросов в минуту (RPM) и токенов в минуту (TPM), Gemini API также применяет ограничения частоты запросов на основе расходов, чтобы защитить пользователей от неожиданных списаний. Применяются ли эти лимиты к вашему аккаунту, зависит от истории платежей и уровня использования.

В таблице ниже приведены лимиты на основе расходов для каждого уровня использования. Ограничения действуют в течение 10 минут. Применяются ли эти ограничения к вашему аккаунту, зависит от истории платежей и статуса аккаунта.

Уровень использования Лимит расходов (за 10 минут)
Бесплатно Н/Д
Уровень 1 10 гонконгских долларов
Уровень 2 50 гонконгских долларов
Уровень 3 200 $

Если вы достигли ограничения частоты запросов на основе расходов, API вернет ошибку 429 RESOURCE_EXHAUSTED. Чтобы решить проблему:

  • Подождите и повторите попытку через некоторое время.
  • Уменьшите частоту дорогостоящих запросов, например используя меньшие окна контекста или более короткие ответы.
  • Если вы регулярно достигаете этого лимита при обычном использовании, запросите увеличение ограничения частоты запросов.

Уровни использования

Ограничения частоты запросов связаны с уровнем использования проекта. По мере того как вы будете чаще использовать API и тратить больше средств, ваш уровень будет автоматически повышаться, а лимиты частоты запросов – увеличиваться.

Квалификация для уровней 2 и 3 основана на общем объеме расходов на сервисы Google Cloud (включая, помимо прочего, Gemini API) для платежного аккаунта, связанного с вашим проектом.

Уровень использования Квалификация Ограничение на уровне платежного тарифа
Бесплатно Активный проект или пробная версия Н/Д
Уровень 1 Настройте и свяжите активный платежный аккаунт 250 гонконгских долларов
Уровень 2 Выплата 100 долл. США + 3 дня с момента первого успешного платежа 2000 долл. США
Уровень 3 1000 долларов США + 30 дней с момента первой успешной оплаты 20 000–100 000 долл. США и более

Обычно, если вы соответствуете требованиям, мы одобряем запрос на повышение уровня. Однако в редких случаях мы можем отказать в повышении уровня, если в ходе проверки будут выявлены другие факторы.

Эта система помогает поддерживать безопасность и целостность платформы Gemini API для всех пользователей.

Ограничения частоты запросов в Gemini API

Ограничения частоты запросов зависят от разных факторов, например от уровня использования, и их можно посмотреть в Google AI Studio. По мере того как меняется ваш уровень и статус аккаунта, ограничения частоты запросов будут обновляться автоматически.

Как посмотреть действующие ограничения частоты запросов в AI Studio

Указанные ограничения скорости не гарантируются, а фактическая пропускная способность может отличаться.

Ограничения частоты запросов на определение приоритета

Потребление с приоритетом имеет собственные ограничения частоты запросов, даже если оно учитывается в общем лимите скорости интерактивного трафика. Ограничения частоты запросов по умолчанию: 0,3 от стандартного ограничения частоты запросов для каждой модели и уровня

Ограничения частоты запросов для пакетного API

Пакетные запросы API имеют собственные ограничения на частоту, которые отличаются от ограничений для обычных вызовов API.

  • Одновременные пакетные запросы: 100
  • Максимальный размер входного файла: 2 ГБ.
  • Ограничение на хранение файлов: 20 ГБ.
  • Токены в очереди для каждой модели. В таблице Токены в очереди для пакетной обработки указано максимальное количество токенов, которые можно поставить в очередь для пакетной обработки во всех активных пакетных заданиях для определенной модели.

Уровень 1

Модель Токены, добавленные в очередь пакетной обработки
Модели для создания текста
Gemini 3.1 Pro Preview 5 000 000
Gemini 3.5 Flash-Lite 10 000 000
Gemini 3.8 Flash 3 000 000
Gemini 3.1 Flash Lite 10 000 000
Gemini 3.1 Flash Lite (предварительная версия) 10 000 000
Gemini 3.6 Flash 3 000 000
Gemini 2.5 Pro 5 000 000
Gemini 2.5 Pro TTS 25 000
Gemini 2.5 Flash 3 000 000
Предварительная версия Gemini 2.5 Flash 3 000 000
Предварительный просмотр изображений Gemini 2.5 Flash 3 000 000
Gemini 2.5 Flash TTS 100 000
Gemini 2.5 Flash Lite 10 000 000
Gemini 2.5 Flash Lite (предварительная версия) 10 000 000
Gemini 2.0 Flash 10 000 000
Gemini 2.0 Flash Image 3 000 000
Gemini 2.0 Flash Lite 10 000 000
Мультимодальные модели генерации
Gemini 3.1 Flash Image Preview 🍌 1 000 000
Gemini 3.1 Flash Lite Image 🍌 2 000 000
Gemini 3 Pro Image Preview 🍌 2 000 000
Модели для встраивания
Встраивание Gemini 500 000

Уровень 2

Модель Токены, добавленные в очередь пакетной обработки
Модели для создания текста
Gemini 3.1 Pro Preview 500 000 000
Gemini 3.5 Flash-Lite 500 000 000
Gemini 3.1 Flash Lite 500 000 000
Gemini 3.1 Flash Lite (предварительная версия) 500 000 000
Gemini 3.8 Flash 400 000 000
Gemini 3.6 Flash 400 000 000
Gemini 2.5 Pro 500 000 000
Gemini 2.5 Pro TTS 100 000
Gemini 2.5 Flash 400 000 000
Предварительная версия Gemini 2.5 Flash 400 000 000
Предварительный просмотр изображений Gemini 2.5 Flash 400 000 000
Gemini 2.5 Flash TTS 100 000
Gemini 2.5 Flash Lite 500 000 000
Gemini 2.5 Flash Lite (предварительная версия) 500 000 000
Gemini 2.0 Flash 1 000 000 000
Gemini 2.0 Flash Image 400 000 000
Gemini 2.0 Flash Lite 1 000 000 000
Мультимодальные модели генерации
Gemini 3.1 Flash Image Preview 🍌 250 000 000
Gemini 3.1 Flash Lite Image 🍌 270 000 000
Gemini 3 Pro Image Preview 🍌 270 000 000
Модели для встраивания
Встраивание Gemini 5 000 000

Уровень 3

Модель Токены, добавленные в очередь пакетной обработки
Модели для создания текста
Gemini 3.1 Pro Preview 1 000 000 000
Gemini 3.5 Flash-Lite 1 000 000 000
Gemini 3.1 Flash Lite 1 000 000 000
Gemini 3.1 Flash Lite (предварительная версия) 1 000 000 000
Gemini 3.8 Flash 1 000 000 000
Gemini 3.6 Flash 1 000 000 000
Gemini 2.5 Pro 1 000 000 000
Gemini 2.5 Pro TTS 1 000 000
Gemini 2.5 Flash 1 000 000 000
Предварительная версия Gemini 2.5 Flash 1 000 000 000
Предварительный просмотр изображений Gemini 2.5 Flash 1 000 000 000
Gemini 2.5 Flash TTS 4 000 000
Gemini 2.5 Flash Lite 1 000 000 000
Gemini 2.5 Flash Lite (предварительная версия) 1 000 000 000
Gemini 2.0 Flash 5 000 000 000
Gemini 2.0 Flash Image 1 000 000 000
Gemini 2.0 Flash Lite 5 000 000 000
Мультимодальные модели генерации
Gemini 3.1 Flash Image Preview 🍌 750 000 000
Gemini 3.1 Flash Lite Image 🍌 1 000 000 000
Gemini 3 Pro Image Preview 🍌 1 000 000 000
Модели для встраивания
Встраивание Gemini 10 000 000

Как перейти на следующий уровень

Чтобы перейти с бесплатного уровня на платный, сначала нужно настроить оплату в AI Studio.

Когда ваш проект будет соответствовать определенным критериям, он автоматически перейдет на следующий уровень. Переход с бесплатного уровня на уровень 1 обычно происходит мгновенно, а на более высокие уровни – в течение 10 минут. Чтобы проверить уровень, перейдите на страницу проектов в AI Studio.

Как запросить увеличение лимита на количество запросов

Для каждого варианта модели задано ограничение частоты запросов (запросов в минуту, RPM). Подробнее об ограничениях на частоту запросов в AI Studio…

Как запросить увеличение лимита частоты запросов для платного уровня

Мы не гарантируем, что увеличим лимит, но постараемся рассмотреть ваш запрос.