Ratenlimits

Ratenbegrenzungen regeln die Anzahl der Anfragen, die Sie innerhalb eines bestimmten Zeitraums an die Gemini API senden können. Diese Limits tragen dazu bei, dass die Nutzung fair bleibt, schützen vor Missbrauch und sorgen dafür, dass die Systemleistung für alle Nutzer erhalten bleibt.

Aktive Ratenbeschränkungen in AI Studio ansehen

So funktionieren Ratenbegrenzungen

Ratenbeschränkungen werden in der Regel anhand von drei Dimensionen gemessen:

  • Anfragen pro Minute (RPM)
  • Tokens pro Minute (Eingabe) (TPM)
  • Anfragen pro Tag (RPD)

Ihre Nutzung wird anhand der einzelnen Limits bewertet. Wenn Sie eines der Limits überschreiten, wird ein Ratenbegrenzungsfehler ausgelöst. Wenn Ihr RPM-Limit beispielsweise 20 beträgt, führt das Senden von 21 Anfragen innerhalb einer Minute zu einem Fehler, auch wenn Sie Ihr TPM-Limit oder andere Limits nicht überschritten haben.

Ratenlimits werden pro Projekt und nicht pro API-Schlüssel angewendet. Kontingente für RPD (Requests Per Day, RPD) werden um Mitternacht (Pacific Time) zurückgesetzt.

Die Limits variieren je nach verwendetem Modell. Einige Limits gelten nur für bestimmte Modelle. „Bilder pro Minute“ (Images per minute, IPM) wird beispielsweise nur für Modelle berechnet, die KI-generierte Bilder generieren können (Nano Banana), ist aber konzeptionell ähnlich wie TPM. Bei anderen Modellen gilt möglicherweise ein Tokenlimit pro Tag.

Die Ratenbegrenzungen sind für experimentelle Modelle und Vorschau-Modelle strenger.

Ausgabenbasierte Ratenlimits

Zusätzlich zu den Limits für Anfragen pro Minute (RPM) und Tokens pro Minute (TPM) werden bei der Gemini API ausgabenbasierte Ratenbegrenzungen erzwungen, um vor unerwarteten Gebühren zu schützen. Ob diese Limits für Ihr Konto gelten, hängt von Ihrem Abrechnungsverlauf und Ihrer Nutzungsstufe ab.

In der folgenden Tabelle sind die ausgabenbasierten Ratenbegrenzungen für die einzelnen Nutzungsebenen aufgeführt. Diese Limits werden in einem fortlaufenden 10‑Minuten-Zeitfenster ausgewertet. Ob diese Limits für Ihr Konto gelten, hängt von Ihrem Abrechnungsverlauf und Ihrem Kontostatus ab.

Nutzungsstufe Ausgabenlimit (pro 10 Minuten)
Kostenlos –
Stufe 1 10 $
Tier 2 50 $
Tier 3 200 $

Wenn Sie ein ausgabenbasiertes Ratenlimit erreichen, gibt die API einen 429 RESOURCE_EXHAUSTED-Fehler zurück. So beheben Sie dies:

  • Warten Sie kurz und versuchen Sie es dann noch einmal.
  • Rate teurer Anfragen reduzieren, z. B. durch die Verwendung kleinerer Kontextfenster oder kürzerer Ausgaben.
  • Wenn Sie dieses Limit bei normaler Nutzung regelmäßig erreichen, beantragen Sie eine Erhöhung des Ratenlimits.

Nutzungsstufen

Ratenbegrenzungen sind an die Nutzungsstufe des Projekts gebunden. Wenn Ihre API-Nutzung und Ihre Ausgaben steigen, werden Sie automatisch auf eine höhere Stufe mit höheren Ratenbegrenzungen hochgestuft.

Die Voraussetzungen für die Stufen 2 und 3 basieren auf den kumulativen Gesamtausgaben für Google Cloud-Dienste (einschließlich, aber nicht beschränkt auf die Gemini API) für das mit Ihrem Projekt verknüpfte Rechnungskonto.

Nutzungsstufe Qualifikation Obergrenze für die Abrechnungsstufe
Kostenlos Aktives Projekt oder kostenloser Testzeitraum –
Stufe 1 Aktives Rechnungskonto einrichten und verknüpfen 250 $
Tier 2 100 $ + 3 Tage seit erster eingegangener Zahlung 2.000 $
Tier 3 1.000 $ + 30 Tage seit erster eingegangener Zahlung 20.000 $ bis 100.000 $ und mehr

Die Erfüllung der angegebenen Qualifikationskriterien reicht in der Regel für die Genehmigung aus. In seltenen Fällen kann ein Upgradeantrag jedoch aufgrund anderer Faktoren abgelehnt werden, die während der Überprüfung festgestellt wurden.

Dieses System trägt dazu bei, die Sicherheit und Integrität der Gemini API-Plattform für alle Nutzer aufrechtzuerhalten.

Ratenbegrenzungen für die Gemini API

Die Ratenbeschränkungen hängen von verschiedenen Faktoren ab, z. B. von Ihrer Nutzungsstufe, und können in Google AI Studio eingesehen werden. Ihre Ratenbegrenzungen werden automatisch aktualisiert, wenn sich Ihr Tier und Ihr Kontostatus im Laufe der Zeit ändern.

Aktive Ratenbeschränkungen in AI Studio ansehen

Die angegebenen Ratenlimits sind nicht garantiert und die tatsächliche Kapazität kann variieren.

Ratenlimits für Prioritätsinferenz

Für die Prioritätsnutzung gelten eigene Ratenbegrenzungen, auch wenn die Nutzung auf die Ratenbegrenzungen für den gesamten interaktiven Traffic angerechnet wird. Die Standardratenlimits sind: 0,3-mal das Standardratenlimit für jedes Modell und jede Stufe.

Ratenbegrenzungen für die Batch API

Für Batch-API-Anfragen gelten eigene Ratenbegrenzungen, die sich von denen für Nicht-Batch-API-Aufrufe unterscheiden.

  • Gleichzeitige Batchanfragen:100
  • Maximale Größe der Eingabedatei:2 GB
  • Dateispeicherlimit:20 GB
  • In die Warteschlange gestellte Tokens pro Modell:In der Tabelle In die Warteschlange gestellte Batch-Tokens ist die maximale Anzahl von Tokens aufgeführt, die für die Batchverarbeitung in allen aktiven Batchjobs für ein bestimmtes Modell in die Warteschlange gestellt werden können.

Preisstufe 1

Modell In die Warteschlange gestellte Batch-Tokens
Textausgabemodelle
Gemini 3.1 Pro (Vorabversion) 5.000.000
Gemini 3.5 Flash-Lite 10.000.000
Gemini 3.8 Flash 3.000.000
Gemini 3.1 Flash Lite 10.000.000
Gemini 3.1 Flash Lite (Vorabversion) 10.000.000
Gemini 3.6 Flash 3.000.000
Gemini 2.5 Pro 5.000.000
Gemini 2.5 Pro TTS 25.000
Gemini 2.5 Flash 3.000.000
Gemini 2.5 Flash (Vorabversion) 3.000.000
Gemini 2.5 Flash Image (Vorabversion) 3.000.000
Gemini 2.5 Flash TTS 100.000
Gemini 2.5 Flash Lite 10.000.000
Gemini 2.5 Flash Lite (Vorabversion) 10.000.000
Gemini 2.0 Flash 10.000.000
Gemini 2.0 Flash Image 3.000.000
Gemini 2.0 Flash Lite 10.000.000
Multimodale generative Modelle
Gemini 3.1 Flash Image (Vorabversion) 🍌 1.000.000
Gemini 3.1 Flash Lite-Image 🍌 2.000.000
Gemini 3 Pro Image (Vorabversion) 🍌 2.000.000
Einbettungsmodelle
Gemini Embedding 500.000

Preisstufe 2

Modell In die Warteschlange gestellte Batch-Tokens
Textausgabemodelle
Gemini 3.1 Pro (Vorabversion) 500.000.000
Gemini 3.5 Flash-Lite 500.000.000
Gemini 3.1 Flash Lite 500.000.000
Gemini 3.1 Flash Lite (Vorabversion) 500.000.000
Gemini 3.8 Flash 400.000.000
Gemini 3.6 Flash 400.000.000
Gemini 2.5 Pro 500.000.000
Gemini 2.5 Pro TTS 100.000
Gemini 2.5 Flash 400.000.000
Gemini 2.5 Flash (Vorabversion) 400.000.000
Gemini 2.5 Flash Image (Vorabversion) 400.000.000
Gemini 2.5 Flash TTS 100.000
Gemini 2.5 Flash Lite 500.000.000
Gemini 2.5 Flash Lite (Vorabversion) 500.000.000
Gemini 2.0 Flash 1.000.000.000
Gemini 2.0 Flash Image 400.000.000
Gemini 2.0 Flash Lite 1.000.000.000
Multimodale generative Modelle
Gemini 3.1 Flash Image (Vorabversion) 🍌 250.000.000
Gemini 3.1 Flash Lite-Image 🍌 270.000.000
Gemini 3 Pro Image (Vorabversion) 🍌 270.000.000
Einbettungsmodelle
Gemini Embedding 5.000.000

Ebene 3

Modell In die Warteschlange gestellte Batch-Tokens
Textausgabemodelle
Gemini 3.1 Pro (Vorabversion) 1.000.000.000
Gemini 3.5 Flash-Lite 1.000.000.000
Gemini 3.1 Flash Lite 1.000.000.000
Gemini 3.1 Flash Lite (Vorabversion) 1.000.000.000
Gemini 3.8 Flash 1.000.000.000
Gemini 3.6 Flash 1.000.000.000
Gemini 2.5 Pro 1.000.000.000
Gemini 2.5 Pro TTS 1.000.000
Gemini 2.5 Flash 1.000.000.000
Gemini 2.5 Flash (Vorabversion) 1.000.000.000
Gemini 2.5 Flash Image (Vorabversion) 1.000.000.000
Gemini 2.5 Flash TTS 4.000.000
Gemini 2.5 Flash Lite 1.000.000.000
Gemini 2.5 Flash Lite (Vorabversion) 1.000.000.000
Gemini 2.0 Flash 5.000.000.000
Gemini 2.0 Flash Image 1.000.000.000
Gemini 2.0 Flash Lite 5.000.000.000
Multimodale generative Modelle
Gemini 3.1 Flash Image (Vorabversion) 🍌 750.000.000
Gemini 3.1 Flash Lite-Image 🍌 1.000.000.000
Gemini 3 Pro Image (Vorabversion) 🍌 1.000.000.000
Einbettungsmodelle
Gemini Embedding 10.000.000

Upgrade auf die nächste Stufe

Wenn Sie von der kostenlosen Stufe zu einer kostenpflichtigen Stufe wechseln möchten, müssen Sie zuerst die Abrechnung in AI Studio einrichten.

Sobald Ihr Projekt die angegebenen Kriterien erfüllt, wird es automatisch auf die nächste Stufe hochgestuft. Stufen-Upgrades von der kostenlosen Stufe auf Stufe 1 werden in der Regel sofort wirksam. Nachfolgende Stufen-Upgrades werden innerhalb von 10 Minuten wirksam. Rufen Sie in AI Studio die Seite „Projekte“ auf, um Ihre Stufen zu prüfen.

Erhöhung der Ratenbegrenzung beantragen

Für jede Modellvariante gilt eine zugehörige Ratenbegrenzung (Anfragen pro Minute, RPM). Weitere Informationen zu diesen Ratenlimits finden Sie auf der Seite AI Studio-Ratenlimit.

Erhöhung des Ratenlimits für kostenpflichtige Stufe beantragen

Wir können keine Garantie für eine Erhöhung Ihres Ratenlimits geben, werden aber unser Bestes tun, um Ihren Antrag zu prüfen.