In diesem Leitfaden werden alle Modelle vorgestellt, die über die Gemini API verfügbar sind.
Gemini 3
Stabil
Gemini 3.6 Flash
Unser neuestes Modell, das Geschwindigkeit und Intelligenz vereint und so eine hohe Leistung bei agentischen und multimodalen Aufgaben bietet.
Stabil
Gemini 3.5 Flash
Das intelligenteste Modell für dauerhafte Spitzenleistung bei agentischen und Coding-Aufgaben.
Stabil
Gemini 3.5 Flash-Lite
Unser schnellstes und kosteneffizientestes Modell der 3.5-Klasse für die Ausführung mit hohem Durchsatz.
Stabil
Gemini 3.1 Flash-Lite
Leistung der Spitzenklasse, die mit größeren Modellen mithalten kann, zu einem Bruchteil der Kosten.
Stabil
Nano Banana 2
Leistungsstarke und hocheffiziente Bildgenerierung und ‑bearbeitung, optimiert für Geschwindigkeit und Anwendungsfälle mit hohem Volumen.
Stabil
Nano Banana 2 Lite
Extrem niedrige Latenz und kostengünstige Bildgenerierung und ‑bearbeitung, entwickelt für interaktive Anwendungsfälle mit hohem Volumen.
Stabil
Nano Banana Pro
Hochmoderne Modelle für die Bildgenerierung und ‑bearbeitung für die kontextbezogene native Bildgenerierung.
Stabil
Vorschau
Gemini 3.1 Pro
Fortschrittliche Intelligenz, komplexe Problemlösungsfähigkeiten und leistungsstarke agentische und Vibe-Coding-Funktionen.
Vorschau
Gemini 3 Flash
Leistung der Spitzenklasse, die mit größeren Modellen mithalten kann, zu einem Bruchteil der Kosten.
Vorschau
Gemini 3.5 Live Translate
Modell für die latenzarme Echtzeit-Sprachübersetzung, das mehr als 70 Sprachen unterstützt.
Neue Vorschau
Gemini 3.1 Flash Live
Hochwertiges, latenzarmes Live API-Modell für Echtzeit-Dialoge und KI-Anwendungen mit Sprachsteuerung.
Neue Vorschau
Gemini 3.1 Flash TTS
Leistungsstarke, latenzarme Spracherzeugung.
Neue Vorschau
Gemini Omni Flash
Schnelle, dialogbasierte Videogenerierung und ‑bearbeitung. Verwandeln Sie Text und Bilder in Videos und optimieren Sie die Ergebnisse mit natürlicher Sprache.
Neue Vorschau
Gemini 2.5 Flash
Gemini 2.5 Flash
Unser bestes Modell in Bezug auf Preis-Leistungs-Verhältnis für latenzarme Aufgaben mit hohem Volumen, die logisches Denken erfordern.
Nano Banana
Hochmoderne native Bildgenerierung und ‑bearbeitung, entwickelt für schnelle, kreative Workflows.
Gemini 2.5 Flash Live Live (Vorabversion)
Optimiert für dialogbasierte Echtzeit-KI-Agenten mit nativem Audio-Streaming im Sub-Sekunden-Bereich.
Gemini 2.5 Flash TTS Vorabversion
Steuerbare Text-zu-Sprache-Audio-Generierung mit detaillierter Steuerung von Stil und Tempo.
Gemini 2.5 Flash-Lite
Gemini 2.5 Flash-Lite
Das schnellste und kostengünstigste multimodale Modell der 2.5-Familie.
Gemini 2.5 Pro
Gemini 2.5 Pro
Unser fortschrittlichstes Modell für komplexe Aufgaben mit umfassenden Funktionen für logisches Denken und Programmierung.
Gemini 2.5 Pro TTS Vorabversion
Hochwertige Sprachsynthese, optimiert für Qualität in strukturierten Workflows wie Podcasts und Hörbüchern.
Audiomodelle
Dieser Abschnitt enthält alle Audiomodelle, einschließlich derer, die möglicherweise bereits in anderen Abschnitten aufgeführt sind.
Gemini 3.1 Flash Live Vorabversion
Unser hochwertiges, latenzarmes Audio-zu-Audio-Modell (A2A), das für Echtzeit-Dialoge und KI-Anwendungen mit Sprachsteuerung entwickelt wurde.
Gemini 3.1 Flash TTS Vorabversion
Leistungsstarke, latenzarme Spracherzeugung mit natürlichen Ausgaben, steuerbaren Prompts und neuen ausdrucksstarken Audio-Tags für eine präzise Steuerung der Erzählung.
Gemini 2.5 Flash Live Live (Vorabversion)
Unser Flaggschiff-Live API-Modell für latenzarme, bidirektionale Sprach- und Video-KI-Agenten mit nativem Audio-Reasoning.
Gemini 2.5 Flash TTS Vorabversion
Schnelle und steuerbare Text-zu-Sprache-Funktion für latenzarme, kostengünstige Anwendungen und Echtzeit-Assistenten.
Gemini 2.5 Pro TTS Vorabversion
Hochwertige Sprachsynthese, optimiert für Qualität in strukturierten Workflows wie Podcasts und Hörbüchern.
Generative Medienmodelle
Dieser Abschnitt enthält alle generativen Medienmodelle, einschließlich derer, die möglicherweise bereits in anderen Abschnitten aufgeführt sind.
Nano Banana 2
Hocheffiziente visuelle Erstellung im Produktionsmaßstab, die die Intelligenz der Gemini 3-Serie mit blitzschnellen Generierungsgeschwindigkeiten kombiniert.
Nano Banana 2 Lite
Entwickelt als Effizienzexperte der Bildgenerierungsfamilie mit extrem niedriger Latenz und kostengünstiger Bildgenerierung und ‑bearbeitung.
Veo 3.1 (Vorabversion)
Hochmoderne filmische Videogenerierung mit erweiterten kreativen Steuerungselementen und nativ synchronisiertem Audio.
Nano Banana Pro
Eine professionelle Design-Engine mit einem Reasoning-Kern für 4K-Visuals in Studioqualität, komplexe Layouts und präzise Textwiedergabe.
Veo 3.1 Lite (Vorabversion)
Hocheffiziente, kostengünstige Videogenerierung, ‑bearbeitung und filmische Steuerung für Entwickler aus der Veo 3.1-Familie.
Gemini Omni Flash (Vorabversion)
Schnelle, dialogbasierte Videogenerierung und ‑bearbeitung. Verwandeln Sie Text und Bilder in Videos und optimieren Sie die Ergebnisse mit natürlicher Sprache.
Nano Banana
Hochmoderne native Bildgenerierung und ‑bearbeitung, entwickelt für schnelle, kreative Workflows.
Imagen 4 (verworfen)
Das bisher beste Text-zu-Bild-Modell mit schneller und ultraschneller Generierung und außergewöhnlicher Klarheit bis zu einer Auflösung von 2K.
Modelle für die Musikgenerierung
Dieser Abschnitt enthält alle Modelle für die Musikgenerierung, einschließlich derer, die möglicherweise bereits in anderen Abschnitten aufgeführt sind.
Lyria 3 Pro (Vorabversion)
Unser Flaggschiff-Modell für die Musikgenerierung, optimiert für Songs in voller Länge mit komplexer struktureller Kohärenz.
Lyria 3 Clip (Vorabversion)
Optimiert für die Generierung kurzer Musikclips, Loops und Vorschauen bis zu 30 Sekunden.
Lyria RealTime (experimentell)
Modell für die Musikgenerierung in hoher Qualität mit detaillierter kreativer Steuerung und Echtzeit-Streaming-Funktionen.
Tool- und Agent-Modelle
Computer Use Preview
Ein spezialisiertes Modell, das einen digitalen Bildschirm „sehen“ und UI-Aktionen wie Klicken, Tippen und Navigieren ausführen kann, um komplexe Browseraufgaben zu automatisieren.
Gemini Deep Research Vorabversion
Ein agentisches Modell, das mehrstufige Recherchen aus Hunderten von Quellen autonom plant und ausführt, um zitierte, interaktive Berichte zu erstellen.
Gemini Deep Research Max (Vorabversion)
Maximale Vollständigkeit für die automatisierte Kontexterfassung und ‑synthese aus Hunderten von Quellen.
Antigravity Agent (Vorabversion)
Ein verwalteter Agent für allgemeine Zwecke, der autonom plant, Schlussfolgerungen zieht, Code ausführt, Dateien verwaltet und im Web surft – alles in einer sicheren, isolierten Linux-Sandbox.
Spezialisierte Aufgabenmodelle
Gemini Embedding 2
Unser erstes multimodales Einbettungsmodell, das Text, Bilder, Videos, Audio und PDFs in einen einheitlichen Einbettungsbereich für erweiterte semantische Such- und RAG-Systeme einordnet.
Gemini Embedding
Hochdimensionale Vektordarstellungen für erweiterte semantische Such-, Textklassifizierungs- und RAG-Systeme.
Gemini Robotics-ER 1.6(Vorabversion)
Erweitertes Modell für verkörpertes Reasoning, das physische Räume versteht und mehrstufige Aufgaben für Roboter-KI-Agenten plant. Es bietet neue Funktionen wie das Lesen von Instrumenten und verbessertes räumliches und physikalisches Reasoning.
Vorherige Modelle
Gemini 2.0 Flash Herunterfahren
Unser Arbeitstier der zweiten Generation mit Funktionen der nächsten Generation und verbesserten Möglichkeiten, darunter überlegene Geschwindigkeit, native Tool-Nutzung und ein Kontextfenster mit 1 Million Tokens.
Gemini 2.0 Flash-Lite Herunterfahren
Unser schnellstes Modell der zweiten Generation, optimiert für Kosteneffizienz und niedrige Latenz.
Gemini 3.1 Flash-Lite (Vorabversion) Herunterfahren
Unser kosteneffizientestes multimodales Modell, das die schnellste Leistung für hochfrequente, einfache Aufgaben bietet.
Gemini 3 Pro (Vorabversion) Herunterfahren
Unser hochmodernes Modell für logisches Denken mit erweitertem multimodalen Verständnis.
Namensmuster für Modellversionen
Gemini-Modelle sind in den Versionen stabil, Vorabversion, neueste oder experimentell verfügbar.
Stabil
Verweist auf ein bestimmtes stabiles Modell. Stabile Modelle ändern sich in der Regel nicht. Die meisten Produktions-Apps sollten ein bestimmtes stabiles Modell verwenden.
Beispiel: gemini-3.6-flash.
Vorschau
Verweist auf ein Vorabmodell, das für die Produktion verwendet werden kann. Für Vorabmodelle ist in der Regel die Abrechnung aktiviert. Sie haben möglicherweise restriktivere Ratenlimits und werden mindestens zwei Wochen im Voraus eingestellt.
Beispiel: gemini-2.5-flash-preview-09-2025.
Neueste
Verweist auf die neueste Version für eine bestimmte Modellvariante. Dies kann eine stabile, Vorab- oder experimentelle Version sein. Dieser Alias wird bei jeder neuen Version einer bestimmten Modellvariante ausgetauscht. Bei wichtigen Änderungen werden Sie zwei Wochen im Voraus per E‑Mail benachrichtigt, bevor die Version hinter „Neueste“ geändert wird.
Beispiel: gemini-flash-latest.
Experimentell
Verweist auf ein experimentelles Modell, das in der Regel nicht für die Produktion geeignet ist und restriktivere Ratenlimits hat. Wir veröffentlichen experimentelle Modelle, um Feedback zu erhalten und Entwicklern schnell die neuesten Updates zur Verfügung zu stellen.
Experimentelle Modelle sind nicht stabil und die Verfügbarkeit von Modellendpunkten kann sich ändern.
Modelleinstellungen
Informationen zu Modelleinstellungen finden Sie auf der Seite Gemini-Einstellungen.