In diesem Leitfaden werden alle Modelle vorgestellt, die über die Gemini API verfügbar sind.
Gemini 3
Stabil
Gemini 3.6 Flash
Unser neuestes Modell, das Geschwindigkeit und Intelligenz in Einklang bringt, um eine hohe Leistung bei agentischen und multimodalen Aufgaben zu erzielen.
Stabil
Gemini 3.5 Flash
Das intelligenteste Modell für dauerhafte Spitzenleistung bei agentischen und Coding-Aufgaben.
Stabil
Gemini 3.5 Flash-Lite
Unser schnellstes und kostengünstigstes 3.5-Modell für die Ausführung mit hohem Durchsatz.
Stabil
Gemini 3.1 Flash Lite
Leistung auf Frontier-Niveau, die mit größeren Modellen mithalten kann, zu einem Bruchteil der Kosten.
Stabil
Nano Banana 2
Leistungsstarke, hocheffiziente Bildgenerierung und ‑bearbeitung, optimiert für Geschwindigkeit und Anwendungsfälle mit hohem Volumen.
Stabil
Nano Banana 2 Lite
Extrem niedrige Latenz und kostengünstige Bildgenerierung und ‑bearbeitung für interaktive Anwendungsfälle mit hohem Volumen.
Stabil
Nano Banana Pro
Hochmoderne Modelle für die Bildgenerierung und ‑bearbeitung für die kontextbezogene Erstellung nativer Bilder.
Stabil
Vorschau
Gemini 3.1. Pro
Fortschrittliche Intelligenz, Fähigkeiten zur Lösung komplexer Probleme und leistungsstarke Funktionen für die Programmierung von Agenten und Vibe Coding.
Vorschau
Gemini 3 Flash
Leistung auf Frontier-Niveau, die mit größeren Modellen mithalten kann, zu einem Bruchteil der Kosten.
Vorschau
Gemini 3.5 Live-Übersetzung
Modell für die Echtzeit-Sprachübersetzung mit geringer Latenz, das über 70 Sprachen unterstützt.
Neu: Vorschau
Gemini 3.1 Flash Live
Hochwertiges Live API-Modell mit niedriger Latenz für Echtzeitdialoge und KI-Anwendungen, die auf Sprache basieren.
Neu: Vorschau
Gemini 3.1 Flash TTS
Leistungsstarke Sprachgenerierung mit geringer Latenz.
Neu: Vorschau
Gemini Omni Flash
Schnelles, konversationelles Generieren und Bearbeiten von Videos. Sie können Text und Bilder in Videos umwandeln und die Ergebnisse mithilfe natürlicher Sprache optimieren.
Neu: Vorschau
Alle Gemini 3-Modelle
| Modell | Endpunkt |
|---|---|
| Gemini 3.1 Pro | gemini-3.1-pro-preview |
| Gemini 3.5 Flash | gemini-3.5-flash |
| Gemini 3 Flash | gemini-3-flash-preview |
| Gemini 3.1 Flash-Lite | gemini-3.1-flash-lite |
| Nano Banana 2 | gemini-3.1-flash-image |
| Nano Banana 2 Lite | gemini-3.1-flash-lite-image |
| Nano Banana Pro | gemini-3-pro-image |
| Gemini 3.5 Live-Übersetzung | gemini-3.5-live-translate-preview |
| Gemini 3.1 Flash Live | gemini-3.1-flash-live-preview |
| Gemini 3.1 Flash TTS | gemini-3.1-flash-tts-preview |
Gemini 2.5 Flash
| Modell | Beschreibung | Endpunkt |
|---|---|---|
| Gemini 2.5 Flash | Unser bestes Preis-Leistungs-Modell für latenzarme Aufgaben mit hohem Volumen, die Reasoning erfordern. | gemini-2.5-flash |
| Nano Banana | Hochmoderne native Bildgenerierung und ‑bearbeitung für schnelle, kreative Workflows. | gemini-2.5-flash-image |
| Gemini 2.5 Flash Live | Optimiert für Konversationsagenten in Echtzeit mit nativem Audio-Streaming in weniger als einer Sekunde. | gemini-2.5-flash-native-audio-preview-12-2025 |
| Gemini 2.5 Flash TTS | Steuerbare Text-zu-Sprache-Audio-Generierung mit präziser Steuerung von Stil und Tempo. | gemini-2.5-flash-preview-tts |
Gemini 2.5 Flash-Lite
| Modell | Beschreibung | Endpunkt |
|---|---|---|
| Gemini 2.5 Flash Lite | Das schnellste und kostengünstigste multimodale Modell der 2.5-Familie. | gemini-2.5-flash-lite |
Gemini 2.5 Pro
| Modell | Beschreibung | Endpunkt |
|---|---|---|
| Gemini 2.5 Pro | Unser fortschrittlichstes Modell für komplexe Aufgaben mit umfassenden Funktionen für logisches Denken und Programmieren in der 2.5-Familie. | gemini-2.5-pro |
| Gemini 2.5 Pro TTS | Sprachsynthese mit hoher Wiedergabetreue, die für Qualität in strukturierten Workflows wie Podcasts und Hörbüchern optimiert ist. | gemini-2.5-pro-preview-tts |
Audiomodelle
Dieser Abschnitt enthält alle Audiomodelle, auch solche, die möglicherweise bereits in anderen Abschnitten aufgeführt sind.
| Modell | Beschreibung | Endpunkt |
|---|---|---|
| Gemini 3.1 Flash Live | Unser hochwertiges Audio-zu-Audio-Modell (A2A) mit geringer Latenz wurde für Echtzeitdialoge und KI-Anwendungen mit Sprachsteuerung entwickelt. | gemini-3.1-flash-live-preview |
| Gemini 3.1 Flash TTS | Leistungsstarke Sprachgenerierung mit geringer Latenz, natürlichen Ausgaben, steuerbaren Prompts und neuen ausdrucksstarken Audio-Tags für eine präzise Steuerung der Sprachausgabe. | gemini-3.1-flash-tts-preview |
| Gemini 2.5 Flash Live | Unser Flaggschiff-Live API-Modell für bidirektionale Sprach- und Videoagenten mit geringer Latenz und nativer Audioanalyse. | gemini-2.5-flash-native-audio-preview-12-2025 |
| Gemini 2.5 Flash TTS | Schnelle und steuerbare Sprachsynthese für kostengünstige Anwendungen mit geringer Latenz und Echtzeit-Assistenten. | gemini-2.5-flash-preview-tts |
| Gemini 2.5 Pro TTS | Sprachsynthese mit hoher Wiedergabetreue, die für Qualität in strukturierten Workflows wie Podcasts und Hörbüchern optimiert ist. | gemini-2.5-pro-preview-tts |
Generative Medienmodelle
Dieser Abschnitt enthält alle generativen Media-Modelle, auch solche, die möglicherweise bereits in anderen Abschnitten aufgeführt sind.
| Modell | Beschreibung | Endpunkt |
|---|---|---|
| Nano Banana 2 | Hocheffiziente visuelle Inhalte in Produktionsqualität erstellen – mit der Intelligenz der Gemini 3-Serie und blitzschnellen Generierungsgeschwindigkeiten. | gemini-3.1-flash-image |
| Nano Banana 2 Lite | Dieses Modell wurde als Effizienzspezialist der Bildgenerierungsfamilie entwickelt und bietet eine extrem niedrige Latenz sowie eine kostengünstige Bildgenerierung und ‑bearbeitung. | gemini-3.1-flash-lite-image |
| Veo 3.1 | Hochmoderne filmische Videogenerierung mit erweiterten kreativen Steuerungselementen und nativ synchronisiertem Audio. | veo-3.1-generate-preview |
| Nano Banana Pro | Eine professionelle Design-Engine mit einem Reasoning-Kern für 4K-Visuals in Studioqualität, komplexe Layouts und präzises Textrendering. | gemini-3-pro-image |
| Veo 3.1 Lite | Hocheffiziente, kostengünstige Videogenerierung, ‑bearbeitung und filmreife Steuerung für Entwickler aus der Veo 3.1-Familie. | veo-3.1-lite-generate-preview |
| Gemini Omni Flash | Schnelles, konversationelles Generieren und Bearbeiten von Videos. Sie können Text und Bilder in Videos umwandeln und die Ergebnisse mithilfe natürlicher Sprache optimieren. | gemini-omni-flash |
| Nano Banana | Hochmoderne native Bildgenerierung und ‑bearbeitung für schnelle, kreative Workflows. | gemini-2.5-flash-image |
| Imagen 4 (eingestellt) | Text-zu-Bild-Modell mit schneller und ultraschneller Generierung und außergewöhnlicher Klarheit bis zu einer Auflösung von 2K. | imagen-4.0-generate |
Modelle zur Musikgenerierung
Dieser Abschnitt enthält alle Modelle zur Musikgenerierung, auch solche, die möglicherweise bereits in anderen Abschnitten aufgeführt sind.
| Modell | Beschreibung | Endpunkt |
|---|---|---|
| Lyria 3 Pro | Unser Flagship-Modell für die Musikgenerierung, optimiert für Songs in voller Länge mit komplexer struktureller Kohärenz. | lyria-3-pro-preview |
| Lyria 3 Clip | Optimiert für die Generierung kurzer Musikclips, Loops und Vorschauen von bis zu 30 Sekunden Länge. | lyria-3-clip-preview |
| Lyria RealTime | Modell zur Musikgenerierung mit hoher Qualität, das eine detaillierte kreative Kontrolle und Echtzeit-Streaming ermöglicht. | lyria-realtime-exp |
Tool- und Agent-Modelle
| Modell | Beschreibung | Endpunkt |
|---|---|---|
| Computer Use | Ein spezialisiertes Modell, das einen digitalen Bildschirm „sehen“ und Benutzeroberflächenaktionen wie Klicken, Tippen und Navigieren ausführen kann, um komplexe Browseraufgaben zu automatisieren. | gemini-2.5-computer-use-preview-10-2025 |
| Gemini Deep Research | Ein agentisches Modell, das autonom mehrstufige Recherchen in Hunderten von Quellen plant und ausführt, um zitierte, interaktive Berichte zu erstellen. | deep-research-preview-04-2026 |
| Gemini Deep Research Max | Maximale Vollständigkeit für die automatische Kontextbeschaffung und ‑synthese aus Hunderten von Quellen. | deep-research-max-preview-04-2026 |
| Antigravity-Agent | Ein Agent für allgemeine Zwecke, der autonom plant, Schlussfolgerungen zieht, Code ausführt, Dateien verwaltet und das Web in einer sicheren, isolierten Linux-Sandbox durchsucht. | antigravity-preview-05-2026 |
Spezialisierte Aufgabenmodelle
| Modell | Beschreibung | Endpunkt |
|---|---|---|
| Gemini Embedding 2 | Unser erstes multimodales Einbettungsmodell, das Text, Bilder, Videos, Audio und PDFs in einen einheitlichen Einbettungsbereich für erweiterte semantische Such- und RAG-Systeme (Retrieval-Augmented Generation) umwandelt. | gemini-embedding-2-preview |
| Gemini Embedding | Hochdimensionale Vektordarstellungen für erweiterte semantische Suche, Textklassifizierung und RAG-Systeme. | gemini-embedding-001 |
| Gemini Robotics ER 2 | Ein Modell für verkörperte Schlussfolgerungen, das fortschrittliches Videoverständnis, räumliches Denken, mehrstufige Tool-Orchestrierung und die Zusammenarbeit mehrerer Roboter für Robotikaufgaben bietet. | gemini-robotics-er-2-preview |
| Gemini Robotics ER 1.6 | Ein fortschrittliches Modell für verkörperte Schlussfolgerungen, das physische Räume versteht und mehrstufige Aufgaben für Roboter-Agents plant. Es bietet neue Funktionen wie das Ablesen von Instrumenten sowie ein verbessertes räumliches und physisches Denken. | gemini-robotics-er-1.6-preview |
Vorherige Modelle
| Modell | Beschreibung | Endpunkt |
|---|---|---|
| Gemini 2.0 Flash (wird eingestellt) | Unser Modell der zweiten Generation für den täglichen Einsatz mit Funktionen der nächsten Generation und verbesserter Leistung, darunter eine höhere Geschwindigkeit, die native Nutzung von Tools und ein Kontextfenster von 1 Million Tokens. | gemini-2.0-flash |
| Gemini 2.0 Flash-Lite (wird eingestellt) | Unser schnellstes Modell der zweiten Generation, optimiert für Kosteneffizienz und niedrige Latenz. | gemini-2.0-flash-lite |
| Gemini 3.1 Flash-Lite (Vorabversion) (wird eingestellt) | Unser kostengünstigstes multimodales Modell, das die schnellste Leistung für hochfrequente, einfache Aufgaben bietet. | gemini-3.1-flash-lite-preview |
| Gemini 3 Pro (Vorabversion) (wird eingestellt) | Unser fortschrittlichstes Logikmodell mit erweitertem multimodalen Verständnis. | gemini-3-pro-preview |
Namensmuster für Modellversionen
Gemini-Modelle sind in den Versionen stabil, Vorschau, aktuell oder experimentell verfügbar.
Stabil
Verweist auf ein bestimmtes stabiles Modell. Stabile Modelle ändern sich in der Regel nicht. Die meisten Produktions-Apps sollten ein bestimmtes stabiles Modell verwenden.
Beispiel: gemini-3.6-flash.
Vorschau
Verweist auf ein Vorschaumodell, das für die Produktion verwendet werden kann. Bei Vorschau-Modellen ist die Abrechnung in der Regel aktiviert. Sie haben möglicherweise restriktivere Ratenbeschränkungen und werden mit einer Vorlaufzeit von mindestens zwei Wochen eingestellt.
Beispiel: gemini-2.5-flash-preview-09-2025.
Neueste
Verweist auf den neuesten Release für eine bestimmte Modellvariante. Das kann ein stabiles Release, ein Preview-Release oder ein experimentelles Release sein. Dieser Alias wird bei jeder neuen Version einer bestimmten Modellvariante ausgetauscht. Bei wichtigen Änderungen wird zwei Wochen im Voraus per E-Mail eine Benachrichtigung gesendet, bevor die Version hinter „Latest“ geändert wird.
Beispiel: gemini-flash-latest.
Experimentell
Verweist auf ein experimentelles Modell, das in der Regel nicht für die Produktion geeignet ist und restriktivere Ratenlimits hat. Wir veröffentlichen experimentelle Modelle, um Feedback zu sammeln und Entwicklern unsere neuesten Updates schnell zur Verfügung zu stellen.
Experimentelle Modelle sind nicht stabil und die Verfügbarkeit von Modellendpunkten kann sich ändern.
Einstellung von Modellen
Informationen zur Einstellung von Modellen finden Sie auf der Seite Einstellung von Gemini-Modellen.