Modelle

In diesem Leitfaden werden alle Modelle vorgestellt, die über die Gemini API verfügbar sind.


Gemini 3

Stabil

Gemini 3.8 Flash

Unser intelligentestes Flash-Modell, das für langfristige Softwareentwicklung, autonome KI-Agenten und komplexe Unternehmensworkflows entwickelt wurde.

Neu (stabil)

Gemini 3.8 Live

Standard-Live-API-Modell für die meisten Sprachagenten mit niedriger Latenz ohne Verzögerungen bei der Schlussfolgerung.

Neu (stabil)

Gemini 3.8 Live Extended Thinking

Live-API-Modell mit hoher Argumentationsfähigkeit für Sprachinteraktionen, empfohlen, wenn eine höhere Hintergrundargumentation erforderlich ist.

Neu (stabil)

Gemini 3.8 Flash TTS

Flaggschiff-Creative-Text-to-Speech-Modell für Sprachwiedergabe in Studioqualität, ausdrucksstarke Darstellung, Voice-Design und Voice-Replikation.

Neu (stabil)

Gemini 3.8 Flash-Lite TTS

Schnelles, kostengünstiges Text-to-Speech-Modell für die Produktion mit hohem Volumen, Echtzeit-Sprachagenten-Kaskaden und Sprachreplikation.

Neu (stabil)

Gemini 3.7 Flash

Unser Flash-Modell der vorherigen Generation für komplexes Programmieren, agentische Workflows und die zuverlässige Ausführung mehrstufiger Aufgaben.

Stabil

Gemini 3.6 Flash

Unser Flash-Modell der vorherigen Generation, das Geschwindigkeit und multimodale Funktionen für allgemeine agentische und alltägliche Aufgaben in Einklang bringt.

Stabil

Gemini 3.5 Flash

Unser altes Flash-Modell, das grundlegende Geschwindigkeit und Leistung für routinemäßige Arbeitslasten mit hohem Durchsatz bietet.

Stabil

Gemini 3.5 Flash-Lite

Unser schnellstes und kostengünstigstes 3.5-Modell für die Ausführung mit hohem Durchsatz.

Stabil

Gemini 3.1 Flash Lite

Leistung auf Frontier-Niveau, die mit größeren Modellen mithalten kann, zu einem Bruchteil der Kosten.

Stabil

Nano Banana 2

Leistungsstarke, hocheffiziente Bildgenerierung und ‑bearbeitung, optimiert für Geschwindigkeit und Anwendungsfälle mit hohem Volumen.

Stabil

Nano Banana 2 Lite

Extrem niedrige Latenz und kostengünstige Bildgenerierung und ‑bearbeitung für interaktive Anwendungsfälle mit hohem Volumen.

Stabil

Nano Banana Pro

Hochmoderne Modelle für die Bildgenerierung und ‑bearbeitung für die kontextbezogene Erstellung nativer Bilder.

Stabil

Gemini 3.5 Transcribe

Speech-to-Text-Modell mit geringer Latenz und auf Äußerungen basierender Spracherkennung, Sprecherbestimmung und Wort-Zeitstempeln.

Neu (stabil)

Vorschau

Alle Gemini 3-Modelle

Modell Endpunkt
Gemini 3.8 Flash
gemini-3.8-flash
Gemini 3.8 Live
gemini-3.8-live
Gemini 3.8 Live Extended Thinking
gemini-3.8-live-extended-thinking
Gemini 3.8 Flash TTS
gemini-3.8-flash-tts
Gemini 3.8 Flash-Lite TTS
gemini-3.8-flash-lite-tts
Gemini 3.7 Flash
gemini-3.7-flash
Gemini 3.6 Flash
gemini-3.6-flash
Gemini 3.5 Flash
gemini-3.5-flash
Gemini 3.5 Flash-Lite
gemini-3.5-flash-lite
Gemini 3.1 Flash-Lite
gemini-3.1-flash-lite
Nano Banana 2
gemini-3.1-flash-image
Nano Banana 2 Lite
gemini-3.1-flash-lite-image
Nano Banana Pro
gemini-3-pro-image
Gemini 3.1 Pro
gemini-3.1-pro-preview
Gemini 3 Flash
gemini-3-flash-preview
Gemini 3.5 Live-Übersetzung
gemini-3.5-live-translate-preview
Gemini 3.1 Flash Live
gemini-3.1-flash-live-preview
Gemini 3.1 Flash TTS
gemini-3.1-flash-tts-preview
Gemini Omni Flash
gemini-omni-1.1-flash
Gemini 3.5 Transcribe
gemini-3.5-transcribe
gemini-3.5-transcribe-live

Gemini 2.5 Flash

Modell Beschreibung Endpunkt
Gemini 2.5 Flash Unser bestes Preis-Leistungs-Modell für latenzarme Aufgaben mit hohem Volumen, die Reasoning erfordern.
gemini-2.5-flash
Nano Banana Hochmoderne native Bildgenerierung und ‑bearbeitung für schnelle, kreative Workflows.
gemini-2.5-flash-image
Gemini 2.5 Flash Live Optimiert für Echtzeit-Unterhaltungsagenten mit nativem Audio-Streaming unter einer Sekunde.
gemini-2.5-flash-native-audio-preview-12-2025
Gemini 2.5 Flash TTS Steuerbare Text-zu-Sprache-Audio-Generierung mit präziser Steuerung von Stil und Tempo.
gemini-2.5-flash-preview-tts

Gemini 2.5 Flash-Lite

Modell Beschreibung Endpunkt
Gemini 2.5 Flash-Lite Das schnellste und kostengünstigste multimodale Modell der 2.5-Familie.
gemini-2.5-flash-lite

Gemini 2.5 Pro

Modell Beschreibung Endpunkt
Gemini 2.5 Pro Unser fortschrittlichstes Modell für komplexe Aufgaben mit umfassenden Funktionen für logisches Denken und Programmieren in der 2.5-Familie.
gemini-2.5-pro
Gemini 2.5 Pro TTS Hochwertige Sprachsynthese, die für Qualität in strukturierten Workflows wie Podcasts und Hörbücher optimiert ist.
gemini-2.5-pro-preview-tts

Audiomodelle

Dieser Abschnitt enthält alle Audiomodelle, auch solche, die möglicherweise bereits in anderen Abschnitten aufgeführt sind.

Modell Beschreibung Endpunkt
Gemini 3.8 Live Die Standardoption für die meisten Sprachagenten mit niedriger Latenz und für Echtzeitdialoge ohne Verzögerungen durch Reasoning.
gemini-3.8-live
Gemini 3.8 Live Extended Thinking Unser Audio-zu-Audio-Modell mit hoher Argumentationsfähigkeit, das für Live-Interaktionen empfohlen wird, bei denen eine höhere Hintergrundargumentation erforderlich ist.
gemini-3.8-live-extended-thinking
Gemini 3.8 Flash TTS Das Flagship-Modell für kreatives Text-to-Speech bietet Sprachausgabe in Studioqualität, ausdrucksstarke Sprecher und regionale Dialekte in 130 Sprachen.
gemini-3.8-flash-tts
Gemini 3.8 Flash-Lite TTS Schnelles, kostengünstiges Text-to-Speech-Modell für Produktionsarbeitslasten mit hohem Durchsatz in 101 Sprachen.
gemini-3.8-flash-lite-tts
Gemini 3.1 Flash Live Legacy-Modell für die Audio-zu-Audio-Vorschau. Wir empfehlen, auf Gemini 3.8 Live zu aktualisieren.
gemini-3.1-flash-live-preview
Gemini 3.1 Flash TTS Legacy-Vorschaumodell für die Sprachausgabe. Wir empfehlen, auf Gemini 3.8 Flash TTS oder Gemini 3.8 Flash-Lite TTS zu aktualisieren.
gemini-3.1-flash-tts-preview
Gemini 3.5 Transcribe Speech-to-Text-Modell mit geringer Latenz und auf Äußerungen basierender Spracherkennung, Sprecherbestimmung, Zeitstempeln auf Wortebene und benutzerdefinierter Vokabelgewichtung.
gemini-3.5-transcribe
gemini-3.5-transcribe-live
Gemini 2.5 Flash Live Unser Flaggschiff-Live API-Modell für latenzarme, bidirektionale Sprach- und Video-Agents mit nativer Audio-Argumentation.
gemini-2.5-flash-native-audio-preview-12-2025
Gemini 2.5 Flash TTS Schnelle und steuerbare Sprachausgabe für kostengünstige Anwendungen mit geringer Latenz und Echtzeit-Assistenten.
gemini-2.5-flash-preview-tts
Gemini 2.5 Pro TTS Hochwertige Sprachsynthese, die für Qualität in strukturierten Workflows wie Podcasts und Hörbücher optimiert ist.
gemini-2.5-pro-preview-tts

Generative Medienmodelle

Dieser Abschnitt enthält alle generativen Media-Modelle, einschließlich der Modelle, die möglicherweise bereits in anderen Abschnitten aufgeführt sind.

Modell Beschreibung Endpunkt
Nano Banana 2 Hocheffiziente visuelle Inhalte in Produktionsqualität erstellen – mit der Intelligenz der Gemini 3-Serie und blitzschnellen Generierungsgeschwindigkeiten.
gemini-3.1-flash-image
Nano Banana 2 Lite Dieses Modell wurde als Effizienzspezialist der Bildgenerierungsfamilie entwickelt und bietet extrem niedrige Latenz sowie kostengünstige Bildgenerierung und ‑bearbeitung.
gemini-3.1-flash-lite-image
Veo 3.1 Hochmoderne filmische Videogenerierung mit erweiterten kreativen Steuerungselementen und nativ synchronisiertem Audio.
veo-3.1-generate-preview
Nano Banana Pro Eine professionelle Design-Engine mit einem Reasoning-Kern für 4K-Visuals in Studioqualität, komplexe Layouts und präzises Rendern von Text.
gemini-3-pro-image
Veo 3.1 Lite Hocheffiziente, kostengünstige Videogenerierung, ‑bearbeitung und filmreife Steuerung für Entwickler aus der Veo 3.1-Familie.
veo-3.1-lite-generate-preview
Gemini Omni Flash Schnelles Generieren und Bearbeiten von Videos, Keyframe-Interpolation und Erweiterung mit nativem Audio.
gemini-omni-1.1-flash
Nano Banana Hochmoderne native Bildgenerierung und ‑bearbeitung für schnelle, kreative Workflows.
gemini-2.5-flash-image
Imagen 4 (Herunterfahren) Text-zu-Bild-Modell mit schneller und ultraschneller Generierung (wird eingestellt).
imagen-4.0-generate

Modelle zur Musikgenerierung

Dieser Abschnitt enthält alle Modelle zur Musikgenerierung, auch solche, die möglicherweise bereits in anderen Abschnitten aufgeführt sind.

Modell Beschreibung Endpunkt
Lyria 3.5 Unser Flagship-Modell zur Musikgenerierung, das für Songs in voller Länge mit komplexer struktureller Kohärenz optimiert ist.
lyria-3.5
Lyria 3 Clip Optimiert für die Generierung kurzer Musikclips, Loops und Vorschauen von bis zu 30 Sekunden.
lyria-3-clip-preview
Lyria 3 Pro Das Musikgenerierungsmodell der vorherigen Generation für Songs in voller Länge.
lyria-3-pro-preview
Lyria RealTime Modell zur Musikgenerierung mit hoher Qualität, das eine detaillierte kreative Kontrolle und Echtzeit-Streaming ermöglicht.
lyria-realtime-exp

Tool- und Agentenmodelle

Modell Beschreibung Endpunkt
Gemini Deep Research Ein agentisches Modell, das autonom mehrstufige Recherchen in Hunderten von Quellen plant und ausführt, um zitierte, interaktive Berichte zu erstellen.
deep-research-preview-04-2026
Gemini Deep Research Max Maximale Vollständigkeit für die automatische Kontextbeschaffung und ‑synthese aus Hunderten von Quellen.
deep-research-max-preview-04-2026
Antigravity-Agent Ein Agent für allgemeine Zwecke, der autonom plant, Schlussfolgerungen zieht, Code ausführt, Dateien verwaltet und im Web surft – alles in einer sicheren, isolierten Linux-Sandbox.
antigravity-preview-09-2026

Spezialisierte Aufgabenmodelle

Modell Beschreibung Endpunkt
Gemini Embedding 2 Unser erstes multimodales Einbettungsmodell, das Text, Bilder, Videos, Audio und PDFs in einen einheitlichen Einbettungsbereich für erweiterte semantische Such- und RAG-Systeme (Retrieval-Augmented Generation) umwandelt.
gemini-embedding-2-preview
Gemini Embedding Hochdimensionale Vektordarstellungen für erweiterte semantische Suche, Textklassifizierung und RAG-Systeme.
gemini-embedding-001
Gemini Robotics ER 2 Modell für verkörpertes Denken, das fortschrittliches Videoverständnis, räumliches Denken, mehrstufige Tool-Orchestrierung und Zusammenarbeit mehrerer Roboter für Robotikaufgaben bietet.
gemini-robotics-er-2-preview
Gemini Robotics ER 1.6 Ein fortschrittliches Modell für verkörperte Schlussfolgerungen, das physische Räume versteht und mehrstufige Aufgaben für Roboter-Agents plant. Es bietet neue Funktionen wie das Ablesen von Instrumenten sowie verbesserte räumliche und physische Schlussfolgerungen.
gemini-robotics-er-1.6-preview

Vorherige Modelle

Modell Beschreibung Endpunkt
Computernutzung (Herunterfahren) Ein spezialisiertes Modell, das einen digitalen Bildschirm „sehen“ und Benutzeroberflächenaktionen wie Klicken, Tippen und Navigieren ausführen kann, um komplexe Browseraufgaben zu automatisieren.
gemini-2.5-computer-use-preview-10-2025
Gemini 2.0 Flash (wird eingestellt) Unser Modell der zweiten Generation für anspruchsvolle Aufgaben mit Funktionen der nächsten Generation und verbesserten Fähigkeiten, darunter eine höhere Geschwindigkeit, die native Verwendung von Tools und ein Kontextfenster von 1 Million Tokens.
gemini-2.0-flash
Gemini 2.0 Flash-Lite (wird eingestellt) Unser schnellstes Modell der zweiten Generation, optimiert für Kosteneffizienz und niedrige Latenz.
gemini-2.0-flash-lite
Gemini 3.1 Flash-Lite (Vorabversion) (wird eingestellt) Unser kostengünstigstes multimodales Modell, das die schnellste Leistung für hochfrequente, einfache Aufgaben bietet.
gemini-3.1-flash-lite-preview
Gemini 3 Pro (Vorabversion) (wird eingestellt) Unser fortschrittlichstes Logikmodell mit erweitertem multimodalen Verständnis.
gemini-3-pro-preview

Namensmuster für Modellversionen

Gemini-Modelle sind in den Versionen stabil, Vorschau, aktuell oder experimentell verfügbar.

Stabil

Verweist auf ein bestimmtes stabiles Modell. Stabile Modelle ändern sich in der Regel nicht. Die meisten Produktions-Apps sollten ein bestimmtes stabiles Modell verwenden.

Beispiel: gemini-3.6-flash.

Vorschau

Verweist auf ein Vorschaumodell, das für die Produktion verwendet werden kann. Bei Vorschauversionen von Modellen ist die Abrechnung in der Regel aktiviert. Sie haben möglicherweise restriktivere Ratenbeschränkungen und werden mit einer Vorlaufzeit von mindestens zwei Wochen eingestellt.

Beispiel: gemini-2.5-flash-preview-09-2025.

Neueste

Verweist auf die neueste Version für eine bestimmte Modellvariante. Das kann eine stabile Version, eine Vorschauversion oder eine experimentelle Version sein. Dieser Alias wird bei jeder neuen Version einer bestimmten Modellvariante ausgetauscht. Bei wichtigen Änderungen wird zwei Wochen im Voraus per E-Mail eine Benachrichtigung gesendet, bevor die Version hinter „latest“ geändert wird.

Beispiel: gemini-flash-latest.

Experimentell

Verweist auf ein experimentelles Modell, das in der Regel nicht für die Produktion geeignet ist und restriktivere Ratenlimits hat. Wir veröffentlichen experimentelle Modelle, um Feedback zu sammeln und Entwicklern schnell unsere neuesten Updates zur Verfügung zu stellen.

Experimentelle Modelle sind nicht stabil und die Verfügbarkeit von Modellendpunkten kann sich ändern.

Einstellung von Modellen

Informationen zur Einstellung von Modellen finden Sie auf der Seite Einstellung von Gemini-Modellen.