Die Gemini API ist der schnellste Weg vom Prompt zur Produktionsphase mit Gemini, Veo, Nano Banana und mehr. Mit ihr können Sie diese generativen Modelle in Ihre Anwendungen einbinden, um Text und Bilder zu generieren, multimodale Eingaben zu analysieren und konversationelle Agenten zu erstellen.
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.7-flash",
input="Explain how AI works in a few words"
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
const interaction = await ai.interactions.create({
model: "gemini-3.7-flash",
input: "Explain how AI works in a few words",
});
console.log(interaction.output_text);
REST
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-d '{
"model": "gemini-3.7-flash",
"input": "Explain how AI works in a few words"
}'
Folgen Sie unserer Anleitung für den Einstieg, um einen API-Schlüssel zu erhalten und Ihren ersten API-Aufruf in wenigen Minuten zu senden.
Die Modelle
Alle ansehenGemini 3.1 Pro Neu
Unser intelligentestes Modell, das weltweit beste für multimodales Verständnis, basierend auf modernstem Schlussfolgern.
Gemini 3.7 Flash Neu
Unser neuestes und leistungsstärkstes Flash-Modell, entwickelt für komplexes Programmieren, agentische Workflows und zuverlässige mehrstufige Ausführung.
Gemini 3.6 Flash
Unser Flash-Modell der vorherigen Generation, das Geschwindigkeit und multimodale Funktionen für allgemeine agentische und alltägliche Aufgaben vereint.
Gemini 3.5 Flash
Unser älteres Flash-Modell, das eine grundlegende Geschwindigkeit und Leistung für routinemäßige Arbeitslasten mit hohem Durchsatz bietet.
Gemini 3.5 Flash-Lite Neu
Kostengünstiges Modell für große Mengen, optimiert für Sub-Agent-Aufgaben mit niedriger Latenz und hohem Durchsatz.
Gemini 3.1 Flash-Lite
Kostengünstiges Modell für große Mengen mit der Leistung und Qualität der Gemini 3-Serie.
Gemini 3 Flash
Leistung der Frontier-Klasse, die mit größeren Modellen mithalten kann, zu einem Bruchteil der Kosten.
🍌 Nano Banana 2 und Nano Banana Pro
Hochmoderne Modelle für die Bildgenerierung und ‑bearbeitung.
Veo 3.1
Unser hochmodernes Modell zur Videogenerierung mit nativer Audiofunktion.
Gemini Robotics
Ein Vision-Language-Modell (VLM), das die agentischen Funktionen von Gemini in die Robotik einbringt und fortschrittliches logisches Schlussfolgern in der physischen Welt ermöglicht.
Funktionen entdecken
Native Bildgenerierung (Nano Banana)
Mit Gemini 2.5 Flash Image können Sie kontextbezogene Bilder nativ generieren und bearbeiten.
Langer Kontext
Geben Sie Millionen von Tokens in Gemini-Modelle ein und gewinnen Sie Erkenntnisse aus unstrukturierten Bildern, Videos und Dokumenten.
Strukturierte Ausgaben
Beschränken Sie Gemini so, dass es mit JSON antwortet, einem strukturierten Datenformat, das für die automatisierte Verarbeitung geeignet ist.
Funktionsaufrufe
Erstellen Sie agentische Workflows, indem Sie Gemini mit externen APIs und Tools verbinden.
Videogenerierung mit Veo 3.1
Mit unserem hochmodernen Modell können Sie hochwertige Videoinhalte aus Text- oder Bild-Prompts erstellen.
Sprachagenten mit der Live API
Mit der Live API können Sie Sprachagenten und ‑anwendungen in Echtzeit erstellen.
Tools
Verbinden Sie Gemini mit der Welt über integrierte Tools wie die Google Suche, URL-Kontext, Google Maps, Codeausführung und Computernutzung.
Verständnis von Dokumenten
Verarbeiten Sie bis zu 1.000 Seiten von PDF-Dateien mit vollständigem multimodalen Verständnis oder anderen textbasierten Dateitypen.
Thinking
Erfahren Sie, wie die Denkfunktionen die Schlussfolgerungen für komplexe Aufgaben und Agenten verbessern.
Interactions API
Die Interactions API ist seit Juni 2026 unsere Standardschnittstelle und die beste Möglichkeit, mit Gemini-Modellen und ‑Agenten zu entwickeln. Wenn Sie ein neues Projekt starten, sollten Sie die Interactions API verwenden. Die generateContent API wird zwar weiterhin unterstützt, gilt aber jetzt als Legacy-API.
Übersicht über Interaktionen
Erfahren Sie, wie die Interactions API den Konversationsstatus, Nachrichten und Ausgabeformate verwaltet.
Migrationsanleitung
Detaillierte Anleitung zur Umstellung Ihres Codes von „generateContent“ auf die Interactions API.
Streaming
Streamen Sie Tokens in Echtzeit, inkrementelle Gedanken und Tool-Aufrufereignisse.