Die Gemini API ist der schnellste Weg vom Prompt zur Produktionsphase mit Gemini, Veo, Nano Banana und mehr. Mit ihr können Sie diese generativen Modelle in Ihre Anwendungen einbinden, um Text und Bilder zu generieren, multimodale Eingaben zu analysieren und konversationelle Agenten zu erstellen.
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.8-flash",
input="Explain how AI works in a few words"
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
const interaction = await ai.interactions.create({
model: "gemini-3.8-flash",
input: "Explain how AI works in a few words",
});
console.log(interaction.output_text);
Java
import com.google.genai.Client;
import com.google.genai.gaos.models.interactions.CreateModelInteraction;
import com.google.genai.gaos.models.interactions.Interaction;
import com.google.genai.gaos.models.interactions.InteractionsInput;
import com.google.genai.gaos.models.interactions.Model;
import com.google.genai.gaos.models.operations.CreateInteractionRequestBody;
Client client = new Client();
CreateModelInteraction params =
CreateModelInteraction.builder()
.model(Model.of("gemini-3.7-flash"))
.input(InteractionsInput.of("Explain how AI works in a few words"))
.build();
Interaction interaction =
client.interactions.create(CreateInteractionRequestBody.of(params)).interaction().get();
System.out.println(interaction.outputText().orElse(""));
REST
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-d '{
"model": "gemini-3.8-flash",
"input": "Explain how AI works in a few words"
}'
Die Modelle
Alle ansehenGemini 3.8 Flash Neu
Unser intelligentestes Flash-Modell, das für langfristige Softwareentwicklung, autonome Agenten und komplexe Unternehmensworkflows entwickelt wurde.
Gemini 3.5 Flash-Lite
Kostengünstiges Modell für große Datenmengen, das für Sub-Agenten-Aufgaben mit niedriger Latenz und hohem Durchsatz optimiert wurde.
Gemini 3.1 Pro
Unser intelligentestes Modell, das weltweit beste für multimodales Verständnis, basierend auf modernster Schlussfolgerungstechnologie.
🍌 Nano Banana 2 und Nano Banana Pro
Hochmoderne Modelle für die Bildgenerierung und ‑bearbeitung.
Gemini Omni Flash
Unser hochmodernes Modell für die Videogenerierung und ‑bearbeitung.
Gemini 3.5 Transcribe Neu
Modell für die Spracherkennung mit niedriger Latenz und sprachbasierter Erkennung, Sprecherbestimmung und Zeitstempeln für Wörter.
Gemini Robotics
Ein Vision-Language-Modell (VLM), das die agentischen Funktionen von Gemini in die Robotik einbringt und logisches Schlussfolgern in der physischen Welt ermöglicht.
Funktionen
Bildgenerierung
Mit Nano Banana kontextbezogene Bilder generieren und bearbeiten.
Langer Kontext
Millionen von Tokens in Gemini-Modelle eingeben und Informationen aus unstrukturierten Bildern, Videos und Dokumenten gewinnen.
Strukturierte Ausgaben
Gemini so einschränken, dass es mit JSON antwortet, einem strukturierten Datenformat, das für die automatisierte Verarbeitung geeignet ist.
Funktionsaufrufe
Agentische Workflows erstellen, indem Sie Gemini mit externen APIs und Tools verbinden.
Videogenerierung mit Veo 3.1
Mit unserem hochmodernen Modell hochwertige Videoinhalte aus Text- oder Bildprompts erstellen.
Sprachagenten mit der Live API
Mit der Live API Sprachagenten und ‑anwendungen in Echtzeit erstellen.
Tools
Gemini über integrierte Tools wie die Google Suche, URL-Kontext, Google Maps, Codeausführung und Computernutzung mit der Welt verbinden.
Verständnis von Dokumenten
Bis zu 1.000 Seiten von PDF-Dateien mit vollständigem multimodalen Verständnis oder anderen textbasierten Dateitypen verarbeiten.
Thinking
Erfahren Sie, wie die Denkfähigkeiten die Schlussfolgerungen für komplexe Aufgaben und Agenten verbessern.
Interactions API
Die Interactions API ist seit Juni 2026 unsere Standardschnittstelle und die beste Möglichkeit, mit Gemini-Modellen und ‑Agenten zu entwickeln. Wenn Sie ein neues Projekt starten, sollten Sie die Interactions API verwenden. Die generateContent API wird zwar weiterhin unterstützt, gilt aber jetzt als Legacy-API.
Übersicht über die Interactions API
Erfahren Sie, wie die Interactions API den Konversationsstatus, Nachrichten und Ausgabeformate verwaltet.
Migrationsanleitung
Detaillierte Anleitung zur Umstellung Ihres Codes von „generateContent“ auf die Interactions API.
Streaming
Tokens, inkrementelle Gedanken und Tool-Aufrufereignisse in Echtzeit streamen.