Gemini API to najszybsza droga od promptu do produkcji z użyciem Gemini, Veo, Nano Banana i innych narzędzi. Umożliwia ona integrowanie tych modeli generatywnych z aplikacjami w celu generowania tekstu i obrazów, analizowania danych wejściowych multimodalnych oraz tworzenia agentów konwersacyjnych.
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.8-flash",
input="Explain how AI works in a few words"
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
const interaction = await ai.interactions.create({
model: "gemini-3.8-flash",
input: "Explain how AI works in a few words",
});
console.log(interaction.output_text);
Java
import com.google.genai.Client;
import com.google.genai.gaos.models.interactions.CreateModelInteraction;
import com.google.genai.gaos.models.interactions.Interaction;
import com.google.genai.gaos.models.interactions.InteractionsInput;
import com.google.genai.gaos.models.interactions.Model;
import com.google.genai.gaos.models.operations.CreateInteractionRequestBody;
Client client = new Client();
CreateModelInteraction params =
CreateModelInteraction.builder()
.model(Model.of("gemini-3.7-flash"))
.input(InteractionsInput.of("Explain how AI works in a few words"))
.build();
Interaction interaction =
client.interactions.create(CreateInteractionRequestBody.of(params)).interaction().get();
System.out.println(interaction.outputText().orElse(""));
REST
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-d '{
"model": "gemini-3.8-flash",
"input": "Explain how AI works in a few words"
}'
Poznaj modele
Wyświetl wszystkoGemini 3.8 Flash Nowość
Nasz najbardziej inteligentny model Flash, zaprojektowany z myślą o długoterminowej inżynierii oprogramowania, autonomicznych agentach i złożonych przepływach pracy w firmach.
Gemini 3.5 Flash-Lite
Model o dużej skali i wrażliwy na koszty, zoptymalizowany pod kątem zadań subagentów o niskim czasie oczekiwania i wysokiej przepustowości.
Gemini 3.1 Pro
Nasz najbardziej inteligentny model, najlepszy na świecie pod względem rozpoznawania multimodalnego, zbudowany na bazie najnowocześniejszego rozumowania.
Nano Banana 2 i Nano Banana Pro
Najnowocześniejsze modele do generowania i edytowania obrazów.
Gemini Omni Flash
Nasz najnowocześniejszy model do generowania i edytowania filmów.
Gemini 3.5 Transcribe Nowość
Model mowy na tekst o niskim poziomie opóźnień z wykrywaniem języka na podstawie wypowiedzi, rozdzielaniem rozmówców i sygnaturami czasowymi słów.
Gemini Robotics
Model wizualno-językowy (VLM), który przenosi możliwości agentowe Gemini do robotyki i umożliwia zaawansowane wnioskowanie w świecie fizycznym.
Poznaj możliwości
Generowanie obrazów
Generuj i edytuj obrazy o wysokim stopniu kontekstowości za pomocą Nano Banana.
Długi kontekst
Przesyłaj do modeli Gemini miliony tokenów i wyodrębniaj informacje z nieustrukturyzowanych obrazów, filmów i dokumentów.
Uporządkowane dane wyjściowe
Ogranicz Gemini do odpowiadania w formacie JSON, czyli formacie danych strukturalnych odpowiednim do automatycznego przetwarzania.
Wywoływanie funkcji
Twórz przepływy pracy oparte na agentach, łącząc Gemini z zewnętrznymi interfejsami API i narzędziami.
Generowanie filmów za pomocą Veo 3.1
Twórz wysokiej jakości treści wideo na podstawie promptów tekstowych lub graficznych za pomocą naszego najnowocześniejszego modelu.
Agenci głosowi z interfejsem Live API
Twórz aplikacje i agenty głosowe działające w czasie rzeczywistym za pomocą interfejsu Live API.
Narzędzia
Połącz Gemini ze światem za pomocą wbudowanych narzędzi, takich jak wyszukiwarka Google, kontekst adresu URL, Mapy Google, wykonywanie kodu i korzystanie z komputera.
Rozumienie dokumentów
Przetwarzaj do 1000 stron plików PDF z pełnym rozpoznawaniem multimodalnym lub innych typów plików tekstowych.
Myślę
Dowiedz się, jak funkcje myślenia poprawiają rozumowanie w przypadku złożonych zadań i agentów.
Interactions API
Interfejs API interakcji stał się naszym domyślnym interfejsem w czerwcu 2026 r. i jest najlepszym sposobem na tworzenie aplikacji z modelami i agentami Gemini w przyszłości. Jeśli rozpoczynasz nowy projekt, użyj interfejsu Interactions API. Interfejs generateContent API jest nadal obsługiwany, ale obecnie jest uważany za starszy.
Omówienie interakcji
Dowiedz się, jak interfejs API interakcji zarządza stanem rozmowy, wiadomościami i formatami wyjściowymi.
Przewodnik po migracji
Szczegółowy przewodnik, który pomoże Ci przenieść kod z interfejsu generateContent do interfejsu API Interactions.
Streaming
Strumieniowanie tokenów w czasie rzeczywistym, przyrostowych przemyśleń i zdarzeń wywoływania narzędzi.