Gemini API to najszybsza droga od prompta do wersji produkcyjnej z Gemini, Veo, Nano Banana i innymi narzędziami. Umożliwia integrację tych modeli generatywnych z aplikacjami w celu generowania tekstu i obrazów, analizowania danych wejściowych multimodalnych oraz tworzenia agentów konwersacyjnych.
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.8-flash",
input="Explain how AI works in a few words"
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
const interaction = await ai.interactions.create({
model: "gemini-3.8-flash",
input: "Explain how AI works in a few words",
});
console.log(interaction.output_text);
Java
import com.google.genai.Client;
import com.google.genai.gaos.models.interactions.CreateModelInteraction;
import com.google.genai.gaos.models.interactions.Interaction;
import com.google.genai.gaos.models.interactions.InteractionsInput;
import com.google.genai.gaos.models.interactions.Model;
import com.google.genai.gaos.models.operations.CreateInteractionRequestBody;
Client client = new Client();
CreateModelInteraction params =
CreateModelInteraction.builder()
.model(Model.of("gemini-3.7-flash"))
.input(InteractionsInput.of("Explain how AI works in a few words"))
.build();
Interaction interaction =
client.interactions.create(CreateInteractionRequestBody.of(params)).interaction().get();
System.out.println(interaction.outputText().orElse(""));
REST
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-d '{
"model": "gemini-3.8-flash",
"input": "Explain how AI works in a few words"
}'
Poznaj modele
Wyświetl wszystkoGemini 3.8 Flash Nowość
Nasz najbardziej inteligentny model Flash, zaprojektowany do długoterminowego inżynierii oprogramowania, autonomicznych agentów i złożonych przepływów pracy w przedsiębiorstwach.
Gemini 3.5 Flash-Lite
Model o dużej przepustowości i niskich kosztach, zoptymalizowany pod kątem zadań subagentów o niskim opóźnieniu i wysokiej przepustowości.
Gemini 3.1 Pro
Nasz najbardziej inteligentny model, najlepszy na świecie pod względem rozpoznawania multimodalnego, zbudowany na bazie najnowocześniejszego rozumowania.
🍌 Nano Banana 2 i Nano Banana Pro
Najnowocześniejsze modele do generowania i edytowania obrazów.
Gemini Omni Flash
Nasz najnowocześniejszy model do generowania i edytowania filmów.
Gemini 3.5 Transcribe Nowość
Model mowy na tekst o niskim opóźnieniu z wykrywaniem języka na podstawie wypowiedzi, rozdzielaniem rozmówców i sygnaturami czasowymi słów.
Gemini Robotics
Model wizyjno-językowy (VLM), który wprowadza możliwości agentowe Gemini do robotyki i umożliwia zaawansowane wnioskowanie w świecie fizycznym.
Poznaj możliwości
Generowanie obrazów
Generuj i edytuj obrazy o wysokim poziomie kontekstu natywnie za pomocą Nano Banana.
Długi kontekst
Wprowadzaj miliony tokenów do modeli Gemini i wyciągaj wnioski z nieustrukturyzowanych obrazów, filmów i dokumentów.
Uporządkowane dane wyjściowe
Ogranicz Gemini do odpowiadania w formacie JSON, czyli formacie danych strukturalnych odpowiednim do automatycznego przetwarzania.
Wywoływanie funkcji
Twórz przepływy pracy agentów, łącząc Gemini z zewnętrznymi interfejsami API i narzędziami.
Generowanie filmów za pomocą Veo 3.1
Twórz wysokiej jakości treści wideo na podstawie promptów tekstowych lub graficznych za pomocą naszego najnowocześniejszego modelu.
Agenty głosowe z interfejsem Live API
Twórz aplikacje i agenty głosowe w czasie rzeczywistym za pomocą interfejsu Live API.
Narzędzia
Połącz Gemini ze światem za pomocą wbudowanych narzędzi, takich jak wyszukiwarka Google, kontekst adresu URL, Mapy Google, wykonywanie kodu i korzystanie z komputera.
Rozumienie dokumentów
Przetwarzaj do 1000 stron plików PDF z pełnym rozpoznawaniem multimodalnym lub innych typów plików tekstowych.
Myślę
Dowiedz się, jak możliwości myślenia poprawiają rozumowanie w przypadku złożonych zadań i agentów.
Interactions API
Od czerwca 2026 r. Interactions API stał się naszym domyślnym interfejsem i jest najlepszym sposobem na tworzenie modeli i agentów Gemini. Jeśli zaczynasz nowy projekt, użyj Interactions API. Interfejs generateContent API jest nadal obsługiwany, ale jest już uważany za starszy.
Omówienie interfejsu Interactions API
Dowiedz się, jak interfejs Interactions API zarządza stanem rozmowy, wiadomościami i formatami danych wyjściowych.
Przewodnik po migracji
Szczegółowy przewodnik, który pomoże Ci przenieść kod z interfejsu generateContent API do interfejsu Interactions API.
Streaming
Przesyłaj strumieniowo tokeny w czasie rzeczywistym, przyrostowe myśli i zdarzenia wywołania narzędzia.