Gemini API to najszybsza droga od prompta do wersji produkcyjnej z Gemini, Veo, Nano Banana i innymi modelami. Umożliwia integrację tych modeli generatywnych z aplikacjami w celu generowania tekstu i obrazów, analizowania danych wejściowych multimodalnych oraz tworzenia agentów konwersacyjnych.
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.7-flash",
input="Explain how AI works in a few words"
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
const interaction = await ai.interactions.create({
model: "gemini-3.7-flash",
input: "Explain how AI works in a few words",
});
console.log(interaction.output_text);
REST
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-d '{
"model": "gemini-3.7-flash",
"input": "Explain how AI works in a few words"
}'
Postępuj zgodnie z przewodnikiem dla początkujących, aby uzyskać klucz interfejsu API i wykonać pierwsze wywołanie interfejsu API w ciągu kilku minut.
Poznaj różne modele
Wyświetl wszystkoGemini 3.1 Pro Nowość
Nasz najinteligentniejszy model, najlepszy na świecie pod względem rozpoznawania multimodalnego, zbudowany na bazie najnowocześniejszego rozumowania.
Gemini 3.7 Flash Nowość
Nasz najnowszy i najbardziej zaawansowany model Flash, stworzony do złożonego kodowania, przepływów pracy agentów i niezawodnego wykonywania wieloetapowych zadań.
Gemini 3.6 Flash
Nasz model Flash poprzedniej generacji, który łączy szybkość i możliwości multimodalne w przypadku ogólnych zadań agentów i codziennych zadań.
Gemini 3.5 Flash
Nasz starszy model Flash, który zapewnia prędkość bazową i podstawową wydajność w przypadku rutynowych zadań wymagających dużej przepustowości.
Gemini 3.5 Flash-Lite Nowość
Model o dużej przepustowości i niskich kosztach, zoptymalizowany pod kątem zadań subagentów o niskim opóźnieniu i wysokiej przepustowości.
Gemini 3.1 Flash-Lite
Model o dużej przepustowości i niskich kosztach, który zapewnia wydajność i jakość serii Gemini 3.
Gemini 3 Flash
Wydajność klasy Frontier, która konkuruje z większymi modelami przy ułamku kosztów.
🍌 Nano Banana 2 i Nano Banana Pro
Najnowocześniejsze modele do generowania i edytowania obrazów.
Veo 3.1
Nasz najnowocześniejszy model do generowania filmów z natywnym dźwiękiem.
Gemini Robotics
Model wizyjno-językowy (VLM), który wprowadza możliwości agentowe Gemini do robotyki i umożliwia zaawansowane wnioskowanie w świecie fizycznym.
Poznaj możliwości
Natywne generowanie obrazów (Nano Banana)
Generuj i edytuj obrazy w wysokim kontekście natywnie za pomocą Gemini 2.5 Flash Image.
Długi kontekst
Wprowadzaj miliony tokenów do modeli Gemini i wyciągaj wnioski z nieustrukturyzowanych obrazów, filmów i dokumentów.
Uporządkowane dane wyjściowe
Ogranicz Gemini do odpowiadania w formacie JSON, czyli formacie danych strukturalnych odpowiednim do automatycznego przetwarzania.
Wywoływanie funkcji
Twórz przepływy pracy agentów, łącząc Gemini z zewnętrznymi interfejsami API i narzędziami.
Generowanie filmów za pomocą Veo 3.1
Twórz wysokiej jakości treści wideo na podstawie promptów tekstowych lub obrazowych za pomocą naszego najnowocześniejszego modelu.
Agenty głosowe z interfejsem Live API
Twórz aplikacje i agentów głosowych działających w czasie rzeczywistym za pomocą interfejsu Live API.
Narzędzia
Połącz Gemini ze światem za pomocą wbudowanych narzędzi, takich jak wyszukiwarka Google, kontekst adresu URL, Mapy Google, wykonywanie kodu i korzystanie z komputera.
Rozumienie dokumentów
Przetwarzaj do 1000 stron plików PDF z pełnym rozpoznawaniem multimodalnym lub innych typów plików tekstowych.
Myślę
Dowiedz się, jak możliwości myślenia poprawiają rozumowanie w przypadku złożonych zadań i agentów.
Interactions API
Od czerwca 2026 r. Interactions API stał się naszym domyślnym interfejsem i jest najlepszym sposobem na tworzenie aplikacji z wykorzystaniem modeli i agentów Gemini. Jeśli zaczynasz nowy projekt, użyj Interactions API. Interfejs generateContent API jest nadal obsługiwany, ale jest teraz uważany za starszy.
Omówienie interfejsu Interactions API
Dowiedz się, jak Interactions API zarządza stanem rozmowy, wiadomościami i formatami danych wyjściowych.
Przewodnik po migracji
Szczegółowy przewodnik, który pomoże Ci przenieść kod z interfejsu generateContent API do interfejsu Interactions API.
Streaming
Przesyłaj strumieniowo tokeny w czasie rzeczywistym, przyrostowe myśli i zdarzenia wywołania narzędzia.