Gemini API to najszybsza droga od prompta do wdrożenia dzięki Gemini, Veo, Nano Banana i innym modelom. Umożliwia integrację tych modeli generatywnych z aplikacjami w celu generowania tekstu i obrazów, analizowania danych wejściowych multimodalnych oraz tworzenia agentów konwersacyjnych.
Interactions API to najlepszy sposób na tworzenie aplikacji za pomocą Gemini API oraz modeli i agentów Gemini. Więcej informacji znajdziesz w artykule Omówienie Interactions API.
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.6-flash",
input="Explain how AI works in a few words"
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
const interaction = await ai.interactions.create({
model: "gemini-3.6-flash",
input: "Explain how AI works in a few words",
});
console.log(interaction.output_text);
REST
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-d '{
"model": "gemini-3.6-flash",
"input": "Explain how AI works in a few words"
}'
Postępuj zgodnie z przewodnikiem dla początkujących, aby uzyskać klucz interfejsu API i wykonać pierwsze wywołanie interfejsu API w ciągu kilku minut.
Poznaj modele
Wyświetl wszystkoGemini 3.1 Pro Nowość
Nasz najbardziej inteligentny model, najlepszy na świecie pod względem rozpoznawania multimodalnego, zbudowany na bazie najnowocześniejszego rozumowania.
Gemini 3.6 Flash Nowość
Wydajność na poziomie modeli Frontier, porównywalna z większymi modelami, ale przy ułamku kosztów.
Gemini 3.5 Flash-Lite Nowość
Model o dużej przepustowości i niskich kosztach, zoptymalizowany pod kątem zadań subagentów o niskim opóźnieniu i wysokiej przepustowości.
Gemini 3 Flash
Wydajność na poziomie modeli Frontier, porównywalna z większymi modelami, ale przy ułamku kosztów.
🍌 Nano Banana 2 i Nano Banana Pro
Najnowocześniejsze modele do generowania i edytowania obrazów.
Veo 3.1
Nasz najnowocześniejszy model do generowania filmów z wbudowanym dźwiękiem.
Gemini Robotics
Model wizyjno-językowy (VLM), który przenosi możliwości agentowe Gemini do robotyki i umożliwia zaawansowane wnioskowanie w świecie fizycznym.
Poznaj możliwości
Generowanie obrazów (Nano Banana)
Generuj i edytuj obrazy w wysokim kontekście za pomocą Gemini 2.5 Flash Image.
Długi kontekst
Wprowadzaj do modeli Gemini miliony tokenów i wyciągaj wnioski z nieustrukturyzowanych obrazów, filmów i dokumentów.
Uporządkowane dane wyjściowe
Ogranicz Gemini do odpowiadania w formacie JSON, czyli formacie danych strukturalnych odpowiednim do automatycznego przetwarzania.
Wywoływanie funkcji
Twórz przepływy pracy agentów, łącząc Gemini z zewnętrznymi interfejsami API i narzędziami.
Generowanie filmów za pomocą Veo 3.1
Twórz wysokiej jakości treści wideo na podstawie promptów tekstowych lub obrazowych za pomocą naszego najnowocześniejszego modelu.
Agenty głosowe z Live API
Twórz aplikacje i agentów głosowych działających w czasie rzeczywistym za pomocą Live API.
Narzędzia
Połącz Gemini ze światem za pomocą wbudowanych narzędzi, takich jak wyszukiwarka Google, kontekst adresu URL, Mapy Google, wykonywanie kodu i korzystanie z komputera.
Rozumienie dokumentów
Przetwarzaj do 1000 stron plików PDF z pełnym rozpoznawaniem multimodalnym lub innych typów plików tekstowych.
Myślę
Dowiedz się, jak możliwości myślenia poprawiają rozumowanie w przypadku złożonych zadań i agentów.