W tym przewodniku znajdziesz informacje o wszystkich modelach dostępnych w interfejsie Gemini API.
Gemini 3
Stabilny
Gemini 3.6 Flash
Nasz najnowszy model, który łączy szybkość z inteligencją, aby zapewnić wysoką wydajność w zadaniach agentowych i multimodalnych.
Stabilny
Gemini 3.5 Flash
Najinteligentniejszy model, który zapewnia stałą, przełomową wydajność w zadaniach agentowych i związanych z kodowaniem.
Stabilny
Gemini 3.5 Flash-Lite
Nasz najszybszy i najbardziej ekonomiczny model 3.5 do wykonywania zadań o wysokiej przepustowości.
Stabilny
Gemini 3.1 Flash-Lite
Wydajność klasy Frontier, która dorównuje większym modelom przy ułamku kosztów.
Stabilny
Nano Banana 2
Wydajne generowanie i edytowanie obrazów o wysokiej jakości, zoptymalizowane pod kątem szybkości i dużej liczby przypadków użycia.
Stabilny
Nano Banana 2 Lite
Bardzo małe opóźnienie oraz ekonomiczne generowanie i edytowanie obrazów, zaprojektowane z myślą o interaktywnych przypadkach użycia wymagających dużych nakładów pracy.
Stabilny
Nano Banana Pro
Najnowocześniejsze modele do generowania i edytowania obrazów, które umożliwiają tworzenie wysoce kontekstowych obrazów natywnych.
Stabilny
Podgląd
Gemini 3.1 Pro
Zaawansowana inteligencja, umiejętności rozwiązywania złożonych problemów oraz zaawansowane możliwości kodowania agentów i vibe coding.
Podgląd
Gemini 3 Flash
Wydajność klasy Frontier, która dorównuje większym modelom przy ułamku kosztów.
Podgląd
Gemini 3.5 Live Translate
Model tłumaczenia mowy na mowę w czasie rzeczywistym o niskim opóźnieniu, który obsługuje ponad 70 języków.
Nowość Podgląd
Gemini 3.1 Flash Live
Wysokiej jakości model Live API o niskim czasie oczekiwania do aplikacji AI opartych na głosie i dialogach w czasie rzeczywistym.
Nowość Podgląd
Gemini 3.1 Flash TTS
Zaawansowane generowanie mowy z niskim czasem oczekiwania.
Nowość Podgląd
Gemini Omni Flash
Szybkie, konwersacyjne generowanie i edytowanie filmów. Przekształcaj tekst i obrazy w filmy oraz dopracowuj wyniki za pomocą języka naturalnego.
Nowość Podgląd
Wszystkie modele Gemini 3
| Model | Punkt końcowy |
|---|---|
| Gemini 3.1 Pro | gemini-3.1-pro-preview |
| Gemini 3.5 Flash | gemini-3.5-flash |
| Gemini 3 Flash | gemini-3-flash-preview |
| Gemini 3.1 Flash-Lite | gemini-3.1-flash-lite |
| Nano Banana 2 | gemini-3.1-flash-image |
| Nano Banana 2 Lite | gemini-3.1-flash-lite-image |
| Nano Banana Pro | gemini-3-pro-image |
| Gemini 3.5 Live Translate | gemini-3.5-live-translate-preview |
| Gemini 3.1 Flash Live | gemini-3.1-flash-live-preview |
| Gemini 3.1 Flash TTS | gemini-3.1-flash-tts-preview |
Gemini 2.5 Flash
| Model | Opis | Punkt końcowy |
|---|---|---|
| Gemini 2.5 Flash | Nasz model o najlepszym stosunku ceny do wydajności w przypadku zadań wymagających rozumowania, które charakteryzują się krótkim czasem oczekiwania i dużą liczbą zapytań. | gemini-2.5-flash |
| Nano Banana | Najnowocześniejszy model do generowania i edytowania obrazów, zaprojektowany z myślą o szybkiej pracy twórczej. | gemini-2.5-flash-image |
| Gemini 2.5 Flash Live | Zoptymalizowany pod kątem agentów konwersacyjnych działających w czasie rzeczywistym, którzy przesyłają strumieniowo dźwięk w czasie poniżej sekundy. | gemini-2.5-flash-native-audio-preview-12-2025 |
| Gemini 2.5 Flash TTS | Generowanie dźwięku za pomocą funkcji zamiany tekstu na mowę z możliwością kontrolowania stylu i tempa. | gemini-2.5-flash-preview-tts |
Gemini 2.5 Flash-Lite
| Model | Opis | Punkt końcowy |
|---|---|---|
| Gemini 2.5 Flash-Lite | Najszybszy i najbardziej przystępny cenowo model multimodalny z rodziny 2.5. | gemini-2.5-flash-lite |
Gemini 2.5 Pro
| Model | Opis | Punkt końcowy |
|---|---|---|
| Gemini 2.5 Pro | Nasz najbardziej zaawansowany model do złożonych zadań, który w ramach serii 2.5 oferuje zaawansowane możliwości rozumowania i kodowania. | gemini-2.5-pro |
| Gemini 2.5 Pro TTS | Synteza mowy o wysokiej wierności zoptymalizowana pod kątem jakości w przypadku uporządkowanych przepływów pracy, takich jak podcasty i audiobooki. | gemini-2.5-pro-preview-tts |
Modele audio
Ta sekcja zawiera wszystkie modele audio, w tym te, które mogą być już wymienione w innych sekcjach.
| Model | Opis | Punkt końcowy |
|---|---|---|
| Gemini 3.1 Flash Live | Nasz wysokiej jakości model audio-to-audio (A2A) o krótkim czasie oczekiwania, zaprojektowany z myślą o dialogach w czasie rzeczywistym i aplikacjach AI opartych na głosie. | gemini-3.1-flash-live-preview |
| Gemini 3.1 Flash TTS | Zaawansowane generowanie mowy o niskim poziomie opóźnień, z naturalnymi wynikami, sterowanymi promptami i nowymi tagami audio, które umożliwiają precyzyjną kontrolę nad narracją. | gemini-3.1-flash-tts-preview |
| Gemini 2.5 Flash Live | Nasz flagowy model Live API do dwukierunkowych agentów głosowych i wideo o krótkim czasie oczekiwania z natywnym rozumowaniem dźwięku. | gemini-2.5-flash-native-audio-preview-12-2025 |
| Gemini 2.5 Flash TTS | Szybka i łatwa w obsłudze zamiana tekstu na mowę w przypadku aplikacji o krótkim czasie oczekiwania i niskich kosztach oraz asystentów działających w czasie rzeczywistym. | gemini-2.5-flash-preview-tts |
| Gemini 2.5 Pro TTS | Synteza mowy o wysokiej wierności zoptymalizowana pod kątem jakości w przypadku uporządkowanych przepływów pracy, takich jak podcasty i audiobooki. | gemini-2.5-pro-preview-tts |
Generatywne modele multimedialne
Ta sekcja zawiera wszystkie modele generatywnych mediów, w tym te, które mogą być już wymienione w innych sekcjach.
| Model | Opis | Punkt końcowy |
|---|---|---|
| Nano Banana 2 | Wysokowydajne tworzenie wizualne na skalę produkcyjną, łączące inteligencję serii Gemini 3 z błyskawiczną szybkością generowania. | gemini-3.1-flash-image |
| Nano Banana 2 Lite | Zaprojektowany jako specjalista od wydajności w rodzinie modeli do generowania obrazów, oferujący bardzo małe opóźnienie oraz opłacalne generowanie i edytowanie obrazów. | gemini-3.1-flash-lite-image |
| Veo 3.1 | Najnowocześniejsza technologia generowania filmów o jakości kinowej z zaawansowanymi opcjami kreatywnymi i natywnie zsynchronizowanym dźwiękiem. | veo-3.1-generate-preview |
| Nano Banana Pro | Profesjonalny silnik projektowania z rdzeniem rozumowania, który umożliwia tworzenie wizualizacji w jakości 4K, złożonych układów i precyzyjnego renderowania tekstu. | gemini-3-pro-image |
| Veo 3.1 Lite | Wysoka wydajność, niskie koszty, generowanie i edytowanie filmów oraz sterowanie kinowe z myślą o programistach – wszystko to w ramach rodziny Veo 3.1. | veo-3.1-lite-generate-preview |
| Gemini Omni Flash | Szybkie, konwersacyjne generowanie i edytowanie filmów. Przekształcaj tekst i obrazy w filmy oraz dopracowuj wyniki za pomocą języka naturalnego. | gemini-omni-flash |
| Nano Banana | Najnowocześniejszy model do generowania i edytowania obrazów, zaprojektowany z myślą o szybkiej pracy twórczej. | gemini-2.5-flash-image |
| Imagen 4 (wycofany) | Model zamiany tekstu na obraz, który umożliwia szybkie i ultraszybkie generowanie obrazów o wyjątkowej wyrazistości w rozdzielczości do 2K. | imagen-4.0-generate |
Modele generowania muzyki
Ta sekcja zawiera wszystkie modele generowania muzyki, w tym te, które mogą być już wymienione w innych sekcjach.
| Model | Opis | Punkt końcowy |
|---|---|---|
| Lyria 3 Pro | Nasz flagowy model generowania muzyki zoptymalizowany pod kątem pełnych utworów o złożonej spójności strukturalnej. | lyria-3-pro-preview |
| Lyria 3 Clip | Zoptymalizowany pod kątem generowania krótkich klipów muzycznych, pętli i podglądów o długości do 30 sekund. | lyria-3-clip-preview |
| Lyria RealTime | Model do generowania muzyki w wysokiej jakości, który zapewnia szczegółową kontrolę kreatywną i możliwość przesyłania strumieniowego w czasie rzeczywistym. | lyria-realtime-exp |
Modele narzędzi i agentów
| Model | Opis | Punkt końcowy |
|---|---|---|
| Korzystanie z komputera | Specjalistyczny model, który „widzi” ekran cyfrowy i wykonuje działania w interfejsie, takie jak klikanie, pisanie i nawigowanie, aby zautomatyzować złożone zadania w przeglądarce. | gemini-2.5-computer-use-preview-10-2025 |
| Gemini Deep Research | Model agentowy, który samodzielnie planuje i przeprowadza wieloetapowe badania w setkach źródeł, aby tworzyć interaktywne raporty z cytatami. | deep-research-preview-04-2026 |
| Gemini Deep Research Max | Maksymalna kompleksowość automatycznego zbierania i syntezy kontekstu z setek źródeł. | deep-research-max-preview-04-2026 |
| Agent Antigravity | Zarządzany agent do zwykłych obciążeń, który autonomicznie planuje, rozumuje, uruchamia kod, zarządza plikami i przegląda internet w bezpiecznej, odizolowanej piaskownicy Linux. | antigravity-preview-05-2026 |
Modele do zadań specjalistycznych
| Model | Opis | Punkt końcowy |
|---|---|---|
| Gemini Embedding 2 | Nasz pierwszy model multimodalnych wektorów dystrybucyjnych, który mapuje tekst, obrazy, filmy, dźwięk i pliki PDF na ujednoliconą przestrzeń wektorów dystrybucyjnych na potrzeby zaawansowanego wyszukiwania semantycznego i systemów RAG. | gemini-embedding-2-preview |
| Gemini Embedding | Wielowymiarowe reprezentacje wektorowe do zaawansowanego wyszukiwania semantycznego, klasyfikacji tekstu i systemów RAG. | gemini-embedding-001 |
| Gemini Robotics ER 2 | Model rozumowania w świecie fizycznym, który zapewnia zaawansowane rozumienie wideo, rozumowanie przestrzenne, wieloetapową orkiestrację narzędzi i współpracę wielu robotów w zadaniach robotycznych. | gemini-robotics-er-2-preview |
| Gemini Robotics ER 1.6 | Zaawansowany model rozumowania przestrzennego, który rozumie przestrzenie fizyczne i planuje wieloetapowe zadania dla agentów robotycznych, z nowymi funkcjami, takimi jak odczytywanie instrumentów, ulepszone rozumowanie przestrzenne i fizyczne. | gemini-robotics-er-1.6-preview |
Poprzednie modele
| Model | Opis | Punkt końcowy |
|---|---|---|
| Gemini 2.0 Flash (wyłączony) | Nasz model roboczy drugiej generacji z funkcjami nowej generacji i ulepszonymi możliwościami, w tym większą szybkością, natywnym korzystaniem z narzędzi i oknem kontekstu z milionem tokenów. | gemini-2.0-flash |
| Gemini 2.0 Flash-Lite (wyłączony) | Nasz najszybszy model drugiej generacji zoptymalizowany pod kątem niskich kosztów i krótkiego czasu oczekiwania. | gemini-2.0-flash-lite |
| Gemini 3.1 Flash-Lite (wersja testowa) (wyłączona) | Nasz najbardziej opłacalny model multimodalny, który zapewnia najszybsze działanie w przypadku częstych, nietrudnych zadań. | gemini-3.1-flash-lite-preview |
| Gemini 3 Pro (wersja testowa) (wyłączona) | Nasz najnowocześniejszy model rozumowania z zaawansowanym rozpoznawaniem multimodalnym. | gemini-3-pro-preview |
Wzorce nazw wersji modelu
Modele Gemini są dostępne w wersjach stabilnych, testowych, najnowszych i eksperymentalnych.
Stabilny
Wskazuje konkretny stabilny model. Modele stabilne zwykle nie ulegają zmianom. Większość aplikacji produkcyjnych powinna korzystać z określonego stabilnego modelu.
Przykład: gemini-3.6-flash.
Podgląd
Wskazuje model w wersji testowej, który może być używany w środowisku produkcyjnym. W przypadku modeli w wersji testowej zwykle włączone są płatności, mogą one mieć bardziej restrykcyjne limity stawek i zostaną wycofane z co najmniej 2-tygodniowym wyprzedzeniem.
Przykład: gemini-2.5-flash-preview-09-2025.
Najnowsze
Wskazuje najnowszą wersję konkretnego wariantu modelu. Może to być wersja stabilna, podglądowa lub eksperymentalna. Ten alias będzie wymieniany na gorąco z każdą nową wersją konkretnego modelu. W przypadku zmian powodujących niezgodność wsteczną wyślemy e-maila z 2-tygodniowym wyprzedzeniem przed zmianą wersji, która jest starsza od najnowszej.
Przykład: gemini-flash-latest.
Wersja eksperymentalna
Wskazuje model eksperymentalny, który zwykle nie nadaje się do użytku produkcyjnego i ma bardziej restrykcyjne limity szybkości. Wypuszczamy modele eksperymentalne, aby zbierać opinie i szybko udostępniać deweloperom najnowsze aktualizacje.
Modele eksperymentalne nie są stabilne, a dostępność punktów końcowych modeli może się zmienić.
Wycofane modele
Informacje o wycofywaniu modeli znajdziesz na stronie Wycofywanie Gemini.