W tym przewodniku znajdziesz informacje o wszystkich modelach dostępnych w interfejsie Gemini API.
Gemini 3
Stabilny
Gemini 3.8 Flash
Nasz najbardziej inteligentny model Flash, zaprojektowany z myślą o długoterminowej inżynierii oprogramowania, autonomicznych agentach i złożonych przepływach pracy w firmach.
Nowa stabilna
Gemini 3.7 Flash
Nasz model Flash poprzedniej generacji do złożonego kodowania, przepływów pracy opartych na agentach i niezawodnego wykonywania wieloetapowego.
Stabilny
Gemini 3.6 Flash
Model Flash poprzedniej generacji, który łączy szybkość i możliwości multimodalne w przypadku ogólnych zadań opartych na agentach i codziennych czynności.
Stabilny
Gemini 3.5 Flash
Nasz starszy model Flash, który zapewnia podstawową szybkość i wydajność w przypadku rutynowych zadań o wysokiej przepustowości.
Stabilny
Gemini 3.5 Flash-Lite
Nasz najszybszy i najbardziej ekonomiczny model 3.5 do wykonywania zadań o dużej przepustowości.
Stabilny
Gemini 3.1 Flash-Lite
Wydajność na poziomie modeli klasy Frontier, porównywalna z większymi modelami, ale przy ułamku kosztów.
Stabilny
Nano Banana 2
Wydajne generowanie i edytowanie obrazów o wysokiej jakości, zoptymalizowane pod kątem szybkości i dużej liczby przypadków użycia.
Stabilny
Nano Banana 2 Lite
Bardzo małe opóźnienie i ekonomiczne generowanie oraz edytowanie obrazów, zaprojektowane z myślą o interaktywnych przypadkach użycia o dużej liczbie zapytań.
Stabilny
Nano Banana Pro
Najnowocześniejsze modele do generowania i edytowania obrazów, które umożliwiają tworzenie wysoce kontekstowych obrazów natywnych.
Stabilny
Gemini 3.5 Transcribe
Model mowy na tekst o niskim poziomie opóźnień z wykrywaniem języka na podstawie wypowiedzi, rozdzielaniem rozmówców i sygnaturami czasowymi słów.
Nowa stabilna
Podgląd
Gemini 3.1 Pro
Zaawansowana inteligencja, umiejętności rozwiązywania złożonych problemów oraz zaawansowane możliwości kodowania agentów i vibe coding.
Podgląd
Gemini 3 Flash
Wydajność na poziomie modeli klasy Frontier, porównywalna z większymi modelami, ale przy ułamku kosztów.
Podgląd
Gemini 3.5 Live Translate
Model tłumaczenia mowy na mowę w czasie rzeczywistym z krótkim czasem oczekiwania, który obsługuje ponad 70 języków.
Nowość
Gemini 3.1 Flash Live
Wysokiej jakości model Live API o krótkim czasie oczekiwania do aplikacji AI opartych na głosie i dialogach w czasie rzeczywistym.
Nowość
Gemini 3.1 Flash TTS
Zaawansowane generowanie mowy z krótkim czasem oczekiwania.
Nowość
Gemini Omni Flash
Szybkie generowanie, edytowanie, interpolacja klatek kluczowych i rozszerzanie filmów z natywnym dźwiękiem.
Nowość
Wszystkie modele Gemini 3
| Model | Punkt końcowy |
|---|---|
| Gemini 3.8 Flash | gemini-3.8-flash |
| Gemini 3.7 Flash | gemini-3.7-flash |
| Gemini 3.6 Flash | gemini-3.6-flash |
| Gemini 3.5 Flash | gemini-3.5-flash |
| Gemini 3.5 Flash-Lite | gemini-3.5-flash-lite |
| Gemini 3.1 Flash-Lite | gemini-3.1-flash-lite |
| Nano Banana 2 | gemini-3.1-flash-image |
| Nano Banana 2 Lite | gemini-3.1-flash-lite-image |
| Nano Banana Pro | gemini-3-pro-image |
| Gemini 3.1 Pro | gemini-3.1-pro-preview |
| Gemini 3 Flash | gemini-3-flash-preview |
| Gemini 3.5 Live Translate | gemini-3.5-live-translate-preview |
| Gemini 3.1 Flash Live | gemini-3.1-flash-live-preview |
| Gemini 3.1 Flash TTS | gemini-3.1-flash-tts-preview |
| Gemini Omni Flash | gemini-omni-1.1-flash |
| Gemini 3.5 Transcribe | gemini-3.5-transcribe |
Gemini 2.5 Flash
| Model | Opis | Punkt końcowy |
|---|---|---|
| Gemini 2.5 Flash | Nasz model o najlepszym stosunku ceny do wydajności w przypadku zadań wymagających rozumowania, które charakteryzują się krótkim czasem oczekiwania i dużą liczbą zapytań. | gemini-2.5-flash |
| Nano Banana | Najnowocześniejszy model do generowania i edytowania obrazów, zaprojektowany z myślą o szybkiej pracy twórczej. | gemini-2.5-flash-image |
| Gemini 2.5 Flash Live | Zoptymalizowany pod kątem agentów konwersacyjnych działających w czasie rzeczywistym z natywnym strumieniowaniem dźwięku w czasie poniżej sekundy. | gemini-2.5-flash-native-audio-preview-12-2025 |
| Gemini 2.5 Flash TTS | Generowanie dźwięku za pomocą funkcji zamiany tekstu na mowę z precyzyjną kontrolą stylu i tempa. | gemini-2.5-flash-preview-tts |
Gemini 2.5 Flash-Lite
| Model | Opis | Punkt końcowy |
|---|---|---|
| Gemini 2.5 Flash-Lite | Najszybszy i najbardziej przystępny cenowo model multimodalny z rodziny 2.5. | gemini-2.5-flash-lite |
Gemini 2.5 Pro
| Model | Opis | Punkt końcowy |
|---|---|---|
| Gemini 2.5 Pro | Nasz najbardziej zaawansowany model do złożonych zadań, który w ramach serii 2.5 oferuje zaawansowane możliwości rozumowania i kodowania. | gemini-2.5-pro |
| Gemini 2.5 Pro TTS | Synteza mowy o wysokiej wierności zoptymalizowana pod kątem jakości w przypadku uporządkowanych przepływów pracy, takich jak podcasty i audiobooki. | gemini-2.5-pro-preview-tts |
Modele audio
Ta sekcja zawiera wszystkie modele audio, w tym te, które mogą być już wymienione w innych sekcjach.
| Model | Opis | Punkt końcowy |
|---|---|---|
| Gemini 3.1 Flash Live | Nasz wysokiej jakości model audio-to-audio (A2A) o krótkim czasie oczekiwania, zaprojektowany z myślą o dialogach w czasie rzeczywistym i aplikacjach AI opartych na głosie. | gemini-3.1-flash-live-preview |
| Gemini 3.1 Flash TTS | Zaawansowane generowanie mowy o niskim poziomie opóźnień, z naturalnymi wynikami, sterowanymi promptami i nowymi ekspresyjnymi tagami audio, które zapewniają precyzyjną kontrolę nad narracją. | gemini-3.1-flash-tts-preview |
| Gemini 3.5 Transcribe | Model mowy na tekst o niskim poziomie opóźnień z wykrywaniem języka na podstawie wypowiedzi, rozdzielaniem rozmówców, sygnaturami czasowymi na poziomie słów i rozpoznawaniem słów z uwzględnieniem kontekstu. | gemini-3.5-transcribe |
| Gemini 2.5 Flash Live | Nasz flagowy model Live API do dwukierunkowych agentów głosowych i wideo o krótkim czasie oczekiwania z natywnym rozumowaniem dźwięku. | gemini-2.5-flash-native-audio-preview-12-2025 |
| Gemini 2.5 Flash TTS | Szybka i łatwa w obsłudze zamiana tekstu na mowę w przypadku aplikacji o krótkim czasie oczekiwania i niskich kosztach oraz asystentów działających w czasie rzeczywistym. | gemini-2.5-flash-preview-tts |
| Gemini 2.5 Pro TTS | Synteza mowy o wysokiej wierności zoptymalizowana pod kątem jakości w przypadku uporządkowanych przepływów pracy, takich jak podcasty i audiobooki. | gemini-2.5-pro-preview-tts |
Generatywne modele multimedialne
Ta sekcja zawiera wszystkie modele generatywnych mediów, w tym te, które mogą być już wymienione w innych sekcjach.
| Model | Opis | Punkt końcowy |
|---|---|---|
| Nano Banana 2 | Wysokowydajne tworzenie wizualne na skalę produkcyjną, łączące inteligencję serii Gemini 3 z błyskawiczną szybkością generowania. | gemini-3.1-flash-image |
| Nano Banana 2 Lite | Zaprojektowany jako specjalista od wydajności w rodzinie modeli do generowania obrazów. Zapewnia bardzo krótki czas oczekiwania oraz ekonomiczne generowanie i edytowanie obrazów. | gemini-3.1-flash-lite-image |
| Veo 3.1 | Najnowocześniejsza technologia generowania filmów z zaawansowanymi opcjami kreatywnymi i natywnie zsynchronizowanym dźwiękiem. | veo-3.1-generate-preview |
| Nano Banana Pro | Profesjonalny silnik projektowania z rdzeniem rozumowania, który umożliwia tworzenie wizualizacji w jakości 4K, złożonych układów i precyzyjnego renderowania tekstu. | gemini-3-pro-image |
| Veo 3.1 Lite | Wysoka wydajność, niskie koszty, generowanie i edytowanie filmów oraz sterowanie kinowe z myślą o programistach – wszystko to w ramach rodziny Veo 3.1. | veo-3.1-lite-generate-preview |
| Gemini Omni Flash | Szybkie generowanie, edytowanie, interpolacja klatek kluczowych i rozszerzanie filmów z natywnym dźwiękiem. | gemini-omni-1.1-flash |
| Nano Banana | Najnowocześniejszy model do generowania i edytowania obrazów, zaprojektowany z myślą o szybkiej pracy twórczej. | gemini-2.5-flash-image |
| Imagen 4 (wycofany) | Model zamiany tekstu na obraz, który umożliwia szybkie i ultraszybkie generowanie obrazów o wyjątkowej wyrazistości w rozdzielczości do 2K. | imagen-4.0-generate |
Modele generowania muzyki
Ta sekcja zawiera wszystkie modele generowania muzyki, w tym te, które mogą być już wymienione w innych sekcjach.
| Model | Opis | Punkt końcowy |
|---|---|---|
| Lyria 3.5 | Nasz flagowy model generowania muzyki zoptymalizowany pod kątem pełnych utworów o złożonej spójności strukturalnej. | lyria-3.5 |
| Lyria 3 Clip | Zoptymalizowany pod kątem generowania krótkich klipów muzycznych, pętli i podglądów trwających do 30 sekund. | lyria-3-clip-preview |
| Lyria 3 Pro | Model poprzedniej generacji do generowania muzyki pełnych utworów. | lyria-3-pro-preview |
| Lyria RealTime | Model do generowania muzyki w wysokiej jakości, który zapewnia szczegółową kontrolę kreatywną i możliwość przesyłania strumieniowego w czasie rzeczywistym. | lyria-realtime-exp |
Modele narzędzi i agentów
| Model | Opis | Punkt końcowy |
|---|---|---|
| Korzystanie z komputera | Specjalistyczny model, który „widzi” ekran cyfrowy i wykonuje działania w interfejsie, takie jak klikanie, wpisywanie tekstu i poruszanie się po nim, aby automatyzować złożone zadania w przeglądarce. | gemini-2.5-computer-use-preview-10-2025 |
| Deep Research w Gemini | Model agentowy, który samodzielnie planuje i przeprowadza wieloetapowe badania w setkach źródeł, aby tworzyć interaktywne raporty z cytatami. | deep-research-preview-04-2026 |
| Gemini Deep Research Max | Maksymalna kompleksowość automatycznego zbierania i syntezy kontekstu z setek źródeł. | deep-research-max-preview-04-2026 |
| Agent Antigravity | Zarządzany agent do zwykłych obciążeń, który autonomicznie planuje, rozumuje, uruchamia kod, zarządza plikami i przegląda internet w bezpiecznej, odizolowanej piaskownicy Linux. | antigravity-preview-05-2026 |
Modele do zadań specjalistycznych
| Model | Opis | Punkt końcowy |
|---|---|---|
| Gemini Embedding 2 | Nasz pierwszy multimodalny model wektorów dystrybucyjnych, który mapuje tekst, obrazy, filmy, dźwięk i pliki PDF w ujednoliconej przestrzeni wektorów dystrybucyjnych na potrzeby zaawansowanego wyszukiwania semantycznego i systemów RAG. | gemini-embedding-2-preview |
| Gemini Embedding | Wielowymiarowe reprezentacje wektorowe do zaawansowanego wyszukiwania semantycznego, klasyfikacji tekstu i systemów RAG. | gemini-embedding-001 |
| Gemini Robotics ER 2 | Model rozumowania w świecie fizycznym, który zapewnia zaawansowane rozumienie wideo, rozumowanie przestrzenne, wieloetapową orkiestrację narzędzi i współpracę wielu robotów w zadaniach robotycznych. | gemini-robotics-er-2-preview |
| Gemini Robotics ER 1.6 | Zaawansowany model rozumowania przestrzennego, który rozumie przestrzenie fizyczne i planuje wieloetapowe zadania dla agentów robotycznych, z nowymi funkcjami, takimi jak odczytywanie instrumentów, ulepszone rozumowanie przestrzenne i fizyczne. | gemini-robotics-er-1.6-preview |
Poprzednie modele
| Model | Opis | Punkt końcowy |
|---|---|---|
| Gemini 2.0 Flash (wyłączony) | Nasz model roboczy drugiej generacji z funkcjami nowej generacji i ulepszonymi możliwościami, w tym większą szybkością, natywnym korzystaniem z narzędzi i oknem kontekstu o wielkości 1 mln tokenów. | gemini-2.0-flash |
| Gemini 2.0 Flash-Lite (wyłączony) | Nasz najszybszy model drugiej generacji zoptymalizowany pod kątem niskich kosztów i krótkiego czasu oczekiwania. | gemini-2.0-flash-lite |
| Gemini 3.1 Flash-Lite (wersja testowa) (wyłączona) | Nasz najbardziej opłacalny model multimodalny, który zapewnia najszybsze działanie w przypadku częstych, nietrudnych zadań. | gemini-3.1-flash-lite-preview |
| Gemini 3 Pro (wersja testowa) (wyłączona) | Nasz najnowocześniejszy model rozumowania z zaawansowanym rozpoznawaniem multimodalnym. | gemini-3-pro-preview |
Wzorce nazw wersji modelu
Modele Gemini są dostępne w wersjach stabilnych, testowych, najnowszych i eksperymentalnych.
Stabilny
Wskazuje konkretny stabilny model. Modele stabilne zwykle się nie zmieniają. Większość aplikacji produkcyjnych powinna korzystać z określonego stabilnego modelu.
Przykład: gemini-3.6-flash.
Podgląd
Wskazuje model w wersji testowej, który może być używany w środowisku produkcyjnym. Modele w wersji testowej będą zwykle miały włączone rozliczenia, mogą mieć bardziej restrykcyjne limity stawek i zostaną wycofane z co najmniej 2-tygodniowym wyprzedzeniem.
Przykład: gemini-2.5-flash-preview-09-2025.
Najnowsze
Wskazuje najnowszą wersję konkretnego wariantu modelu. Może to być wersja stabilna, podglądowa lub eksperymentalna. Ten alias będzie wymieniany na gorąco z każdą nową wersją konkretnego wariantu modelu. W przypadku zmian powodujących niezgodność wsteczną wyślemy e-maila z 2-tygodniowym wyprzedzeniem przed zmianą wersji starszej od najnowszej.
Przykład: gemini-flash-latest.
Wersja eksperymentalna
Wskazuje model eksperymentalny, który zwykle nie nadaje się do użytku produkcyjnego i ma bardziej restrykcyjne limity szybkości. Wypuszczamy modele eksperymentalne, aby zbierać opinie i szybko udostępniać deweloperom najnowsze aktualizacje.
Modele eksperymentalne nie są stabilne, a dostępność punktów końcowych modeli może się zmienić.
Wycofane modele
Informacje o wycofywaniu modeli znajdziesz na stronie Wycofywanie Gemini.