W tym przewodniku znajdziesz informacje o wszystkich modelach dostępnych w interfejsie Gemini API.
Gemini 3
Stabilny
Gemini 3.8 Flash
Nasz najbardziej inteligentny model Flash, zaprojektowany z myślą o długofalowej inżynierii oprogramowania, autonomicznych agentach i złożonych firmowych przepływach pracy.
Nowa stabilna
Gemini 3.8 Live
Domyślny model Live API w przypadku większości funkcji głosowych agenta z krótkim czasem oczekiwania, które nie wymagają opóźnień w rozumowaniu.
Nowa stabilna
Gemini 3.8 Live Extended Thinking
Model Live API o wysokim poziomie rozumowania do interakcji głosowych, zalecany, gdy wymagane jest bardziej zaawansowane rozumowanie w tle.
Nowa stabilna
Gemini 3.7 Flash
Nasz model Flash poprzedniej generacji do złożonego kodowania, przepływów pracy opartych na agentach i niezawodnego wykonywania wieloetapowego.
Stabilny
Gemini 3.6 Flash
Model Flash poprzedniej generacji, który łączy szybkość i możliwości multimodalne w przypadku ogólnych zadań opartych na agentach i codziennych czynności.
Stabilny
Gemini 3.5 Flash
Nasz starszy model Flash, który zapewnia podstawową szybkość i wydajność w przypadku rutynowych zadań o wysokiej przepustowości.
Stabilny
Gemini 3.5 Flash-Lite
Nasz najszybszy i najbardziej ekonomiczny model 3.5 do wykonywania zadań o dużej przepustowości.
Stabilny
Gemini 3.1 Flash-Lite
Wydajność na poziomie modeli klasy Frontier, porównywalna z większymi modelami, ale przy ułamku kosztów.
Stabilny
Nano Banana 2
Wydajne generowanie i edytowanie obrazów o wysokiej jakości, zoptymalizowane pod kątem szybkości i dużej liczby przypadków użycia.
Stabilny
Nano Banana 2 Lite
Bardzo małe opóźnienie i ekonomiczne generowanie oraz edytowanie obrazów, zaprojektowane z myślą o interaktywnych przypadkach użycia o dużej liczbie zapytań.
Stabilny
Nano Banana Pro
Najnowocześniejsze modele do generowania i edytowania obrazów, które umożliwiają tworzenie wysoce kontekstowych obrazów natywnych.
Stabilny
Gemini 3.5 Transcribe
Model mowy na tekst o niskim poziomie opóźnień z wykrywaniem języka na podstawie wypowiedzi, rozdzielaniem rozmówców i sygnaturami czasowymi słów.
Nowa stabilna
Podgląd
Gemini 3.1 Pro
Zaawansowana inteligencja, umiejętności rozwiązywania złożonych problemów oraz zaawansowane możliwości kodowania agentów i vibe coding.
Podgląd
Gemini 3 Flash
Wydajność na poziomie modeli klasy Frontier, porównywalna z większymi modelami, ale przy ułamku kosztów.
Podgląd
Gemini 3.5 Live Translate
Model tłumaczenia mowy na mowę w czasie rzeczywistym z krótkim czasem oczekiwania, który obsługuje ponad 70 języków.
Nowość
Gemini 3.1 Flash Live
Model podglądu starszej wersji interfejsu Live API. Zalecamy aktualizację do Gemini 3.8 Live.
Nowość
Gemini 3.1 Flash TTS
Zaawansowane generowanie mowy z krótkim czasem oczekiwania.
Nowość
Gemini Omni Flash
Szybkie generowanie, edytowanie, interpolacja klatek kluczowych i rozszerzanie filmów z natywnym dźwiękiem.
Nowość
Wszystkie modele Gemini 3
| Model | Punkt końcowy |
|---|---|
| Gemini 3.8 Flash | gemini-3.8-flash |
| Gemini 3.8 Live | gemini-3.8-live |
| Gemini 3.8 Live Extended Thinking | gemini-3.8-live-extended-thinking |
| Gemini 3.7 Flash | gemini-3.7-flash |
| Gemini 3.6 Flash | gemini-3.6-flash |
| Gemini 3.5 Flash | gemini-3.5-flash |
| Gemini 3.5 Flash-Lite | gemini-3.5-flash-lite |
| Gemini 3.1 Flash-Lite | gemini-3.1-flash-lite |
| Nano Banana 2 | gemini-3.1-flash-image |
| Nano Banana 2 Lite | gemini-3.1-flash-lite-image |
| Nano Banana Pro | gemini-3-pro-image |
| Gemini 3.1 Pro | gemini-3.1-pro-preview |
| Gemini 3 Flash | gemini-3-flash-preview |
| Gemini 3.5 Live Translate | gemini-3.5-live-translate-preview |
| Gemini 3.1 Flash Live | gemini-3.1-flash-live-preview |
| Gemini 3.1 Flash TTS | gemini-3.1-flash-tts-preview |
| Gemini Omni Flash | gemini-omni-1.1-flash |
| Gemini 3.5 Transcribe | gemini-3.5-transcribe |
Gemini 2.5 Flash
| Model | Opis | Punkt końcowy |
|---|---|---|
| Gemini 2.5 Flash | Nasz model o najlepszym stosunku ceny do wydajności w przypadku zadań wymagających rozumowania, które charakteryzują się krótkim czasem oczekiwania i dużą liczbą zapytań. | gemini-2.5-flash |
| Nano Banana | Najnowocześniejszy model do generowania i edytowania obrazów, zaprojektowany z myślą o szybkiej pracy twórczej. | gemini-2.5-flash-image |
| Gemini 2.5 Flash Live | Zoptymalizowany pod kątem agentów konwersacyjnych działających w czasie rzeczywistym z natywnym strumieniowaniem dźwięku w czasie poniżej sekundy. | gemini-2.5-flash-native-audio-preview-12-2025 |
| Gemini 2.5 Flash TTS | Generowanie dźwięku za pomocą funkcji zamiany tekstu na mowę z precyzyjną kontrolą stylu i tempa. | gemini-2.5-flash-preview-tts |
Gemini 2.5 Flash-Lite
| Model | Opis | Punkt końcowy |
|---|---|---|
| Gemini 2.5 Flash-Lite | Najszybszy i najbardziej przystępny cenowo model multimodalny z rodziny 2.5. | gemini-2.5-flash-lite |
Gemini 2.5 Pro
| Model | Opis | Punkt końcowy |
|---|---|---|
| Gemini 2.5 Pro | Nasz najbardziej zaawansowany model do złożonych zadań, który w ramach serii 2.5 oferuje zaawansowane możliwości rozumowania i kodowania. | gemini-2.5-pro |
| Gemini 2.5 Pro TTS | Synteza mowy o wysokiej wierności zoptymalizowana pod kątem jakości w przypadku uporządkowanych przepływów pracy, takich jak podcasty i audiobooki. | gemini-2.5-pro-preview-tts |
Modele audio
Ta sekcja zawiera wszystkie modele audio, w tym te, które mogą być już wymienione w innych sekcjach.
| Model | Opis | Punkt końcowy |
|---|---|---|
| Gemini 3.8 Live | Domyślna opcja w przypadku większości agentów głosowych o krótkim czasie oczekiwania i dialogów w czasie rzeczywistym bez opóźnień w rozumowaniu. | gemini-3.8-live |
| Gemini 3.8 Live Extended Thinking | Nasz model audio-to-audio o zaawansowanym rozumowaniu, zalecany, gdy podczas interakcji na żywo wymagane jest bardziej zaawansowane rozumowanie w tle. | gemini-3.8-live-extended-thinking |
| Gemini 3.1 Flash Live | Starszy model podglądu audio-to-audio. Zalecamy aktualizację do Gemini 3.8 Live. | gemini-3.1-flash-live-preview |
| Gemini 3.1 Flash TTS | Zaawansowane generowanie mowy o niskim poziomie opóźnień, z naturalnymi wynikami, sterowanymi promptami i nowymi ekspresyjnymi tagami audio, które zapewniają precyzyjną kontrolę nad narracją. | gemini-3.1-flash-tts-preview |
| Gemini 3.5 Transcribe | Model mowy na tekst o niskim poziomie opóźnień z wykrywaniem języka na podstawie wypowiedzi, rozdzielaniem rozmówców, sygnaturami czasowymi na poziomie słów i rozpoznawaniem słów z uwzględnieniem kontekstu. | gemini-3.5-transcribe |
| Gemini 2.5 Flash Live | Nasz flagowy model Live API do dwukierunkowych agentów głosowych i wideo o krótkim czasie oczekiwania z natywnym rozumowaniem dźwięku. | gemini-2.5-flash-native-audio-preview-12-2025 |
| Gemini 2.5 Flash TTS | Szybka i łatwa w obsłudze zamiana tekstu na mowę w przypadku aplikacji o krótkim czasie oczekiwania i niskich kosztach oraz asystentów działających w czasie rzeczywistym. | gemini-2.5-flash-preview-tts |
| Gemini 2.5 Pro TTS | Synteza mowy o wysokiej wierności zoptymalizowana pod kątem jakości w przypadku uporządkowanych przepływów pracy, takich jak podcasty i audiobooki. | gemini-2.5-pro-preview-tts |
Generatywne modele multimedialne
Ta sekcja zawiera wszystkie modele generatywnych mediów, w tym te, które mogą być już wymienione w innych sekcjach.
| Model | Opis | Punkt końcowy |
|---|---|---|
| Nano Banana 2 | Wysokowydajne tworzenie wizualne na skalę produkcyjną, łączące inteligencję serii Gemini 3 z błyskawiczną szybkością generowania. | gemini-3.1-flash-image |
| Nano Banana 2 Lite | Zaprojektowany jako specjalista od wydajności w rodzinie modeli do generowania obrazów. Zapewnia bardzo krótki czas oczekiwania oraz ekonomiczne generowanie i edytowanie obrazów. | gemini-3.1-flash-lite-image |
| Veo 3.1 | Najnowocześniejsza technologia generowania filmów z zaawansowanymi opcjami kreatywnymi i natywnie zsynchronizowanym dźwiękiem. | veo-3.1-generate-preview |
| Nano Banana Pro | Profesjonalny silnik projektowania z rdzeniem rozumowania, który umożliwia tworzenie wizualizacji w jakości 4K, złożonych układów i precyzyjnego renderowania tekstu. | gemini-3-pro-image |
| Veo 3.1 Lite | Wysoka wydajność, niskie koszty, generowanie i edytowanie filmów oraz sterowanie kinowe z myślą o programistach – wszystko to w ramach rodziny Veo 3.1. | veo-3.1-lite-generate-preview |
| Gemini Omni Flash | Szybkie generowanie, edytowanie, interpolacja klatek kluczowych i rozszerzanie filmów z natywnym dźwiękiem. | gemini-omni-1.1-flash |
| Nano Banana | Najnowocześniejszy model do generowania i edytowania obrazów, zaprojektowany z myślą o szybkiej pracy twórczej. | gemini-2.5-flash-image |
| Imagen 4 (wycofany) | Model zamiany tekstu na obraz, który umożliwia szybkie i ultraszybkie generowanie obrazów o wyjątkowej wyrazistości w rozdzielczości do 2K. | imagen-4.0-generate |
Modele generowania muzyki
Ta sekcja zawiera wszystkie modele generowania muzyki, w tym te, które mogą być już wymienione w innych sekcjach.
| Model | Opis | Punkt końcowy |
|---|---|---|
| Lyria 3.5 | Nasz flagowy model generowania muzyki zoptymalizowany pod kątem pełnych utworów o złożonej spójności strukturalnej. | lyria-3.5 |
| Lyria 3 Clip | Zoptymalizowany pod kątem generowania krótkich klipów muzycznych, pętli i podglądów trwających do 30 sekund. | lyria-3-clip-preview |
| Lyria 3 Pro | Model poprzedniej generacji do generowania muzyki pełnych utworów. | lyria-3-pro-preview |
| Lyria RealTime | Model do generowania muzyki w wysokiej jakości, który zapewnia szczegółową kontrolę kreatywną i możliwość przesyłania strumieniowego w czasie rzeczywistym. | lyria-realtime-exp |
Modele narzędzi i agentów
| Model | Opis | Punkt końcowy |
|---|---|---|
| Korzystanie z komputera | Specjalistyczny model, który „widzi” ekran cyfrowy i wykonuje działania w interfejsie, takie jak klikanie, wpisywanie tekstu i poruszanie się po nim, aby automatyzować złożone zadania w przeglądarce. | gemini-2.5-computer-use-preview-10-2025 |
| Deep Research w Gemini | Model agentowy, który samodzielnie planuje i przeprowadza wieloetapowe badania w setkach źródeł, aby tworzyć interaktywne raporty z cytatami. | deep-research-preview-04-2026 |
| Gemini Deep Research Max | Maksymalna kompleksowość automatycznego zbierania i syntezy kontekstu z setek źródeł. | deep-research-max-preview-04-2026 |
| Agent Antigravity | Zarządzany agent do zwykłych obciążeń, który autonomicznie planuje, rozumuje, uruchamia kod, zarządza plikami i przegląda internet w bezpiecznej, odizolowanej piaskownicy Linux. | antigravity-preview-05-2026 |
Modele do zadań specjalistycznych
| Model | Opis | Punkt końcowy |
|---|---|---|
| Gemini Embedding 2 | Nasz pierwszy multimodalny model wektorów dystrybucyjnych, który mapuje tekst, obrazy, filmy, dźwięk i pliki PDF w ujednoliconej przestrzeni wektorów dystrybucyjnych na potrzeby zaawansowanego wyszukiwania semantycznego i systemów RAG. | gemini-embedding-2-preview |
| Gemini Embedding | Wielowymiarowe reprezentacje wektorowe do zaawansowanego wyszukiwania semantycznego, klasyfikacji tekstu i systemów RAG. | gemini-embedding-001 |
| Gemini Robotics ER 2 | Model rozumowania w świecie fizycznym, który zapewnia zaawansowane rozumienie wideo, rozumowanie przestrzenne, wieloetapową orkiestrację narzędzi i współpracę wielu robotów w zadaniach robotycznych. | gemini-robotics-er-2-preview |
| Gemini Robotics ER 1.6 | Zaawansowany model rozumowania przestrzennego, który rozumie przestrzenie fizyczne i planuje wieloetapowe zadania dla agentów robotycznych, z nowymi funkcjami, takimi jak odczytywanie instrumentów, ulepszone rozumowanie przestrzenne i fizyczne. | gemini-robotics-er-1.6-preview |
Poprzednie modele
| Model | Opis | Punkt końcowy |
|---|---|---|
| Gemini 2.0 Flash (wyłączony) | Nasz model roboczy drugiej generacji z funkcjami nowej generacji i ulepszonymi możliwościami, w tym większą szybkością, natywnym korzystaniem z narzędzi i oknem kontekstu o wielkości 1 mln tokenów. | gemini-2.0-flash |
| Gemini 2.0 Flash-Lite (wyłączony) | Nasz najszybszy model drugiej generacji zoptymalizowany pod kątem niskich kosztów i krótkiego czasu oczekiwania. | gemini-2.0-flash-lite |
| Gemini 3.1 Flash-Lite (wersja testowa) (wyłączona) | Nasz najbardziej opłacalny model multimodalny, który zapewnia najszybsze działanie w przypadku częstych, nietrudnych zadań. | gemini-3.1-flash-lite-preview |
| Gemini 3 Pro (wersja testowa) (wyłączona) | Nasz najnowocześniejszy model rozumowania z zaawansowanym rozpoznawaniem multimodalnym. | gemini-3-pro-preview |
Wzorce nazw wersji modelu
Modele Gemini są dostępne w wersjach stabilnych, testowych, najnowszych i eksperymentalnych.
Stabilny
Wskazuje konkretny stabilny model. Modele stabilne zwykle się nie zmieniają. Większość aplikacji produkcyjnych powinna korzystać z określonego stabilnego modelu.
Przykład: gemini-3.6-flash.
Podgląd
Wskazuje model w wersji testowej, który może być używany w środowisku produkcyjnym. Modele w wersji testowej będą zwykle miały włączone rozliczenia, mogą mieć bardziej restrykcyjne limity stawek i zostaną wycofane z co najmniej 2-tygodniowym wyprzedzeniem.
Przykład: gemini-2.5-flash-preview-09-2025.
Najnowsze
Wskazuje najnowszą wersję konkretnego wariantu modelu. Może to być wersja stabilna, podglądowa lub eksperymentalna. Ten alias będzie wymieniany na gorąco z każdą nową wersją konkretnego wariantu modelu. W przypadku zmian powodujących niezgodność wsteczną wyślemy e-maila z 2-tygodniowym wyprzedzeniem przed zmianą wersji starszej od najnowszej.
Przykład: gemini-flash-latest.
Wersja eksperymentalna
Wskazuje model eksperymentalny, który zwykle nie nadaje się do użytku produkcyjnego i ma bardziej restrykcyjne limity szybkości. Wypuszczamy modele eksperymentalne, aby zbierać opinie i szybko udostępniać deweloperom najnowsze aktualizacje.
Modele eksperymentalne nie są stabilne, a dostępność punktów końcowych modeli może się zmienić.
Wycofane modele
Informacje o wycofywaniu modeli znajdziesz na stronie Wycofywanie Gemini.