Modele

W tym przewodniku znajdziesz informacje o wszystkich modelach dostępnych w interfejsie Gemini API.


Gemini 3

Stabilny

Podgląd

Wszystkie modele Gemini 3

Model Punkt końcowy
Gemini 3.1 Pro
gemini-3.1-pro-preview
Gemini 3.5 Flash
gemini-3.5-flash
Gemini 3 Flash
gemini-3-flash-preview
Gemini 3.1 Flash-Lite
gemini-3.1-flash-lite
Nano Banana 2
gemini-3.1-flash-image
Nano Banana 2 Lite
gemini-3.1-flash-lite-image
Nano Banana Pro
gemini-3-pro-image
Gemini 3.5 Live Translate
gemini-3.5-live-translate-preview
Gemini 3.1 Flash Live
gemini-3.1-flash-live-preview
Gemini 3.1 Flash TTS
gemini-3.1-flash-tts-preview

Gemini 2.5 Flash

Model Opis Punkt końcowy
Gemini 2.5 Flash Nasz model o najlepszym stosunku ceny do wydajności w przypadku zadań wymagających rozumowania, które charakteryzują się krótkim czasem oczekiwania i dużą liczbą zapytań.
gemini-2.5-flash
Nano Banana Najnowocześniejszy model do generowania i edytowania obrazów, zaprojektowany z myślą o szybkiej pracy twórczej.
gemini-2.5-flash-image
Gemini 2.5 Flash Live Zoptymalizowany pod kątem agentów konwersacyjnych działających w czasie rzeczywistym, którzy przesyłają strumieniowo dźwięk w czasie poniżej sekundy.
gemini-2.5-flash-native-audio-preview-12-2025
Gemini 2.5 Flash TTS Generowanie dźwięku za pomocą funkcji zamiany tekstu na mowę z możliwością kontrolowania stylu i tempa.
gemini-2.5-flash-preview-tts

Gemini 2.5 Flash-Lite

Model Opis Punkt końcowy
Gemini 2.5 Flash-Lite Najszybszy i najbardziej przystępny cenowo model multimodalny z rodziny 2.5.
gemini-2.5-flash-lite

Gemini 2.5 Pro

Model Opis Punkt końcowy
Gemini 2.5 Pro Nasz najbardziej zaawansowany model do złożonych zadań, który w ramach serii 2.5 oferuje zaawansowane możliwości rozumowania i kodowania.
gemini-2.5-pro
Gemini 2.5 Pro TTS Synteza mowy o wysokiej wierności zoptymalizowana pod kątem jakości w przypadku uporządkowanych przepływów pracy, takich jak podcasty i audiobooki.
gemini-2.5-pro-preview-tts

Modele audio

Ta sekcja zawiera wszystkie modele audio, w tym te, które mogą być już wymienione w innych sekcjach.

Model Opis Punkt końcowy
Gemini 3.1 Flash Live Nasz wysokiej jakości model audio-to-audio (A2A) o krótkim czasie oczekiwania, zaprojektowany z myślą o dialogach w czasie rzeczywistym i aplikacjach AI opartych na głosie.
gemini-3.1-flash-live-preview
Gemini 3.1 Flash TTS Zaawansowane generowanie mowy o niskim poziomie opóźnień, z naturalnymi wynikami, sterowanymi promptami i nowymi tagami audio, które umożliwiają precyzyjną kontrolę nad narracją.
gemini-3.1-flash-tts-preview
Gemini 2.5 Flash Live Nasz flagowy model Live API do dwukierunkowych agentów głosowych i wideo o krótkim czasie oczekiwania z natywnym rozumowaniem dźwięku.
gemini-2.5-flash-native-audio-preview-12-2025
Gemini 2.5 Flash TTS Szybka i łatwa w obsłudze zamiana tekstu na mowę w przypadku aplikacji o krótkim czasie oczekiwania i niskich kosztach oraz asystentów działających w czasie rzeczywistym.
gemini-2.5-flash-preview-tts
Gemini 2.5 Pro TTS Synteza mowy o wysokiej wierności zoptymalizowana pod kątem jakości w przypadku uporządkowanych przepływów pracy, takich jak podcasty i audiobooki.
gemini-2.5-pro-preview-tts

Generatywne modele multimedialne

Ta sekcja zawiera wszystkie modele generatywnych mediów, w tym te, które mogą być już wymienione w innych sekcjach.

Model Opis Punkt końcowy
Nano Banana 2 Wysokowydajne tworzenie wizualne na skalę produkcyjną, łączące inteligencję serii Gemini 3 z błyskawiczną szybkością generowania.
gemini-3.1-flash-image
Nano Banana 2 Lite Zaprojektowany jako specjalista od wydajności w rodzinie modeli do generowania obrazów, oferujący bardzo małe opóźnienie oraz opłacalne generowanie i edytowanie obrazów.
gemini-3.1-flash-lite-image
Veo 3.1 Najnowocześniejsza technologia generowania filmów o jakości kinowej z zaawansowanymi opcjami kreatywnymi i natywnie zsynchronizowanym dźwiękiem.
veo-3.1-generate-preview
Nano Banana Pro Profesjonalny silnik projektowania z rdzeniem rozumowania, który umożliwia tworzenie wizualizacji w jakości 4K, złożonych układów i precyzyjnego renderowania tekstu.
gemini-3-pro-image
Veo 3.1 Lite Wysoka wydajność, niskie koszty, generowanie i edytowanie filmów oraz sterowanie kinowe z myślą o programistach – wszystko to w ramach rodziny Veo 3.1.
veo-3.1-lite-generate-preview
Gemini Omni Flash Szybkie, konwersacyjne generowanie i edytowanie filmów. Przekształcaj tekst i obrazy w filmy oraz dopracowuj wyniki za pomocą języka naturalnego.
gemini-omni-flash
Nano Banana Najnowocześniejszy model do generowania i edytowania obrazów, zaprojektowany z myślą o szybkiej pracy twórczej.
gemini-2.5-flash-image
Imagen 4 (wycofany) Model zamiany tekstu na obraz, który umożliwia szybkie i ultraszybkie generowanie obrazów o wyjątkowej wyrazistości w rozdzielczości do 2K.
imagen-4.0-generate

Modele generowania muzyki

Ta sekcja zawiera wszystkie modele generowania muzyki, w tym te, które mogą być już wymienione w innych sekcjach.

Model Opis Punkt końcowy
Lyria 3 Pro Nasz flagowy model generowania muzyki zoptymalizowany pod kątem pełnych utworów o złożonej spójności strukturalnej.
lyria-3-pro-preview
Lyria 3 Clip Zoptymalizowany pod kątem generowania krótkich klipów muzycznych, pętli i podglądów o długości do 30 sekund.
lyria-3-clip-preview
Lyria RealTime Model do generowania muzyki w wysokiej jakości, który zapewnia szczegółową kontrolę kreatywną i możliwość przesyłania strumieniowego w czasie rzeczywistym.
lyria-realtime-exp

Modele narzędzi i agentów

Model Opis Punkt końcowy
Korzystanie z komputera Specjalistyczny model, który „widzi” ekran cyfrowy i wykonuje działania w interfejsie, takie jak klikanie, pisanie i nawigowanie, aby zautomatyzować złożone zadania w przeglądarce.
gemini-2.5-computer-use-preview-10-2025
Gemini Deep Research Model agentowy, który samodzielnie planuje i przeprowadza wieloetapowe badania w setkach źródeł, aby tworzyć interaktywne raporty z cytatami.
deep-research-preview-04-2026
Gemini Deep Research Max Maksymalna kompleksowość automatycznego zbierania i syntezy kontekstu z setek źródeł.
deep-research-max-preview-04-2026
Agent Antigravity Zarządzany agent do zwykłych obciążeń, który autonomicznie planuje, rozumuje, uruchamia kod, zarządza plikami i przegląda internet w bezpiecznej, odizolowanej piaskownicy Linux.
antigravity-preview-05-2026

Modele do zadań specjalistycznych

Model Opis Punkt końcowy
Gemini Embedding 2 Nasz pierwszy model multimodalnych wektorów dystrybucyjnych, który mapuje tekst, obrazy, filmy, dźwięk i pliki PDF na ujednoliconą przestrzeń wektorów dystrybucyjnych na potrzeby zaawansowanego wyszukiwania semantycznego i systemów RAG.
gemini-embedding-2-preview
Gemini Embedding Wielowymiarowe reprezentacje wektorowe do zaawansowanego wyszukiwania semantycznego, klasyfikacji tekstu i systemów RAG.
gemini-embedding-001
Gemini Robotics ER 2 Model rozumowania w świecie fizycznym, który zapewnia zaawansowane rozumienie wideo, rozumowanie przestrzenne, wieloetapową orkiestrację narzędzi i współpracę wielu robotów w zadaniach robotycznych.
gemini-robotics-er-2-preview
Gemini Robotics ER 1.6 Zaawansowany model rozumowania przestrzennego, który rozumie przestrzenie fizyczne i planuje wieloetapowe zadania dla agentów robotycznych, z nowymi funkcjami, takimi jak odczytywanie instrumentów, ulepszone rozumowanie przestrzenne i fizyczne.
gemini-robotics-er-1.6-preview

Poprzednie modele

Model Opis Punkt końcowy
Gemini 2.0 Flash (wyłączony) Nasz model roboczy drugiej generacji z funkcjami nowej generacji i ulepszonymi możliwościami, w tym większą szybkością, natywnym korzystaniem z narzędzi i oknem kontekstu z milionem tokenów.
gemini-2.0-flash
Gemini 2.0 Flash-Lite (wyłączony) Nasz najszybszy model drugiej generacji zoptymalizowany pod kątem niskich kosztów i krótkiego czasu oczekiwania.
gemini-2.0-flash-lite
Gemini 3.1 Flash-Lite (wersja testowa) (wyłączona) Nasz najbardziej opłacalny model multimodalny, który zapewnia najszybsze działanie w przypadku częstych, nietrudnych zadań.
gemini-3.1-flash-lite-preview
Gemini 3 Pro (wersja testowa) (wyłączona) Nasz najnowocześniejszy model rozumowania z zaawansowanym rozpoznawaniem multimodalnym.
gemini-3-pro-preview

Wzorce nazw wersji modelu

Modele Gemini są dostępne w wersjach stabilnych, testowych, najnowszycheksperymentalnych.

Stabilny

Wskazuje konkretny stabilny model. Modele stabilne zwykle nie ulegają zmianom. Większość aplikacji produkcyjnych powinna korzystać z określonego stabilnego modelu.

Przykład: gemini-3.6-flash.

Podgląd

Wskazuje model w wersji testowej, który może być używany w środowisku produkcyjnym. W przypadku modeli w wersji testowej zwykle włączone są płatności, mogą one mieć bardziej restrykcyjne limity stawek i zostaną wycofane z co najmniej 2-tygodniowym wyprzedzeniem.

Przykład: gemini-2.5-flash-preview-09-2025.

Najnowsze

Wskazuje najnowszą wersję konkretnego wariantu modelu. Może to być wersja stabilna, podglądowa lub eksperymentalna. Ten alias będzie wymieniany na gorąco z każdą nową wersją konkretnego modelu. W przypadku zmian powodujących niezgodność wsteczną wyślemy e-maila z 2-tygodniowym wyprzedzeniem przed zmianą wersji, która jest starsza od najnowszej.

Przykład: gemini-flash-latest.

Wersja eksperymentalna

Wskazuje model eksperymentalny, który zwykle nie nadaje się do użytku produkcyjnego i ma bardziej restrykcyjne limity szybkości. Wypuszczamy modele eksperymentalne, aby zbierać opinie i szybko udostępniać deweloperom najnowsze aktualizacje.

Modele eksperymentalne nie są stabilne, a dostępność punktów końcowych modeli może się zmienić.

Wycofane modele

Informacje o wycofywaniu modeli znajdziesz na stronie Wycofywanie Gemini.