Modele Gemini 3.6 Flash (gemini-3.6-flash) i Gemini 3.5 Flash-Lite (gemini-3.5-flash-lite) są ogólnie dostępne i gotowe do użytku produkcyjnego.
- Gemini 3.6 Flash: większa wydajność w przypadku złożonych zadań agentowych i wielomodalnych przy jednoczesnym zmniejszeniu zużycia tokenów i niższej cenie niż w przypadku modelu 3.5 Flash.
- Gemini 3.5 Flash-Lite: najszybszy i najtańszy model z rodziny 3.5. Przewyższa poprzednie generacje Flash-Lite pod względem wykonywania zadań o wysokiej przepustowości.
Z tego przewodnika dowiesz się, co nowego wprowadziliśmy w poszczególnych modelach, jakie zmiany w interfejsie API mają wpływ na Twój kod i jak przeprowadzić migrację.
Gemini 3.6 Flash
Zainstaluj umiejętność:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalZastosuj umiejętność:
/gemini-interactions-api migrate my app to Gemini 3.6 Flash
Gemini 3.5 Flash-Lite
Zainstaluj umiejętność:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalZastosuj umiejętność:
/gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite
Nowe modele
| Model | Identyfikator modelu | Domyślny poziom myślenia | Ceny | Opis |
|---|---|---|---|---|
| Gemini 3.6 Flash | gemini-3.6-flash |
medium |
1,50 USD za milion tokenów wejściowych i 7,50 USD za milion tokenów wyjściowych | Równoważy szybkość i inteligencję w przypadku zadań agentowych i multimodalnych. |
| Gemini 3.5 Flash-Lite | gemini-3.5-flash-lite |
minimal |
0,30 USD za milion tokenów wejściowych i 2,50 USD za milion tokenów wyjściowych | Najszybszy i najtańszy model 3.5 do wykonywania zadań o dużej przepustowości. |
Oba modele obsługują okno kontekstu o wielkości 1 mln tokenów, maksymalnie 64 tys. tokenów wyjściowych, myślenie i pełny zestaw wbudowanych narzędzi, w tym korzystanie z komputera.
Pełne specyfikacje znajdziesz na stronach modeli:
Szczegółowe informacje o cenach znajdziesz na stronie z cennikiem.
Krótkie wprowadzenie
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.6-flash",
input="Write a three.js script that renders an interactive 3D robot."
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
async function main() {
const interaction = await ai.interactions.create({
model: "gemini-3.6-flash",
input: "Write a three.js script that renders an interactive 3D robot.",
});
console.log(interaction.outputText);
}
main();
REST
curl "https://generativelanguage.googleapis.com/v1beta/interactions" -H "x-goog-api-key: $GEMINI_API_KEY" -H 'Content-Type: application/json' -X POST -d '{
"model": "gemini-3.6-flash",
"input": "Write a three.js script that renders an interactive 3D robot."
}'
Nowości w Gemini 3.6 Flash
- Redukcja liczby tokenów i etapów: wykonuje wieloetapowe procesy z mniejszą liczbą etapów rozumowania, etapów konwersacji i wywołań narzędzi niż Gemini 3.5. Ogranicza też spiralne działanie pętli wykonania.
- Ulepszone generowanie kodu: generuje kod wyższej jakości, gotowy do wdrożenia, z mniejszą liczbą niechcianych zmian i pętli debugowania.
- Lepsze wykonywanie instrukcji: ogranicza niepożądane zmiany w plikach podczas zadań diagnostycznych.
- Zaawansowane rozumowanie multimodalne i przestrzenne: lepsze wyniki w zakresie interpretacji wykresów, konwersji wizualnych planów i generowania układów stron internetowych z wieloma elementami.
- Wstępne sprawdzanie automatyczne: częściej niż Gemini 3.5 Flash uruchamia skrypty kodu diagnostycznego przed wprowadzeniem zmian. Zwiększa to dokładność w przypadku złożonych zadań, ale może wymagać dodatkowych kroków eksploracyjnych w przypadku rutynowych prac związanych z interfejsem.
- Obsługa korzystania z komputera: obsługiwana jako wbudowane narzędzie do automatyzacji interfejsu agenta.
- Preferencje dotyczące stylu interfejsu: lepiej tworzy funkcjonalny kod, ale weryfikatorzy preferowali wcześniejsze modele pod względem układu wizualnego i stylu. Możesz temu zapobiec, podając wyraźne wytyczne dotyczące projektu.
- Domyślny nakład pracy związany z myśleniem (średni): korzysta z tego samego
mediumdomyślnego nakładu pracy związanego z myśleniem co Gemini 3.5 Flash. - Niższe ceny: niższe koszty tokenów wyjściowych (7,50 USD za milion w porównaniu z 9,00 USD za milion w przypadku 3.5 Flash). Tokeny wejściowe nadal kosztują 1,50 USD za milion.
Nowości w Gemini 3.5 Flash-Lite
- Krótszy czas oczekiwania na wykonanie zadania: najwyższa przepustowość w rodzinie 3.5 na potrzeby analizowania dużych ilości danych i wyodrębniania dokumentów.
- Ulepszone rozumowanie i wydajność multimodalna: łatwa migracja z Gemini 2.5 Flash, z wyższymi wynikami w przypadku zadań związanych z rozumowaniem, takich jak HLE (18,0% w porównaniu z 11,0%), oraz testów porównawczych multimodalnych, takich jak CharXIV (74,5% w porównaniu z 63,7%).
- Administrowanie subagentami i niezawodność narzędzi: zwiększa niezawodność wykonywania narzędzi w przypadku przepływów pracy związanych z wykonywaniem kodu, wyszukiwaniem i MCP. Zwiększ poziom myślenia w przypadku autonomicznego planowania i złożonych zadań podrzędnych agentów.
- Lepsze rozumienie dokumentów: zwiększa dokładność analizowania dokumentów i wyodrębniania danych strukturalnych. Eksperymentuj z minimalnym i wysokim poziomem myślenia w zależności od złożoności dokumentu.
- Interaktywne kodowanie w internecie i przetwarzanie danych tabelarycznych: dobrze radzi sobie z JavaScriptem po stronie klienta i przetwarzaniem danych tabelarycznych, planując za pomocą lekkiego wykonywania kodu.
- Trwałość chatbota i osobowości: lepsze wykonywanie instrukcji wieloetapowych i spójność osobowości w porównaniu z modelem Gemini 3.1 Flash-Lite.
- Obsługa korzystania z komputera: obsługiwana jako wbudowane narzędzie do automatyzacji interfejsu agenta.
Wybór odpowiedniego modelu Flash lub Flash-Lite
Wybierz odpowiedni model i ścieżkę migracji dla swoich zbiorów zadań.
Oba modele wymagają usunięcia wycofanych parametrów próbkowania (temperature, top_p, top_k) i przygotowanych odpowiedzi modelu. Więcej informacji znajdziesz w sekcji Zmiany w interfejsie API.
| Model | Główne przypadki użycia | Zalecany cel migracji |
|---|---|---|
Gemini 3.6 Flashgemini-3.6-flash |
Generowanie kodu, przestrzenne/multimodalne rozumowanie, wieloetapowe przepływy pracy agenta | Gemini 3.5 Flash, Gemini 3 Flash (wersja testowa) lub Gemini 3.1 Pro |
Gemini 3.5 Flash-Litegemini-3.5-flash-lite |
Autonomiczne wykonywanie zadań przez podagenty, analiza dużych ilości danych i wyodrębnianie dokumentów, analizowanie uporządkowanych plików JSON | Gemini 3.1 Flash-Lite lub Gemini 2.5 Flash |
Pomoc dotycząca agenta Antigravity
W Gemini 3.6 Flash wprowadziliśmy obsługę agenta Antigravity w zarządzanych agentach Gemini.
Aktualne przykładowe kody i najnowszą domyślną konfigurację agenta znajdziesz w przewodniku po agencie Antigravity i przewodniku po Gemini 3.8 Flash.
Zmiany w interfejsie API i aktualizacje parametrów
Począwszy od modeli Gemini 3.6 Flash i Gemini 3.5 Flash-Lite, poniższe zmiany w API będą dotyczyć tych modeli i wszystkich przyszłych wersji modeli Gemini.
- Wycofanie parametrów próbkowania: wycofujemy parametry
temperature,top_pitop_k. Interfejs API ignoruje te parametry i w przyszłych generacjach modelu zwraca błąd. - Weryfikacja przygotowanej odpowiedzi modelu: przygotowywanie odpowiedzi modelu nie jest już obsługiwane. Jeśli ostatnia niepusta tura w żądaniu jest turą
model, interfejs API zwraca błąd400.
W kolejnych sekcjach znajdziesz szczegółowe wyjaśnienia i przykłady kodu dotyczące każdej zmiany w interfejsie API.
1. Wycofanie parametrów próbkowania (temperature, top_p, top_k)
temperature, top_p i top_k są wycofane i ignorowane. W przyszłych generacjach modelu podanie tych parametrów spowoduje zwrócenie błędu HTTP 400. Usuń te parametry ze wszystkich żądań.
# ⚠️ Remove these parameters (deprecated)
generation_config = {
"temperature": 0.7,
"top_p": 0.9,
"top_k": 40,
}
Aby zwiększyć determinizm, zdefiniuj instrukcję systemową z wyraźnymi regułami dla konkretnego przypadku użycia.
2. Weryfikacja przygotowanej odpowiedzi modelu
Żądania do interfejsu API kończące się niepustą rolą modelu są niedozwolone i zwracają błąd HTTP 400.
⚠️ Unikaj
W starszych wersjach generateContent lub w nieprzetworzonych ładunkach REST kończenie odpowiedzi rolą modelu
jest teraz niedozwolone:
/* ❌ DO NOT: End payload contents with a 'model' role turn */
{
"contents": [
{"role": "user", "parts": [{"text": "Translate 'Hello world' to Spanish."}]},
{"role": "model", "parts": [{"text": "Translation:"}]} /* ❌ Returns error */
]
}
✅ Zalecana migracja (Interactions API)
W interfejsie Interactions API tury modelu nie są wypełniane ręcznie. Jeśli Twoja aplikacja wcześniej wstępnie wypełniała turę modelu, aby pominąć wstępy lub wymusić formatowanie JSON, użyj zamiast tego system_instruction lub ustrukturyzowanych danych wyjściowych.
# ✅ RECOMMENDED: Use system_instruction in the Interactions API to specify output format
interaction = client.interactions.create(
model="gemini-3.6-flash",
input="Translate 'Hello world' to Spanish.",
system_instruction="Output only the translation without introductory text.",
)
Lista kontrolna migracji
Gemini 3.6 Flash
Zainstaluj umiejętność:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalZastosuj umiejętność:
/gemini-interactions-api migrate my app to Gemini 3.6 Flash
Gemini 3.5 Flash-Lite
Zainstaluj umiejętność:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalZastosuj umiejętność:
/gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite
Migracja do modelu gemini-3.6-flash
- Zaktualizuj identyfikator modelu: zmień ciąg docelowego modelu na
gemini-3.6-flash. - Zastosuj aktualizacje parametrów: usuń wycofane parametry próbkowania (
temperature,top_p,top_k),candidate_count(nieobsługiwane w Gemini 3 i nowszych wersjach) oraz wstępnie wypełnione odpowiedzi modelu zgodnie z opisem w sekcji Zmiany w interfejsie API i aktualizacje parametrów. - Skonfiguruj poziom myślenia: zastąp
thinking_budgetwartościąthinking_level("medium"lub"high"). - Sprawdzanie wywoływania funkcji:
- Umieść zasoby multimodalne w ładunku odpowiedzi.
- Instrukcje w tekście formatuj za pomocą
\n\n. - Jeśli widzisz błędy
Malformed_Function_Callzwiązane z tekstem przed narzędziem, zapoznaj się z obejściami wymagań dotyczących tekstu przed narzędziem.
- Podstawowe wymagania dotyczące Gemini 3.x: informacje o aktualizacjach pakietu SDK i zachowaniu sygnatury myśli znajdziesz na liście kontrolnej migracji do Gemini 3.5.
Migracja do gemini-3.5-flash-lite
- Zaktualizuj identyfikator modelu: zmień ciąg docelowego modelu na
gemini-3.5-flash-lite. - Skonfiguruj poziom wysiłku umysłowego:
- W przypadku wyodrębniania, kierowania lub klasyfikowania dużych ilości danych pozostaw wartość
thinking_levelna"minimal"(domyślnie), aby uzyskać maksymalną przepustowość. - W przypadku autonomicznych subagentów z wywołaniami narzędzi, wykonywaniem kodu lub wieloetapowym rozumowaniem ustaw wartość
thinking_levelna"medium"lub"high", aby zapobiec przedwczesnemu zakończeniu działania narzędzia.
- W przypadku wyodrębniania, kierowania lub klasyfikowania dużych ilości danych pozostaw wartość
- Usuwanie wycofanych parametrów i weryfikowanie wywoływania funkcji: zastosuj te same reguły co w przypadku wersji 3.6 Flash.
- Wymagania podstawowe dotyczące Gemini 3.x: zapoznaj się z listą kontrolną migracji do Gemini 3.5.
Dalsze kroki
- Specyfikacje interfejsu API znajdziesz w przeglądzie modeli.
- Więcej informacji o administrowaniu wieloma agentami znajdziesz w przewodniku po interfejsie Interactions API.
- Testuj i dopracowuj prompty w Google AI Studio.