Modeli më i fundit Modele të tjera
Gemini 3.6 Flash (gemini-3.6-flash) dhe Gemini 3.5 Flash-Lite
(gemini-3.5-flash-lite) janë përgjithësisht të disponueshëm (GA) dhe gati për përdorim në prodhim.
- Gemini 3.6 Flash: Performancë më e mirë për detyrat komplekse të agjentit dhe ato multimodale ndërkohë që zvogëlon përdorimin e kodeve, me një çmim më të ulët se 3.5 Flash.
- Gemini 3.5 Flash-Lite: Modeli më i shpejtë dhe me koston më të ulët në familjen 3.5. Ka performancë më të mirë se gjeneratat e mëparshme të Flash-Lite për ekzekutimin me shpejtësi të lartë.
Ky udhëzues shpjegon se çfarë ka të re në secilin model, çfarë ndryshimesh në API ndikojnë në kodin tënd dhe si të migrosh.
Gemini 3.6 Flash
Instalo aftësinë:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalZbato aftësinë:
/gemini-interactions-api migrate my app to Gemini 3.6 Flash
Gemini 3.5 Flash-Lite
Instalo aftësinë:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalZbato aftësinë:
/gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite
Modele të reja
| Modeli | ID-ja e modelit | Niveli i parazgjedhur i arsyetimit | Çmimet | Përshkrimi |
|---|---|---|---|---|
| Gemini 3.6 Flash | gemini-3.6-flash |
medium |
1,50 USD/1 milion tokenë hyrjeje dhe 7,50 USD/1 milion tokenë daljeje | Balancimi i shpejtësisë me inteligjencën për detyrat agjentike dhe shumëmodale. |
| Gemini 3.5 Flash-Lite | gemini-3.5-flash-lite |
minimal |
0,30 USD/1 milion tokenë hyrjeje dhe 2,50 USD/1 milion tokenë daljeje | Modeli më i shpejtë dhe me koston më të ulët 3.5 për ekzekutim me kapacitet të lartë. |
Të dyja modelet mbështesin dritaren kontekstuale me 1 milion kode, maksimumi 64 000 kode dalëse, arsyetimin dhe paketën e plotë të veglave të integruara, duke përfshirë Përdorimin e kompjuterit.
Për specifikimet e plota, shiko faqet e modeleve:
Për çmimet e detajuara, shiko faqen e çmimeve.
Nisja e shpejtë
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.6-flash",
input="Write a three.js script that renders an interactive 3D robot."
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
async function main() {
const interaction = await ai.interactions.create({
model: "gemini-3.6-flash",
input: "Write a three.js script that renders an interactive 3D robot.",
});
console.log(interaction.outputText);
}
main();
QETËSI
curl "https://generativelanguage.googleapis.com/v1beta/interactions" -H "x-goog-api-key: $GEMINI_API_KEY" -H 'Content-Type: application/json' -X POST -d '{
"model": "gemini-3.6-flash",
"input": "Write a three.js script that renders an interactive 3D robot."
}'
Çfarë ka të re në Gemini 3.6 Flash
- Reduktimi i kodeve dhe i hapave: Përfundon flukset e punës me shumë hapa me më pak hapa arsyetimi, hapa bisedorë dhe thirrje të veglave se Gemini 3.5. Ai zvogëlon gjithashtu rritjen e shpejtësisë së ekzekutimit.
- Gjenerim i përmirësuar i kodit: Prodhon kod me cilësi më të lartë të gatshëm për prodhim me më pak modifikime të padëshiruara dhe më pak cikle korrigjimi.
- Ndiq më mirë udhëzimet: Zvogëlon ndryshimet e padëshiruara të skedarëve gjatë detyrave diagnostikuese.
- Arsyetim i fortë multimodal dhe hapësinor: Performancë e përmirësuar në interpretimin e grafikëve, konvertimin e strukturave vizuale dhe gjenerimin e strukturave të uebit me shumë elemente.
- Inspektimi programatik paraprak: Preferon të ekzekutojë skriptet e kodit diagnostik para se të bëjë ndryshime më shpesh se Gemini 3.5 Flash. Kjo përmirëson saktësinë për detyrat komplekse, por mund të shtojë hapa eksplorues shtesë për punën e zakonshme të ndërfaqes.
- Mbështetja për përdorimin e kompjuterit: Mbështetet si një vegël e integruar për automatizimin e ndërfaqes së përdoruesit të agjentit.
- Preferenca për stilin e ndërfaqes së përdoruesit: Më i mirë në krijimin e kodit funksional, megjithëse vlerësuesit njerëzorë preferuan modelet e mëparshme për strukturën dhe stilin vizual. Mund ta zbusësh këtë duke dhënë udhëzime të qarta për dizajnin.
- Përpjekja e parazgjedhur e arsyetimit (mesatare): Përdor të njëjtin nivel të parazgjedhur të arsyetimit të
mediumsi Gemini 3.5 Flash. - Çmim i reduktuar: Kosto më të ulëta të tokenëve të daljes (7,50 USD/1 milion kundrejt 9,00 USD/1 milion për 3.5 Flash). Tokenët e hyrjes mbeten në 1,50 USD/1 milion.
Çfarë ka të re në Gemini 3.5 Flash-Lite
- Vonesë e reduktuar e ekzekutimit të detyrave: Kapaciteti më i lartë në familjen 3.5 për analizimin e të dhënave me volum të lartë dhe nxjerrjen e dokumenteve.
- Performancë e përmirësuar e arsyetimit dhe multimodaliteti: Shteg i fortë migrimi nga Gemini 2.5 Flash, me rezultate më të larta në detyrat e arsyetimit si HLE (18,0% kundrejt 11,0%) dhe në standardet e performancës multimodale si CharXIV (74,5% kundrejt 63,7%).
- Orkestrimi i nënagentëve dhe besueshmëria e veglave: Përmirëson besueshmërinë e ekzekutimit të veglave për ekzekutimin e kodit, kërkimin dhe flukset e punës të MCP-së. Rrit nivelin e të menduarit për planifikimin autonom dhe detyrat komplekse të nënagjentëve.
- Kuptim i përmirësuar i dokumenteve: Përmirëson saktësinë për analizimin e dokumenteve dhe nxjerrjen e të dhënave të strukturuara. Eksperimento me nivelet minimale dhe të larta të të menduarit në varësi të kompleksitetit të dokumentit.
- Kodimi ndërveprues i uebit dhe përpunimi i të dhënave tabelare: Performon mirë në JavaScript për frontend dhe përpunimin e të dhënave tabelare duke planifikuar me përdorimin e ekzekutimit të lehtë të kodit.
- Qëndrueshmëria e chatbot-it dhe personazhit: Ndiqje më e fortë e udhëzimeve me shumë hapa dhe qëndrueshmëri e personazhit në Gemini 3.1 Flash-Lite.
- Mbështetja për përdorimin e kompjuterit: Mbështetet si një vegël e integruar për automatizimin e ndërfaqes së përdoruesit të agjentit.
Zgjedhja e modelit të duhur Flash ose Flash-Lite
Përdor këtë tabelë për të zgjedhur modelin e duhur dhe shtegun e migrimit për ngarkesat e punës.
Të dyja modelet kërkojnë heqjen e parametrave të zhvlerësuar të marrjes së mostrave (temperature,
top_p, top_k) dhe ndërhyrjet e parambushura të modelit. Shiko
ndryshimet e API-së për detaje.
| Modeli | Rastet kryesore të përdorimit | Objektivi i rekomanduar i migrimit |
|---|---|---|
Gemini 3.6 Flashgemini-3.6-flash |
Gjenerimi i kodit, arsyetimi hapësinor/multimodal, flukset e punës agjentike me shumë hapa | Gemini 3.5 Flash, Gemini 3 Flash (pamja paraprake) ose Gemini 3.1 Pro |
Gemini 3.5 Flash-Litegemini-3.5-flash-lite |
Ekzekutimi autonom i nënagjentëve, analiza e të dhënave në volum të lartë dhe nxjerrja e dokumenteve, analizimi i strukturuar i JSON | Gemini 3.1 Flash-Lite ose Gemini 2.5 Flash |
Mbështetja e agjentit të Antigravity
Gemini 3.6 Flash prezantoi mbështetjen për agjentin Antigravity në Gemini Managed Agents.
Për shembujt aktualë të kodit dhe konfigurimin më të fundit të agjentit të parazgjedhur, shiko Udhëzuesin e agjentit të antigravitetit dhe Udhëzuesin e Gemini 3.8 Flash.
Ndryshimet e API-së dhe përditësimet e parametrave
Duke filluar me Gemini 3.6 Flash dhe Gemini 3.5 Flash-Lite, ndryshimet e mëposhtme të API-së zbatohen për këto modele dhe të gjitha publikimet e ardhshme të modeleve Gemini.
- Zhvlerësimi i parametrit të kampionimit:
temperature,top_pdhetop_kjanë zhvlerësuar. API-ja i shpërfill këta parametra dhe kthen një gabim në gjeneratat e ardhshme të modelit. - Verifikimi i ndërhyrjes së parambushur të modelit: Parambushja e ndërhyrjeve të modelit nuk mbështetet më. Nëse rradha e fundit jo e zbrazët në kërkesë është një rradhë e
model, API-ja kthen një gabim400.
Seksionet e mëposhtme ofrojnë shpjegime të detajuara dhe shembuj kodesh për çdo ndryshim të API-së.
1. Zhvlerësimi i parametrit të marrjes së mostrave (temperature, top_p, top_k)
temperature, top_p dhe top_k janë të zhvlerësuara dhe të shpërfillura. Në gjeneratat e ardhshme të modelit, dhënia e këtyre parametrave kthen një gabim HTTP 400. Hiqi
këta parametra nga të gjitha kërkesat.
# ⚠️ Remove these parameters (deprecated)
generation_config = {
"temperature": 0.7,
"top_p": 0.9,
"top_k": 40,
}
Për të përmirësuar determinizmin, përcakto një udhëzim sistemi me rregulla të qarta për rastin tënd specifik të përdorimit.
2. Verifikimi i ndërhyrjes së parakonfiguruar të modelit
Kërkesat e API-së që përfundojnë me një radhë të rolit të modelit që nuk është bosh nuk lejohen dhe kthejnë një gabim HTTP 400.
⚠️ Shmang
Në ngarkesat e trashëguara generateContent ose të papërpunuara REST, që përfundojnë me një rradhë të rolit të modelit
nuk lejohen më:
/* ❌ DO NOT: End payload contents with a 'model' role turn */
{
"contents": [
{"role": "user", "parts": [{"text": "Translate 'Hello world' to Spanish."}]},
{"role": "model", "parts": [{"text": "Translation:"}]} /* ❌ Returns error */
]
}
✅ Migrimi i rekomanduar (Interactions API)
Në API-n e ndërveprimeve, radhët e modelit nuk plotësohen paraprakisht në mënyrë manuale. Nëse aplikacioni yt ka mbushur paraprakisht një rradhë të modelit për të hequr hyrjet ose për të detyruar formatimin JSON, përdor system_instruction ose Daljet e strukturuara në vend të tyre.
# ✅ RECOMMENDED: Use system_instruction in the Interactions API to specify output format
interaction = client.interactions.create(
model="gemini-3.6-flash",
input="Translate 'Hello world' to Spanish.",
system_instruction="Output only the translation without introductory text.",
)
Lista e kontrollit për migrimin
Gemini 3.6 Flash
Instalo aftësinë:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalZbato aftësinë:
/gemini-interactions-api migrate my app to Gemini 3.6 Flash
Gemini 3.5 Flash-Lite
Instalo aftësinë:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalZbato aftësinë:
/gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite
Migro te gemini-3.6-flash
- Përditëso ID-në e modelit: Ndrysho vargun e modelit të synuar në
gemini-3.6-flash. - Zbato përditësimet e parametrave: Hiq parametrat e amortizuar të kampionimit (
temperature,top_p,top_k),candidate_count(nuk mbështetet në Gemini 3 dhe versionet e mëvonshme) dhe kthesat e modelit të parambushur siç detajohet në Ndryshimet e API-së dhe përditësimet e parametrave. - Konfiguro nivelin e të menduarit: Zëvendëso
thinking_budgetmethinking_level("medium"ose"high"). - Funksioni i thirrjes së auditit:
- Vendos asetet multimodale brenda ngarkesës së përgjigjes.
- Formato udhëzimet e integruara duke përdorur
\n\n. - Nëse shikon gabime
Malformed_Function_Calltë lidhura me tekstin para veglës, shiko Zgjidhjet alternative për kërkesat për tekstin para veglës.
- Kërkesat bazë për Gemini 3.x: Për përditësimet e SDK-së dhe ruajtjen e nënshkrimit të mendimit, shiko Listën e kontrollit të migrimit të Gemini 3.5.
Migro te gemini-3.5-flash-lite
- Përditëso ID-në e modelit: Ndrysho vargun e modelit të synuar në
gemini-3.5-flash-lite. - Konfiguro nivelin e përpjekjes për të menduar:
- Për nxjerrje, transferim ose klasifikim me volum të lartë: lëre
thinking_levelnë"minimal"(parazgjedhja) për një kapacitet maksimal. - Për nënagentët autonomë me thirrje veglash, ekzekutim kodesh ose arsyetim me shumë hapa: cakto
thinking_levelnë"medium"ose"high"për të parandaluar përfundimin e parakohshëm të veglave.
- Për nxjerrje, transferim ose klasifikim me volum të lartë: lëre
- Hiq parametrat e zhvlerësuar dhe verifiko thirrjen e funksionit: Zbato të njëjtat rregulla si për 3.6 Flash.
- Kërkesat bazë për Gemini 3.x: Referoju Listës së kontrollit të migrimit të Gemini 3.5.
Hapat e radhës
- Rishiko specifikimet e API-së te Përmbledhja e modeleve.
- Eksploro orkestrimin e shumë agjentëve në Udhëzuesin e API-së së ndërveprimeve.
- Testo dhe përmirëso kërkesat në Google AI Studio.