Çfarë ka të re në Gemini 3.6 Flash dhe 3.5 Flash-Lite

Modeli më i fundit Modele të tjera

Gemini 3.6 Flash (gemini-3.6-flash) dhe Gemini 3.5 Flash-Lite (gemini-3.5-flash-lite) janë përgjithësisht të disponueshëm (GA) dhe gati për përdorim në prodhim.

  • Gemini 3.6 Flash: Performancë më e mirë për detyrat komplekse të agjentit dhe ato multimodale ndërkohë që zvogëlon përdorimin e kodeve, me një çmim më të ulët se 3.5 Flash.
  • Gemini 3.5 Flash-Lite: Modeli më i shpejtë dhe me koston më të ulët në familjen 3.5. Ka performancë më të mirë se gjeneratat e mëparshme të Flash-Lite për ekzekutimin me shpejtësi të lartë.

Ky udhëzues shpjegon se çfarë ka të re në secilin model, çfarë ndryshimesh në API ndikojnë në kodin tënd dhe si të migrosh.

Gemini 3.6 Flash

  1. Instalo aftësinë:

    npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global
  2. Zbato aftësinë:

    /gemini-interactions-api migrate my app to Gemini 3.6 Flash

Gemini 3.5 Flash-Lite

  1. Instalo aftësinë:

    npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global
  2. Zbato aftësinë:

    /gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite

Modele të reja

Modeli ID-ja e modelit Niveli i parazgjedhur i arsyetimit Çmimet Përshkrimi
Gemini 3.6 Flash gemini-3.6-flash medium 1,50 USD/1 milion tokenë hyrjeje dhe 7,50 USD/1 milion tokenë daljeje Balancimi i shpejtësisë me inteligjencën për detyrat agjentike dhe shumëmodale.
Gemini 3.5 Flash-Lite gemini-3.5-flash-lite minimal 0,30 USD/1 milion tokenë hyrjeje dhe 2,50 USD/1 milion tokenë daljeje Modeli më i shpejtë dhe me koston më të ulët 3.5 për ekzekutim me kapacitet të lartë.

Të dyja modelet mbështesin dritaren kontekstuale me 1 milion kode, maksimumi 64 000 kode dalëse, arsyetimin dhe paketën e plotë të veglave të integruara, duke përfshirë Përdorimin e kompjuterit.

Për specifikimet e plota, shiko faqet e modeleve:

Për çmimet e detajuara, shiko faqen e çmimeve.

Nisja e shpejtë

Python

from google import genai

client = genai.Client()

interaction = client.interactions.create(
    model="gemini-3.6-flash",
    input="Write a three.js script that renders an interactive 3D robot."
)

print(interaction.output_text)

JavaScript

import { GoogleGenAI } from "@google/genai";

const ai = new GoogleGenAI({});

async function main() {
  const interaction = await ai.interactions.create({
    model: "gemini-3.6-flash",
    input: "Write a three.js script that renders an interactive 3D robot.",
  });
  console.log(interaction.outputText);
}

main();

QETËSI

curl "https://generativelanguage.googleapis.com/v1beta/interactions"       -H "x-goog-api-key: $GEMINI_API_KEY"       -H 'Content-Type: application/json'       -X POST       -d '{
    "model": "gemini-3.6-flash",
    "input": "Write a three.js script that renders an interactive 3D robot."
  }'

Çfarë ka të re në Gemini 3.6 Flash

  • Reduktimi i kodeve dhe i hapave: Përfundon flukset e punës me shumë hapa me më pak hapa arsyetimi, hapa bisedorë dhe thirrje të veglave se Gemini 3.5. Ai zvogëlon gjithashtu rritjen e shpejtësisë së ekzekutimit.
  • Gjenerim i përmirësuar i kodit: Prodhon kod me cilësi më të lartë të gatshëm për prodhim me më pak modifikime të padëshiruara dhe më pak cikle korrigjimi.
  • Ndiq më mirë udhëzimet: Zvogëlon ndryshimet e padëshiruara të skedarëve gjatë detyrave diagnostikuese.
  • Arsyetim i fortë multimodal dhe hapësinor: Performancë e përmirësuar në interpretimin e grafikëve, konvertimin e strukturave vizuale dhe gjenerimin e strukturave të uebit me shumë elemente.
  • Inspektimi programatik paraprak: Preferon të ekzekutojë skriptet e kodit diagnostik para se të bëjë ndryshime më shpesh se Gemini 3.5 Flash. Kjo përmirëson saktësinë për detyrat komplekse, por mund të shtojë hapa eksplorues shtesë për punën e zakonshme të ndërfaqes.
  • Mbështetja për përdorimin e kompjuterit: Mbështetet si një vegël e integruar për automatizimin e ndërfaqes së përdoruesit të agjentit.
  • Preferenca për stilin e ndërfaqes së përdoruesit: Më i mirë në krijimin e kodit funksional, megjithëse vlerësuesit njerëzorë preferuan modelet e mëparshme për strukturën dhe stilin vizual. Mund ta zbusësh këtë duke dhënë udhëzime të qarta për dizajnin.
  • Përpjekja e parazgjedhur e arsyetimit (mesatare): Përdor të njëjtin nivel të parazgjedhur të arsyetimit të medium si Gemini 3.5 Flash.
  • Çmim i reduktuar: Kosto më të ulëta të tokenëve të daljes (7,50 USD/1 milion kundrejt 9,00 USD/1 milion për 3.5 Flash). Tokenët e hyrjes mbeten në 1,50 USD/1 milion.

Çfarë ka të re në Gemini 3.5 Flash-Lite

  • Vonesë e reduktuar e ekzekutimit të detyrave: Kapaciteti më i lartë në familjen 3.5 për analizimin e të dhënave me volum të lartë dhe nxjerrjen e dokumenteve.
  • Performancë e përmirësuar e arsyetimit dhe multimodaliteti: Shteg i fortë migrimi nga Gemini 2.5 Flash, me rezultate më të larta në detyrat e arsyetimit si HLE (18,0% kundrejt 11,0%) dhe në standardet e performancës multimodale si CharXIV (74,5% kundrejt 63,7%).
  • Orkestrimi i nënagentëve dhe besueshmëria e veglave: Përmirëson besueshmërinë e ekzekutimit të veglave për ekzekutimin e kodit, kërkimin dhe flukset e punës të MCP-së. Rrit nivelin e të menduarit për planifikimin autonom dhe detyrat komplekse të nënagjentëve.
  • Kuptim i përmirësuar i dokumenteve: Përmirëson saktësinë për analizimin e dokumenteve dhe nxjerrjen e të dhënave të strukturuara. Eksperimento me nivelet minimale dhe të larta të të menduarit në varësi të kompleksitetit të dokumentit.
  • Kodimi ndërveprues i uebit dhe përpunimi i të dhënave tabelare: Performon mirë në JavaScript për frontend dhe përpunimin e të dhënave tabelare duke planifikuar me përdorimin e ekzekutimit të lehtë të kodit.
  • Qëndrueshmëria e chatbot-it dhe personazhit: Ndiqje më e fortë e udhëzimeve me shumë hapa dhe qëndrueshmëri e personazhit në Gemini 3.1 Flash-Lite.
  • Mbështetja për përdorimin e kompjuterit: Mbështetet si një vegël e integruar për automatizimin e ndërfaqes së përdoruesit të agjentit.

Zgjedhja e modelit të duhur Flash ose Flash-Lite

Përdor këtë tabelë për të zgjedhur modelin e duhur dhe shtegun e migrimit për ngarkesat e punës.

Të dyja modelet kërkojnë heqjen e parametrave të zhvlerësuar të marrjes së mostrave (temperature, top_p, top_k) dhe ndërhyrjet e parambushura të modelit. Shiko ndryshimet e API-së për detaje.

Modeli Rastet kryesore të përdorimit Objektivi i rekomanduar i migrimit
Gemini 3.6 Flash
gemini-3.6-flash
Gjenerimi i kodit, arsyetimi hapësinor/multimodal, flukset e punës agjentike me shumë hapa Gemini 3.5 Flash, Gemini 3 Flash (pamja paraprake) ose Gemini 3.1 Pro
Gemini 3.5 Flash-Lite
gemini-3.5-flash-lite
Ekzekutimi autonom i nënagjentëve, analiza e të dhënave në volum të lartë dhe nxjerrja e dokumenteve, analizimi i strukturuar i JSON Gemini 3.1 Flash-Lite ose Gemini 2.5 Flash

Mbështetja e agjentit të Antigravity

Gemini 3.6 Flash prezantoi mbështetjen për agjentin Antigravity në Gemini Managed Agents.

Për shembujt aktualë të kodit dhe konfigurimin më të fundit të agjentit të parazgjedhur, shiko Udhëzuesin e agjentit të antigravitetit dhe Udhëzuesin e Gemini 3.8 Flash.

Ndryshimet e API-së dhe përditësimet e parametrave

Duke filluar me Gemini 3.6 Flash dhe Gemini 3.5 Flash-Lite, ndryshimet e mëposhtme të API-së zbatohen për këto modele dhe të gjitha publikimet e ardhshme të modeleve Gemini.

  • Zhvlerësimi i parametrit të kampionimit: temperature, top_p dhe top_k janë zhvlerësuar. API-ja i shpërfill këta parametra dhe kthen një gabim në gjeneratat e ardhshme të modelit.
  • Verifikimi i ndërhyrjes së parambushur të modelit: Parambushja e ndërhyrjeve të modelit nuk mbështetet më. Nëse rradha e fundit jo e zbrazët në kërkesë është një rradhë e model, API-ja kthen një gabim 400.

Seksionet e mëposhtme ofrojnë shpjegime të detajuara dhe shembuj kodesh për çdo ndryshim të API-së.

1. Zhvlerësimi i parametrit të marrjes së mostrave (temperature, top_p, top_k)

temperature, top_p dhe top_k janë të zhvlerësuara dhe të shpërfillura. Në gjeneratat e ardhshme të modelit, dhënia e këtyre parametrave kthen një gabim HTTP 400. Hiqi këta parametra nga të gjitha kërkesat.

# ⚠️ Remove these parameters (deprecated)
generation_config = {
     "temperature": 0.7,
     "top_p": 0.9,
     "top_k": 40,
}

Për të përmirësuar determinizmin, përcakto një udhëzim sistemi me rregulla të qarta për rastin tënd specifik të përdorimit.

2. Verifikimi i ndërhyrjes së parakonfiguruar të modelit

Kërkesat e API-së që përfundojnë me një radhë të rolit të modelit që nuk është bosh nuk lejohen dhe kthejnë një gabim HTTP 400.

⚠️ Shmang

Në ngarkesat e trashëguara generateContent ose të papërpunuara REST, që përfundojnë me një rradhë të rolit të modelit nuk lejohen më:

/* ❌ DO NOT: End payload contents with a 'model' role turn */
{
  "contents": [
    {"role": "user", "parts": [{"text": "Translate 'Hello world' to Spanish."}]},
    {"role": "model", "parts": [{"text": "Translation:"}]}  /* ❌ Returns error */
  ]
}

Në API-n e ndërveprimeve, radhët e modelit nuk plotësohen paraprakisht në mënyrë manuale. Nëse aplikacioni yt ka mbushur paraprakisht një rradhë të modelit për të hequr hyrjet ose për të detyruar formatimin JSON, përdor system_instruction ose Daljet e strukturuara në vend të tyre.

# ✅ RECOMMENDED: Use system_instruction in the Interactions API to specify output format
interaction = client.interactions.create(
    model="gemini-3.6-flash",
    input="Translate 'Hello world' to Spanish.",
    system_instruction="Output only the translation without introductory text.",
)

Lista e kontrollit për migrimin

Gemini 3.6 Flash

  1. Instalo aftësinë:

    npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global
  2. Zbato aftësinë:

    /gemini-interactions-api migrate my app to Gemini 3.6 Flash

Gemini 3.5 Flash-Lite

  1. Instalo aftësinë:

    npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global
  2. Zbato aftësinë:

    /gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite

Migro te gemini-3.6-flash

  • Përditëso ID-në e modelit: Ndrysho vargun e modelit të synuar në gemini-3.6-flash.
  • Zbato përditësimet e parametrave: Hiq parametrat e amortizuar të kampionimit (temperature, top_p, top_k), candidate_count (nuk mbështetet në Gemini 3 dhe versionet e mëvonshme) dhe kthesat e modelit të parambushur siç detajohet në Ndryshimet e API-së dhe përditësimet e parametrave.
  • Konfiguro nivelin e të menduarit: Zëvendëso thinking_budget me thinking_level ("medium" ose "high").
  • Funksioni i thirrjes së auditit:
  • Kërkesat bazë për Gemini 3.x: Për përditësimet e SDK-së dhe ruajtjen e nënshkrimit të mendimit, shiko Listën e kontrollit të migrimit të Gemini 3.5.

Migro te gemini-3.5-flash-lite

  • Përditëso ID-në e modelit: Ndrysho vargun e modelit të synuar në gemini-3.5-flash-lite.
  • Konfiguro nivelin e përpjekjes për të menduar:
    • Për nxjerrje, transferim ose klasifikim me volum të lartë: lëre thinking_level në "minimal" (parazgjedhja) për një kapacitet maksimal.
    • Për nënagentët autonomë me thirrje veglash, ekzekutim kodesh ose arsyetim me shumë hapa: cakto thinking_level në "medium" ose "high" për të parandaluar përfundimin e parakohshëm të veglave.
  • Hiq parametrat e zhvlerësuar dhe verifiko thirrjen e funksionit: Zbato të njëjtat rregulla si për 3.6 Flash.
  • Kërkesat bazë për Gemini 3.x: Referoju Listës së kontrollit të migrimit të Gemini 3.5.

Hapat e radhës