Duke përdorur modelet më të fundit Gemini

Kjo faqe 3.5 Flash

Gemini 3.6 Flash ( gemini-3.6-flash ) dhe Gemini 3.5 Flash-Lite ( gemini-3.5-flash-lite ) janë përgjithësisht të disponueshëm (GA) dhe gati për përdorim në prodhim.

  • Gemini 3.6 Flash : Performancë më e fortë në detyra komplekse agjentike dhe multimodale, duke zvogëluar përdorimin e token-ave, me një çmim më të ulët se 3.5 Flash.
  • Gemini 3.5 Flash-Lite : Modeli më i shpejtë dhe me koston më të ulët në familjen 3.5. I tejkalon gjeneratat e mëparshme Flash-Lite për ekzekutim me rendiment të lartë.

Ky udhëzues shpjegon se çfarë ka të re në secilin model, cilat ndryshime të API-t ndikojnë në kodin tuaj dhe si të migroni.

Binjakët 3.6 Flash

  1. Instaloni aftësinë:

    npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global
  2. Zbatoni aftësinë:

    /gemini-interactions-api migrate my app to Gemini 3.6 Flash

Gemini 3.5 Flash-Lite

  1. Instaloni aftësinë:

    npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global
  2. Zbatoni aftësinë:

    /gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite

Modele të reja

Model ID e modelit Niveli i paracaktuar i të menduarit Çmimet Përshkrimi
Binjakët 3.6 Flash gemini-3.6-flash medium Tokena hyrëse prej $1.50/1 milion dhe tokena dalëse prej $7.50/1 milion Balancon shpejtësinë me inteligjencën për detyra agjentike dhe multimodale.
Gemini 3.5 Flash-Lite gemini-3.5-flash-lite minimal Tokena hyrëse prej $0.30/1 milion dhe tokena dalëse prej $2.50/1 milion Modeli 3.5 më i shpejtë dhe me koston më të ulët për ekzekutim me rendiment të lartë.

Të dy modelet mbështesin dritaren e kontekstit të tokenëve 1M, 64k tokena dalës maksimal, të menduarit dhe gamën e plotë të mjeteve të integruara, duke përfshirë Përdorimin e Kompjuterit .

Për specifikimet e plota, shihni faqet e modelit:

Për çmimet e detajuara, shihni faqen e çmimeve .

Nisje e shpejtë

Python

from google import genai

client = genai.Client()

interaction = client.interactions.create(
    model="gemini-3.6-flash",
    input="Write a three.js script that renders an interactive 3D robot."
)

print(interaction.output_text)

JavaScript

import { GoogleGenAI } from "@google/genai";

const ai = new GoogleGenAI({});

async function main() {
  const interaction = await ai.interactions.create({
    model: "gemini-3.6-flash",
    input: "Write a three.js script that renders an interactive 3D robot.",
  });
  console.log(interaction.outputText);
}

main();

PUSHTIM

curl "https://generativelanguage.googleapis.com/v1beta/interactions" \
  -H "x-goog-api-key: $GEMINI_API_KEY" \
  -H 'Content-Type: application/json' \
  -X POST \
  -d '{
    "model": "gemini-3.6-flash",
    "input": {
      "parts": [{"text": "Write a three.js script that renders an interactive 3D robot."}]
    }
  }'

Çfarë ka të re në Gemini 3.6 Flash

  • Reduktimi i tokenëve dhe kthesave: Përfundon rrjedhat e punës me shumë hapa me më pak hapa arsyetimi, kthesa bisedore dhe thirrje mjetesh sesa Gemini 3.5. Gjithashtu zvogëlon spiralizimin e ciklit të ekzekutimit.
  • Gjenerim i përmirësuar i kodit: Prodhon kod të gatshëm për prodhim me cilësi më të lartë me më pak ndryshime të padëshiruara dhe më pak sythe debugging-u.
  • Ndjekje më e mirë e udhëzimeve : Zvogëlon ndryshimet e padëshiruara të skedarëve gjatë detyrave diagnostikuese.
  • Arsyetim i fortë multimodal dhe hapësinor: Performancë e përmirësuar në interpretimin e grafikëve, konvertimin vizual të planeve dhe gjenerimin e paraqitjes së uebit me shumë elementë.
  • Inspektimi programatik paraprak: Preferon ekzekutimin e skripteve të kodit diagnostikues përpara se të bëjë ndryshime më shpesh sesa Gemini 3.5 Flash. Kjo përmirëson saktësinë në detyra komplekse, por mund të shtojë hapa shtesë eksplorues në punën e thjeshtë të frontend-it.
  • Mbështetje për Përdorimin e Kompjuterit: Mbështetet si mjet vendas për automatizimin e Ndërfaqes së Përdoruesit të Agjentëve.
  • Preferenca e stilimit të ndërfaqes së përdoruesit : Më i mirë në krijimin e kodit funksional, megjithëse vlerësuesit njerëzorë preferonin modelet e mëparshme për paraqitjen dhe stilimin vizual. Mund ta zbutni këtë duke ofruar udhëzime të qarta për dizajnin.
  • Përpjekja e parazgjedhur e të menduarit (mesatare): Përdor të njëjtin nivel medium të parazgjedhur të të menduarit si Binjakët 3.5 Flash.
  • Çmime të reduktuara : Kosto më të ulëta të tokenëve të daljes ($7.50/1M kundrejt $9.00/1M për Flash 3.5). Tokenët e hyrjes mbeten në $1.50/1M.

Çfarë ka të re në Gemini 3.5 Flash-Lite

  • Vonesa e reduktuar e ekzekutimit të detyrave: Rendimenti më i lartë në familjen 3.5 për analizimin e të dhënave me vëllim të lartë dhe nxjerrjen e dokumenteve.
  • Arsyetim i përmirësuar dhe performancë multimodale: Shteg i fortë migrimi nga Gemini 2.5 Flash, me rezultate më të larta në detyra arsyetimi si HLE (18.0% kundrejt 11.0%) dhe teste multimodale si CharXIV (74.5% kundrejt 63.7%).
  • Orkestrimi i nën-agjentëve dhe besueshmëria e mjeteve: Përmirëson besueshmërinë e ekzekutimit të mjeteve për ekzekutimin e kodit, kërkimin dhe rrjedhat e punës MCP. Rrit nivelin e të menduarit për planifikim autonom dhe detyra komplekse të nën-agjentëve.
  • Përmirësimi i të kuptuarit të dokumentit: Përmirëson saktësinë në analizimin e dokumentit dhe nxjerrjen e të dhënave të strukturuara. Eksperimentoni me nivele minimale dhe të larta të të menduarit në varësi të kompleksitetit të dokumentit.
  • Kodim interaktiv në internet dhe përpunimi i të dhënave tabelare: Performon fuqishëm në JavaScript-in e frontend-it dhe përpunimin e të dhënave tabelare duke planifikuar nëpërmjet ekzekutimit të lehtë të kodit.
  • Chatbot dhe këmbëngulje e personazheve: Ndjekje më e fortë e udhëzimeve me shumë kthesa dhe qëndrueshmëri e personazheve krahasuar me Gemini 3.1 Flash-Lite.
  • Mbështetje për Përdorimin e Kompjuterit: Mbështetet si mjet vendas për automatizimin e Ndërfaqes së Përdoruesit të Agjentëve.

Zgjedhja e modelit të duhur Flash ose Flash-Lite

Përdorni këtë tabelë për të zgjedhur modelin dhe rrugën e duhur të migrimit për ngarkesat tuaja të punës.

Të dy modelet kërkojnë heqjen e parametrave të vjetëruar të marrjes së mostrave ( temperature , top_p , top_k ) dhe kthesave të modelit të parambushura. Shihni ndryshimet e API-t për detaje.

Model Rastet e përdorimit kryesor Objektivi i rekomanduar i migrimit
Binjakët 3.6 Flash
gemini-3.6-flash
Gjenerimi i kodit, arsyetimi hapësinor/multimodal, rrjedhat e punës agjentike me shumë hapa Blic Gemini 3.5 , Blic Gemini 3 (Parashikim) ose Blic Gemini 3.1 Pro
Gemini 3.5 Flash-Lite
gemini-3.5-flash-lite
Ekzekutim autonom i nën-agjentëve, analiza e të dhënave me vëllim të lartë dhe nxjerrja e dokumenteve, analizimi i strukturuar i JSON Gemini 3.1 Flash-Lite ose Gemini 2.5 Flash

Agjent i përditësuar antigravitacional

Për shkak të performancës së përmirësuar, Gemini 3.6 Flash është tani modeli i ri parazgjedhur që fuqizon agjentin Antigravity në Gemini Managed Agents. Kjo mund të ndryshohet duke vendosur një fushë të re në API.

Python

from google import genai

client = genai.Client()

interaction = client.interactions.create(
    agent="antigravity-preview-05-2026",
    input="Read Hacker News, summarize the top 10 stories, and save the results as a PDF.",
    environment="remote",
)

print(interaction.output_text)

JavaScript

import { GoogleGenAI } from "@google/genai";

const client = new GoogleGenAI({});

const interaction = await client.interactions.create({
    agent: "antigravity-preview-05-2026",
    input: "Read Hacker News, summarize the top 10 stories, and save the results as a PDF.",
    environment: "remote",
}, { timeout: 300000 });

console.log(interaction.output_text);

PUSHTIM

curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "Content-Type: application/json" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-d '{
    "agent": "antigravity-preview-05-2026",
    "input": "Read Hacker News, summarize the top 10 stories, and save the results as a PDF.",
    "environment": "remote"
}'

Ndryshimet e API-t dhe përditësimet e parametrave

Duke filluar me Gemini 3.6 Flash dhe Gemini 3.5 Flash-Lite, ndryshimet e mëposhtme të API-t zbatohen për këto modele dhe të gjitha versionet e ardhshme të modelit Gemini.

  • Parametrat e mostrës nuk rekomandohen më : temperature , top_p dhe top_k nuk rekomandohen më. API i injoron këto parametra dhe kthen një gabim në gjeneratat e ardhshme të modelit.
  • Validimi i kthesës së modelit të parambushur : Parambushja e kthesave të modelit nuk mbështetet më. Nëse kthesa e fundit jo-bosh në kërkesë është një kthesë model , API kthen një gabim 400 .

Më poshtë janë shpjegime të hollësishme dhe shembuj kodi për secilin ndryshim të API-t.

1. Zhvlerësimi i parametrave të marrjes së mostrave ( temperature , top_p , top_k )

temperature , top_p dhe top_k janë të vjetruara dhe injorohen. Në gjeneratat e ardhshme të modeleve, dhënia e këtyre parametrave kthen një gabim HTTP 400. Hiqni këto parametra nga të gjitha kërkesat.

# ⚠️ Remove these parameters (deprecated)
generation_config = {
     "temperature": 0.7,
     "top_p": 0.9,
     "top_k": 40,
}

To improve determinism, define a system instruction with explicit rules for your specific use case.

2. Validimi i kthesës së modelit të parambushur

Kërkesat API që mbarojnë me një kthesë jo të zbrazët të rolit të modelit nuk lejohen dhe kthejnë një gabim HTTP 400 .

⚠️ Shmangni

Në ngarkesat e trashëguara generateContent ose të papërpunuara REST, përfundimi me një kthesë të rolit model tani nuk lejohet:

/* ❌ DO NOT: End payload contents with a 'model' role turn */
{
  "contents": [
    {"role": "user", "parts": [{"text": "Translate 'Hello world' to Spanish."}]},
    {"role": "model", "parts": [{"text": "Translation:"}]}  /* ❌ Returns error */
  ]
}

Në API-në e Ndërveprimeve, kthesat e modelit nuk plotësohen paraprakisht manualisht. Nëse aplikacioni juaj ka plotësuar paraprakisht më parë një kthesë modeli për të shtypur preambulat ose për të detyruar formatimin JSON, përdorni në vend të kësaj rezultatet system_instruction ose Structured .

# ✅ RECOMMENDED: Use system_instruction in the Interactions API to specify output format
interaction = client.interactions.create(
    model="gemini-3.6-flash",
    input="Translate 'Hello world' to Spanish.",
    system_instruction="Output only the translation without introductory text.",
)

Lista e kontrollit të migrimit për migrimin

Binjakët 3.6 Flash

  1. Instaloni aftësinë:

    npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global
  2. Zbatoni aftësinë:

    /gemini-interactions-api migrate my app to Gemini 3.6 Flash

Gemini 3.5 Flash-Lite

  1. Instaloni aftësinë:

    npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global
  2. Zbatoni aftësinë:

    /gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite

Migro në gemini-3.6-flash

  • Përditësoni ID-në e Modelit: Ndryshoni vargun e modelit tuaj të synuar në gemini-3.6-flash .
  • Hiq parametrat e vjetëruar të mostrave:
    • Zhvendos temperature , top_p dhe top_k nga konfigurimet e gjenerimit.
    • Zëvendësoni thinking_budget me numrin e vargut thinking_level të vendosur në "medium" ose "high" .
    • Hiq candidate_count (nuk mbështetet në Gemini 3.x).
  • Zbatoni rregullat e validimit të kthesës:
    • Standardizoni bisedat me shumë kthesa në anën e serverit previous_interaction_id .
    • Hiqni kthesat e modelit të parambushura.
  • Thirrja e funksionit të auditimit:
    • Vendosni asetet multimodale brenda ngarkesës së përgjigjes.
    • Formato udhëzimet brenda rreshtit duke përdorur \n\n .
    • Nëse shihni gabime Malformed_Function_Call të lidhura me tekstin para-mjetit, shihni Zgjidhjet e Zgjidhjes për kërkesat e tekstit para-mjetit .
    • Vetëm nëse përdorni generateContent API: Sigurohuni që të gjitha objektet FunctionResponse përfshijnë call_id dhe name .
  • Kërkesat bazë të Gemini 3.x: Për përditësimet e SDK-së dhe ruajtjen e nënshkrimit të mendimit, shihni Listën e Kontrollit të Migrimit Gemini 3.5 .

Migro në gemini-3.5-flash-lite

  • Përditësoni ID-në e Modelit: Ndryshoni vargun e modelit tuaj të synuar në gemini-3.5-flash-lite .
  • Konfiguro nivelin e përpjekjes së të menduarit:
    • Për nxjerrje, rrugëzim ose klasifikim me vëllim të lartë: lëreni thinking_level"minimal" (parazgjedhur) për rendiment maksimal.
    • Për nënagjentë autonomë me thirrje mjetesh, ekzekutim kodi ose arsyetim me shumë hapa: vendosni thinking_level"medium" ose "high" për të parandaluar ndërprerjen e parakohshme të mjeteve.
  • Hiq parametrat e vjetëruar dhe validoje thirrjen e funksionit: Zbato të njëjtat rregulla si në Flash 3.6 .
  • Kërkesat bazë të Gemini 3.x: Referojuni Listës së Kontrollit të Migrimit të Gemini 3.5 .

Hapat e ardhshëm