Gemini 3.6 Flash और 3.5 Flash-Lite में नया क्या है

नया मॉडल अन्य मॉडल

Gemini 3.6 Flash (gemini-3.6-flash) और Gemini 3.5 Flash-Lite (gemini-3.5-flash-lite) सामान्य रूप से उपलब्ध हैं. साथ ही, इनका इस्तेमाल प्रोडक्शन के लिए किया जा सकता है.

  • Gemini 3.6 Flash: यह मॉडल, एजेंटिक और मल्टीमॉडल वाले मुश्किल टास्क को बेहतर तरीके से पूरा करता है. साथ ही, यह 3.5 Flash की तुलना में कम टोकन इस्तेमाल करता है और इसकी कीमत भी कम है.
  • Gemini 3.5 Flash-Lite: यह 3.5 फ़ैमिली का सबसे तेज़ और सबसे कम कीमत वाला मॉडल है. यह मॉडल, ज़्यादा थ्रूपुट के साथ काम करने के लिए, Flash-Lite की पिछली जनरेशन से बेहतर है.

इस गाइड में बताया गया है कि हर मॉडल में नया क्या है, एपीआई में हुए किन बदलावों का असर आपके कोड पर पड़ता है, और माइग्रेट कैसे करें.

Gemini 3.6 Flash

  1. स्किल इंस्टॉल करें:

    npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global
  2. स्किल लागू करें:

    /gemini-interactions-api migrate my app to Gemini 3.6 Flash

Gemini 3.5 Flash-Lite

  1. स्किल इंस्टॉल करें:

    npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global
  2. स्किल लागू करें:

    /gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite

नए मॉडल

मॉडल मॉडल आईडी सोचने का डिफ़ॉल्ट लेवल कीमत ब्यौरा
Gemini 3.6 Flash gemini-3.6-flash medium इनपुट टोकन के लिए 1.50 डॉलर/मिलियन और आउटपुट टोकन के लिए 7.50 डॉलर/मिलियन यह एजेंटिक और मल्टीमॉडल टास्क के लिए, तेज़ी से और समझदारी से काम करता है.
Gemini 3.5 Flash-Lite gemini-3.5-flash-lite minimal इनपुट टोकन के लिए 0.30 डॉलर/मिलियन और आउटपुट टोकन के लिए 2.50 डॉलर/मिलियन यह मॉडल, ज़्यादा थ्रूपुट के साथ काम करने के लिए सबसे तेज़ और सबसे कम कीमत वाला 3.5 मॉडल है.

दोनों मॉडल में, 10 लाख टोकन वाली कॉन्टेक्स्ट विंडो और ज़्यादा से ज़्यादा 64 हज़ार आउटपुट टोकन इस्तेमाल किए जा सकते हैं. साथ ही, ये सोच-समझकर जवाब दे सकते हैं. इनमें कंप्यूटर का इस्तेमाल करने की सुविधा के साथ-साथ, पहले से मौजूद टूल का फ़ुल सुइट भी शामिल है.

पूरी जानकारी के लिए, मॉडल के पेज देखें:

शुल्क के बारे में ज़्यादा जानकारी के लिए, शुल्क वाला पेज देखें.

क्विकस्टार्ट

Python

from google import genai

client = genai.Client()

interaction = client.interactions.create(
    model="gemini-3.6-flash",
    input="Write a three.js script that renders an interactive 3D robot."
)

print(interaction.output_text)

JavaScript

import { GoogleGenAI } from "@google/genai";

const ai = new GoogleGenAI({});

async function main() {
  const interaction = await ai.interactions.create({
    model: "gemini-3.6-flash",
    input: "Write a three.js script that renders an interactive 3D robot.",
  });
  console.log(interaction.outputText);
}

main();

REST

curl "https://generativelanguage.googleapis.com/v1beta/interactions"       -H "x-goog-api-key: $GEMINI_API_KEY"       -H 'Content-Type: application/json'       -X POST       -d '{
    "model": "gemini-3.6-flash",
    "input": "Write a three.js script that renders an interactive 3D robot."
  }'

Gemini 3.6 Flash में नया क्या है

  • टोकन और टर्न में कमी: यह Gemini 3.5 की तुलना में, कम तर्कों, बातचीत के टर्न, और टूल कॉल के साथ कई चरणों वाले वर्कफ़्लो पूरे करता है. इससे एक्ज़ीक्यूशन लूप स्पाइरलिंग भी कम हो जाती है.
  • बेहतर कोड जनरेट करने की सुविधा: यह सुविधा, इस्तेमाल के लिए तैयार बेहतर क्वालिटी वाला कोड जनरेट करती है. इसमें कम अनचाहे बदलाव होते हैं और डीबग करने के लिए कम लूप होते हैं.
  • निर्देशों का बेहतर तरीके से पालन करना: गड़बड़ी की जानकारी देने वाले टास्क के दौरान, फ़ाइल में अनचाहे बदलावों को कम करता है.
  • मल्टीमॉडल और स्पेशल रीज़निंग की बेहतर क्षमता: चार्ट को समझने, विज़ुअल ब्लूप्रिंट को बदलने, और कई एलिमेंट वाले वेब लेआउट जनरेट करने की बेहतर क्षमता.
  • प्रोग्राम के हिसाब से पहले से की गई जांच: Gemini 3.5 Flash की तुलना में, यह बदलाव करने से पहले ज़्यादा बार डाइग्नोस्टिक कोड स्क्रिप्ट चलाता है. इससे मुश्किल टास्क को ज़्यादा सटीक तरीके से पूरा किया जा सकता है. हालांकि, इससे रोज़मर्रा के फ़्रंटएंड के काम में कुछ अतिरिक्त चरण जुड़ सकते हैं.
  • कंप्यूटर के इस्तेमाल से जुड़ी सहायता: यह एजेंटिक यूआई ऑटोमेशन के लिए, पहले से मौजूद टूल के तौर पर काम करता है.
  • यूज़र इंटरफ़ेस (यूआई) स्टाइलिंग की प्राथमिकता: यह काम करने वाला कोड बेहतर तरीके से बना सकता है. हालांकि, इंसानों ने विज़ुअल लेआउट और स्टाइलिंग के लिए, पहले के मॉडल को प्राथमिकता दी थी. डिजाइन से जुड़े दिशा-निर्देश साफ़ तौर पर देकर, इस समस्या को कम किया जा सकता है.
  • सोच-समझकर जवाब देने का डिफ़ॉल्ट लेवल (मीडियम): यह Gemini 3.5 Flash के medium सोच-समझकर जवाब देने के डिफ़ॉल्ट लेवल का इस्तेमाल करता है.
  • कम कीमत: आउटपुट टोकन की कम लागत (3.5 Flash के लिए 9.00 डॉलर/मिलियन के मुकाबले 7.50 डॉलर/मिलियन). इनपुट टोकन के लिए, 150 रुपये/10 लाख टोकन का शुल्क लिया जाएगा.

Gemini 3.5 Flash-Lite में नया क्या है

  • टास्क पूरा होने में लगने वाला समय कम हुआ: ज़्यादा डेटा पार्स करने और दस्तावेज़ों से जानकारी निकालने के लिए, 3.5 फ़ैमिली में सबसे ज़्यादा थ्रूपुट.
  • बेहतर रीज़निंग और मल्टीमॉडल परफ़ॉर्मेंस: Gemini 2.5 Flash से माइग्रेट करने का बेहतर विकल्प. साथ ही, रीज़निंग वाले टास्क में ज़्यादा स्कोर. जैसे, HLE (18.0% बनाम 11.0%) और मल्टीमॉडल बेंचमार्क. जैसे, CharXIV (74.5% बनाम 63.7%).
  • सब-एजेंट ऑर्केस्ट्रेशन और टूल की भरोसेमंदता: इससे कोड को लागू करने, खोजने, और एमसीपी वर्कफ़्लो के लिए टूल को लागू करने की भरोसेमंदता बेहतर होती है. अपने-आप प्लान बनाने और सब-एजेंट के मुश्किल टास्क के लिए, सोचने का लेवल बढ़ाएं.
  • दस्तावेज़ को बेहतर तरीके से समझना: इससे दस्तावेज़ को पार्स करने और स्ट्रक्चर्ड डेटा निकालने की सुविधा को ज़्यादा सटीक बनाया जा सकता है. दस्तावेज़ की जटिलता के आधार पर, कम और ज़्यादा सोच-विचार करने वाले दोनों तरीकों का इस्तेमाल करें.
  • इंटरैक्टिव वेब कोडिंग और टेबल फ़ॉर्मैट वाले डेटा को प्रोसेस करना: यह हल्के कोड एक्ज़ीक्यूशन की योजना बनाकर, फ़्रंटएंड JavaScript और टेबल फ़ॉर्मैट वाले डेटा को प्रोसेस करने में बेहतर परफ़ॉर्म करता है.
  • चैटबॉट और पर्सोना की स्थिरता: Gemini 3.1 Flash-Lite की तुलना में, निर्देशों का बेहतर तरीके से पालन करना और पर्सोना को बनाए रखना.
  • कंप्यूटर के इस्तेमाल से जुड़ी सहायता: यह एजेंटिक यूआई ऑटोमेशन के लिए, पहले से मौजूद टूल के तौर पर काम करता है.

सही Flash या Flash-Lite मॉडल चुनना

इस टेबल का इस्तेमाल करके, अपने वर्कलोड के लिए सही मॉडल और माइग्रेशन का तरीका चुनें.

दोनों मॉडल के लिए, अब काम न करने वाले सैंपलिंग पैरामीटर (temperature, top_p, top_k) और पहले से भरे गए मॉडल टर्न को हटाना ज़रूरी है. ज़्यादा जानकारी के लिए, एपीआई में हुए बदलाव देखें.

मॉडल इस्तेमाल के मुख्य उदाहरण माइग्रेशन के लिए सुझाया गया टारगेट
Gemini 3.6 Flash
gemini-3.6-flash
कोड जनरेशन, स्पेशल/टेक्स्ट, इमेज वग़ैरह को प्रोसेस करने वाला मॉडल गहराई से विश्लेषण, कई चरणों वाले एजेंटिक वर्कफ़्लो Gemini 3.5 Flash, Gemini 3 Flash (Preview) या Gemini 3.1 Pro
Gemini 3.5 Flash-Lite
gemini-3.5-flash-lite
ऑटोनॉमस सब-एजेंट एक्ज़ीक्यूशन, बड़ी मात्रा में डेटा का विश्लेषण और दस्तावेज़ से जानकारी निकालना, स्ट्रक्चर्ड JSON पार्सिंग Gemini 3.1 Flash-Lite या Gemini 2.5 Flash

Antigravity एजेंट से सहायता

Gemini 3.6 Flash में, Gemini में एजेंट बनाने और मैनेज करने की सुविधा में Antigravity एजेंट के लिए सहायता उपलब्ध कराई गई है.

मौजूदा कोड सैंपल और डिफ़ॉल्ट एजेंट कॉन्फ़िगरेशन के बारे में जानने के लिए, Antigravity एजेंट गाइड और Gemini 3.8 Flash गाइड देखें.

एपीआई में हुए बदलाव और पैरामीटर के अपडेट

Gemini 3.6 Flash और Gemini 3.5 Flash-Lite से शुरू करके, एपीआई में हुए ये बदलाव इन मॉडल और Gemini के आने वाले सभी मॉडल पर लागू होंगे.

  • सैंपलिंग पैरामीटर अब काम नहीं करते: temperature, top_p, और top_k अब काम नहीं करते. एपीआई इन पैरामीटर को अनदेखा करता है और आने वाले समय में मॉडल जनरेट करते समय गड़बड़ी दिखाता है.
  • पहले से भरे गए मॉडल टर्न की पुष्टि करना: मॉडल टर्न को पहले से भरने की सुविधा अब काम नहीं करती. अगर अनुरोध में मौजूद आखिरी टर्न model टर्न है, तो एपीआई 400 गड़बड़ी का मैसेज दिखाता है.

यहां दिए गए सेक्शन में, एपीआई में हुए हर बदलाव के बारे में पूरी जानकारी और कोड सैंपल दिए गए हैं.

1. सैंपलिंग पैरामीटर के काम न करने से जुड़ी जानकारी (temperature, top_p, top_k)

temperature, top_p, और top_k अब काम नहीं करते और इन्हें अनदेखा किया जाता है. आने वाले समय में मॉडल जनरेशन के लिए, इन पैरामीटर को उपलब्ध कराने पर एचटीटीपी 400 गड़बड़ी दिखेगी. सभी अनुरोधों से इन पैरामीटर को हटाएं.

# ⚠️ Remove these parameters (deprecated)
generation_config = {
     "temperature": 0.7,
     "top_p": 0.9,
     "top_k": 40,
}

जवाब के सटीक होने की संभावना को बेहतर बनाने के लिए, अपने इस्तेमाल के उदाहरण के हिसाब से साफ़ तौर पर नियम तय करके, सिस्टम के लिए निर्देश तय करें.

2. पहले से भरे गए मॉडल टर्न की पुष्टि करना

मॉडल की भूमिका के साथ खत्म होने वाले एपीआई अनुरोधों को अनुमति नहीं दी जाती. ऐसे अनुरोधों के जवाब में, एचटीटीपी 400 गड़बड़ी का मैसेज दिखता है.

⚠️ इस्तेमाल करने से बचें

लेगसी generateContent या रॉ REST पेलोड में, मॉडल की भूमिका वाले टर्न के साथ खत्म होने वाले मैसेज अब नहीं भेजे जा सकते:

/* ❌ DO NOT: End payload contents with a 'model' role turn */
{
  "contents": [
    {"role": "user", "parts": [{"text": "Translate 'Hello world' to Spanish."}]},
    {"role": "model", "parts": [{"text": "Translation:"}]}  /* ❌ Returns error */
  ]
}

Interactions API में, मॉडल के जवाबों को मैन्युअल तरीके से पहले से नहीं भरा जाता. अगर आपके ऐप्लिकेशन ने पहले मॉडल के जवाब में, प्रस्तावनाओं को हटाने या JSON फ़ॉर्मैटिंग को लागू करने के लिए, मॉडल के जवाब को पहले से भरा था, तो इसके बजाय system_instruction या स्ट्रक्चर्ड आउटपुट का इस्तेमाल करें.

# ✅ RECOMMENDED: Use system_instruction in the Interactions API to specify output format
interaction = client.interactions.create(
    model="gemini-3.6-flash",
    input="Translate 'Hello world' to Spanish.",
    system_instruction="Output only the translation without introductory text.",
)

माइग्रेशन की चेकलिस्ट

Gemini 3.6 Flash

  1. स्किल इंस्टॉल करें:

    npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global
  2. स्किल लागू करें:

    /gemini-interactions-api migrate my app to Gemini 3.6 Flash

Gemini 3.5 Flash-Lite

  1. स्किल इंस्टॉल करें:

    npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --global
  2. स्किल लागू करें:

    /gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite

gemini-3.6-flash पर माइग्रेट करना

  • मॉडल आईडी अपडेट करें: अपने टारगेट मॉडल स्ट्रिंग को gemini-3.6-flash में बदलें.
  • पैरामीटर अपडेट लागू करें: temperature, top_p, top_k जैसे बंद किए गए सैंपलिंग पैरामीटर हटाएं. साथ ही, candidate_count (Gemini 3 और इसके बाद के वर्शन में काम नहीं करता) और पहले से भरे गए मॉडल टर्न हटाएं. इस बारे में ज़्यादा जानकारी के लिए, एपीआई में हुए बदलाव और पैरामीटर अपडेट लेख पढ़ें.
  • सोचने का लेवल कॉन्फ़िगर करना: thinking_budget को thinking_level ("medium" या "high") से बदलें.
  • फ़ंक्शन कॉल की ऑडिटिंग:
  • Gemini 3.x की बुनियादी ज़रूरी शर्तें: एसडीके अपडेट और थॉट सिग्नेचर को सुरक्षित रखने के लिए, Gemini 3.5 पर माइग्रेट करने की चेकलिस्ट देखें.

gemini-3.5-flash-lite पर माइग्रेट करना

  • मॉडल आईडी अपडेट करें: अपने टारगेट मॉडल स्ट्रिंग को gemini-3.5-flash-lite में बदलें.
  • सोचने के स्तर को कॉन्फ़िगर करना:
    • ज़्यादा डेटा निकालने, रूट करने या क्लासिफ़ाई करने के लिए: ज़्यादा थ्रूपुट पाने के लिए, thinking_level को "minimal" (डिफ़ॉल्ट) पर छोड़ दें.
    • टूल कॉल, कोड एक्ज़ीक्यूशन या कई चरणों में तर्क करने की सुविधा वाले ऑटोनॉमस सब-एजेंट के लिए: thinking_level को "medium" या "high" पर सेट करें, ताकि टूल को समय से पहले बंद होने से रोका जा सके.
  • बंद किए गए पैरामीटर हटाएं और फ़ंक्शन कॉल करने की सुविधा की पुष्टि करें: 3.6 Flash वाले नियम लागू करें.
  • Gemini 3.x के लिए ज़रूरी शर्तें: Gemini 3.5 पर माइग्रेट करने से जुड़ी चेकलिस्ट देखें.

अगले चरण