Gemini 3.6 Flash (gemini-3.6-flash) और Gemini 3.5 Flash-Lite (gemini-3.5-flash-lite) सामान्य रूप से उपलब्ध हैं. साथ ही, इनका इस्तेमाल प्रोडक्शन के लिए किया जा सकता है.
- Gemini 3.6 Flash: यह मॉडल, एजेंटिक और मल्टीमॉडल वाले मुश्किल टास्क को बेहतर तरीके से पूरा करता है. साथ ही, यह 3.5 Flash की तुलना में कम टोकन इस्तेमाल करता है और इसकी कीमत भी कम है.
- Gemini 3.5 Flash-Lite: यह 3.5 फ़ैमिली का सबसे तेज़ और सबसे कम कीमत वाला मॉडल है. यह मॉडल, ज़्यादा थ्रूपुट के साथ काम करने के लिए, Flash-Lite की पिछली जनरेशन से बेहतर है.
इस गाइड में बताया गया है कि हर मॉडल में नया क्या है, एपीआई में हुए किन बदलावों का असर आपके कोड पर पड़ता है, और माइग्रेट कैसे करें.
Gemini 3.6 Flash
स्किल इंस्टॉल करें:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalस्किल लागू करें:
/gemini-interactions-api migrate my app to Gemini 3.6 Flash
Gemini 3.5 Flash-Lite
स्किल इंस्टॉल करें:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalस्किल लागू करें:
/gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite
नए मॉडल
| मॉडल | मॉडल आईडी | सोचने का डिफ़ॉल्ट लेवल | कीमत | ब्यौरा |
|---|---|---|---|---|
| Gemini 3.6 Flash | gemini-3.6-flash |
medium |
इनपुट टोकन के लिए 1.50 डॉलर/मिलियन और आउटपुट टोकन के लिए 7.50 डॉलर/मिलियन | यह एजेंटिक और मल्टीमॉडल टास्क के लिए, तेज़ी से और समझदारी से काम करता है. |
| Gemini 3.5 Flash-Lite | gemini-3.5-flash-lite |
minimal |
इनपुट टोकन के लिए 0.30 डॉलर/मिलियन और आउटपुट टोकन के लिए 2.50 डॉलर/मिलियन | यह मॉडल, ज़्यादा थ्रूपुट के साथ काम करने के लिए सबसे तेज़ और सबसे कम कीमत वाला 3.5 मॉडल है. |
दोनों मॉडल में, 10 लाख टोकन वाली कॉन्टेक्स्ट विंडो और ज़्यादा से ज़्यादा 64 हज़ार आउटपुट टोकन इस्तेमाल किए जा सकते हैं. साथ ही, ये सोच-समझकर जवाब दे सकते हैं. इनमें कंप्यूटर का इस्तेमाल करने की सुविधा के साथ-साथ, पहले से मौजूद टूल का फ़ुल सुइट भी शामिल है.
पूरी जानकारी के लिए, मॉडल के पेज देखें:
शुल्क के बारे में ज़्यादा जानकारी के लिए, शुल्क वाला पेज देखें.
क्विकस्टार्ट
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.6-flash",
input="Write a three.js script that renders an interactive 3D robot."
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
async function main() {
const interaction = await ai.interactions.create({
model: "gemini-3.6-flash",
input: "Write a three.js script that renders an interactive 3D robot.",
});
console.log(interaction.outputText);
}
main();
REST
curl "https://generativelanguage.googleapis.com/v1beta/interactions" -H "x-goog-api-key: $GEMINI_API_KEY" -H 'Content-Type: application/json' -X POST -d '{
"model": "gemini-3.6-flash",
"input": "Write a three.js script that renders an interactive 3D robot."
}'
Gemini 3.6 Flash में नया क्या है
- टोकन और टर्न में कमी: यह Gemini 3.5 की तुलना में, कम तर्कों, बातचीत के टर्न, और टूल कॉल के साथ कई चरणों वाले वर्कफ़्लो पूरे करता है. इससे एक्ज़ीक्यूशन लूप स्पाइरलिंग भी कम हो जाती है.
- बेहतर कोड जनरेट करने की सुविधा: यह सुविधा, इस्तेमाल के लिए तैयार बेहतर क्वालिटी वाला कोड जनरेट करती है. इसमें कम अनचाहे बदलाव होते हैं और डीबग करने के लिए कम लूप होते हैं.
- निर्देशों का बेहतर तरीके से पालन करना: गड़बड़ी की जानकारी देने वाले टास्क के दौरान, फ़ाइल में अनचाहे बदलावों को कम करता है.
- मल्टीमॉडल और स्पेशल रीज़निंग की बेहतर क्षमता: चार्ट को समझने, विज़ुअल ब्लूप्रिंट को बदलने, और कई एलिमेंट वाले वेब लेआउट जनरेट करने की बेहतर क्षमता.
- प्रोग्राम के हिसाब से पहले से की गई जांच: Gemini 3.5 Flash की तुलना में, यह बदलाव करने से पहले ज़्यादा बार डाइग्नोस्टिक कोड स्क्रिप्ट चलाता है. इससे मुश्किल टास्क को ज़्यादा सटीक तरीके से पूरा किया जा सकता है. हालांकि, इससे रोज़मर्रा के फ़्रंटएंड के काम में कुछ अतिरिक्त चरण जुड़ सकते हैं.
- कंप्यूटर के इस्तेमाल से जुड़ी सहायता: यह एजेंटिक यूआई ऑटोमेशन के लिए, पहले से मौजूद टूल के तौर पर काम करता है.
- यूज़र इंटरफ़ेस (यूआई) स्टाइलिंग की प्राथमिकता: यह काम करने वाला कोड बेहतर तरीके से बना सकता है. हालांकि, इंसानों ने विज़ुअल लेआउट और स्टाइलिंग के लिए, पहले के मॉडल को प्राथमिकता दी थी. डिजाइन से जुड़े दिशा-निर्देश साफ़ तौर पर देकर, इस समस्या को कम किया जा सकता है.
- सोच-समझकर जवाब देने का डिफ़ॉल्ट लेवल (मीडियम): यह Gemini 3.5 Flash के
mediumसोच-समझकर जवाब देने के डिफ़ॉल्ट लेवल का इस्तेमाल करता है. - कम कीमत: आउटपुट टोकन की कम लागत (3.5 Flash के लिए 9.00 डॉलर/मिलियन के मुकाबले 7.50 डॉलर/मिलियन). इनपुट टोकन के लिए, 150 रुपये/10 लाख टोकन का शुल्क लिया जाएगा.
Gemini 3.5 Flash-Lite में नया क्या है
- टास्क पूरा होने में लगने वाला समय कम हुआ: ज़्यादा डेटा पार्स करने और दस्तावेज़ों से जानकारी निकालने के लिए, 3.5 फ़ैमिली में सबसे ज़्यादा थ्रूपुट.
- बेहतर रीज़निंग और मल्टीमॉडल परफ़ॉर्मेंस: Gemini 2.5 Flash से माइग्रेट करने का बेहतर विकल्प. साथ ही, रीज़निंग वाले टास्क में ज़्यादा स्कोर. जैसे, HLE (18.0% बनाम 11.0%) और मल्टीमॉडल बेंचमार्क. जैसे, CharXIV (74.5% बनाम 63.7%).
- सब-एजेंट ऑर्केस्ट्रेशन और टूल की भरोसेमंदता: इससे कोड को लागू करने, खोजने, और एमसीपी वर्कफ़्लो के लिए टूल को लागू करने की भरोसेमंदता बेहतर होती है. अपने-आप प्लान बनाने और सब-एजेंट के मुश्किल टास्क के लिए, सोचने का लेवल बढ़ाएं.
- दस्तावेज़ को बेहतर तरीके से समझना: इससे दस्तावेज़ को पार्स करने और स्ट्रक्चर्ड डेटा निकालने की सुविधा को ज़्यादा सटीक बनाया जा सकता है. दस्तावेज़ की जटिलता के आधार पर, कम और ज़्यादा सोच-विचार करने वाले दोनों तरीकों का इस्तेमाल करें.
- इंटरैक्टिव वेब कोडिंग और टेबल फ़ॉर्मैट वाले डेटा को प्रोसेस करना: यह हल्के कोड एक्ज़ीक्यूशन की योजना बनाकर, फ़्रंटएंड JavaScript और टेबल फ़ॉर्मैट वाले डेटा को प्रोसेस करने में बेहतर परफ़ॉर्म करता है.
- चैटबॉट और पर्सोना की स्थिरता: Gemini 3.1 Flash-Lite की तुलना में, निर्देशों का बेहतर तरीके से पालन करना और पर्सोना को बनाए रखना.
- कंप्यूटर के इस्तेमाल से जुड़ी सहायता: यह एजेंटिक यूआई ऑटोमेशन के लिए, पहले से मौजूद टूल के तौर पर काम करता है.
सही Flash या Flash-Lite मॉडल चुनना
इस टेबल का इस्तेमाल करके, अपने वर्कलोड के लिए सही मॉडल और माइग्रेशन का तरीका चुनें.
दोनों मॉडल के लिए, अब काम न करने वाले सैंपलिंग पैरामीटर (temperature,
top_p, top_k) और पहले से भरे गए मॉडल टर्न को हटाना ज़रूरी है. ज़्यादा जानकारी के लिए, एपीआई में हुए बदलाव देखें.
| मॉडल | इस्तेमाल के मुख्य उदाहरण | माइग्रेशन के लिए सुझाया गया टारगेट |
|---|---|---|
Gemini 3.6 Flashgemini-3.6-flash |
कोड जनरेशन, स्पेशल/टेक्स्ट, इमेज वग़ैरह को प्रोसेस करने वाला मॉडल गहराई से विश्लेषण, कई चरणों वाले एजेंटिक वर्कफ़्लो | Gemini 3.5 Flash, Gemini 3 Flash (Preview) या Gemini 3.1 Pro |
Gemini 3.5 Flash-Litegemini-3.5-flash-lite |
ऑटोनॉमस सब-एजेंट एक्ज़ीक्यूशन, बड़ी मात्रा में डेटा का विश्लेषण और दस्तावेज़ से जानकारी निकालना, स्ट्रक्चर्ड JSON पार्सिंग | Gemini 3.1 Flash-Lite या Gemini 2.5 Flash |
Antigravity एजेंट से सहायता
Gemini 3.6 Flash में, Gemini में एजेंट बनाने और मैनेज करने की सुविधा में Antigravity एजेंट के लिए सहायता उपलब्ध कराई गई है.
मौजूदा कोड सैंपल और डिफ़ॉल्ट एजेंट कॉन्फ़िगरेशन के बारे में जानने के लिए, Antigravity एजेंट गाइड और Gemini 3.8 Flash गाइड देखें.
एपीआई में हुए बदलाव और पैरामीटर के अपडेट
Gemini 3.6 Flash और Gemini 3.5 Flash-Lite से शुरू करके, एपीआई में हुए ये बदलाव इन मॉडल और Gemini के आने वाले सभी मॉडल पर लागू होंगे.
- सैंपलिंग पैरामीटर अब काम नहीं करते:
temperature,top_p, औरtop_kअब काम नहीं करते. एपीआई इन पैरामीटर को अनदेखा करता है और आने वाले समय में मॉडल जनरेट करते समय गड़बड़ी दिखाता है. - पहले से भरे गए मॉडल टर्न की पुष्टि करना: मॉडल टर्न को पहले से भरने की सुविधा अब काम नहीं करती. अगर अनुरोध में मौजूद आखिरी टर्न
modelटर्न है, तो एपीआई400गड़बड़ी का मैसेज दिखाता है.
यहां दिए गए सेक्शन में, एपीआई में हुए हर बदलाव के बारे में पूरी जानकारी और कोड सैंपल दिए गए हैं.
1. सैंपलिंग पैरामीटर के काम न करने से जुड़ी जानकारी (temperature, top_p, top_k)
temperature, top_p, और top_k अब काम नहीं करते और इन्हें अनदेखा किया जाता है. आने वाले समय में मॉडल जनरेशन के लिए, इन पैरामीटर को उपलब्ध कराने पर एचटीटीपी 400 गड़बड़ी दिखेगी. सभी अनुरोधों से इन पैरामीटर को हटाएं.
# ⚠️ Remove these parameters (deprecated)
generation_config = {
"temperature": 0.7,
"top_p": 0.9,
"top_k": 40,
}
जवाब के सटीक होने की संभावना को बेहतर बनाने के लिए, अपने इस्तेमाल के उदाहरण के हिसाब से साफ़ तौर पर नियम तय करके, सिस्टम के लिए निर्देश तय करें.
2. पहले से भरे गए मॉडल टर्न की पुष्टि करना
मॉडल की भूमिका के साथ खत्म होने वाले एपीआई अनुरोधों को अनुमति नहीं दी जाती. ऐसे अनुरोधों के जवाब में, एचटीटीपी 400 गड़बड़ी का मैसेज दिखता है.
⚠️ इस्तेमाल करने से बचें
लेगसी generateContent या रॉ REST पेलोड में, मॉडल की भूमिका वाले टर्न के साथ खत्म होने वाले मैसेज अब नहीं भेजे जा सकते:
/* ❌ DO NOT: End payload contents with a 'model' role turn */
{
"contents": [
{"role": "user", "parts": [{"text": "Translate 'Hello world' to Spanish."}]},
{"role": "model", "parts": [{"text": "Translation:"}]} /* ❌ Returns error */
]
}
✅ माइग्रेशन का सुझाव दिया गया (Interactions API)
Interactions API में, मॉडल के जवाबों को मैन्युअल तरीके से पहले से नहीं भरा जाता. अगर आपके ऐप्लिकेशन ने पहले मॉडल के जवाब में, प्रस्तावनाओं को हटाने या JSON फ़ॉर्मैटिंग को लागू करने के लिए, मॉडल के जवाब को पहले से भरा था, तो इसके बजाय system_instruction या स्ट्रक्चर्ड आउटपुट का इस्तेमाल करें.
# ✅ RECOMMENDED: Use system_instruction in the Interactions API to specify output format
interaction = client.interactions.create(
model="gemini-3.6-flash",
input="Translate 'Hello world' to Spanish.",
system_instruction="Output only the translation without introductory text.",
)
माइग्रेशन की चेकलिस्ट
Gemini 3.6 Flash
स्किल इंस्टॉल करें:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalस्किल लागू करें:
/gemini-interactions-api migrate my app to Gemini 3.6 Flash
Gemini 3.5 Flash-Lite
स्किल इंस्टॉल करें:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalस्किल लागू करें:
/gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite
gemini-3.6-flash पर माइग्रेट करना
- मॉडल आईडी अपडेट करें: अपने टारगेट मॉडल स्ट्रिंग को
gemini-3.6-flashमें बदलें. - पैरामीटर अपडेट लागू करें:
temperature,top_p,top_kजैसे बंद किए गए सैंपलिंग पैरामीटर हटाएं. साथ ही,candidate_count(Gemini 3 और इसके बाद के वर्शन में काम नहीं करता) और पहले से भरे गए मॉडल टर्न हटाएं. इस बारे में ज़्यादा जानकारी के लिए, एपीआई में हुए बदलाव और पैरामीटर अपडेट लेख पढ़ें. - सोचने का लेवल कॉन्फ़िगर करना:
thinking_budgetकोthinking_level("medium"या"high") से बदलें. - फ़ंक्शन कॉल की ऑडिटिंग:
- जवाब के पेलोड में मल्टीमॉडल ऐसेट रखें.
- इनलाइन निर्देशों को
\n\nका इस्तेमाल करके फ़ॉर्मैट करें. - अगर आपको टूल से पहले के टेक्स्ट से जुड़ी
Malformed_Function_Callगड़बड़ियां दिखती हैं, तो टूल से पहले के टेक्स्ट की ज़रूरी शर्तों को पूरा करने के तरीके देखें.
- Gemini 3.x की बुनियादी ज़रूरी शर्तें: एसडीके अपडेट और थॉट सिग्नेचर को सुरक्षित रखने के लिए, Gemini 3.5 पर माइग्रेट करने की चेकलिस्ट देखें.
gemini-3.5-flash-lite पर माइग्रेट करना
- मॉडल आईडी अपडेट करें: अपने टारगेट मॉडल स्ट्रिंग को
gemini-3.5-flash-liteमें बदलें. - सोचने के स्तर को कॉन्फ़िगर करना:
- ज़्यादा डेटा निकालने, रूट करने या क्लासिफ़ाई करने के लिए: ज़्यादा थ्रूपुट पाने के लिए,
thinking_levelको"minimal"(डिफ़ॉल्ट) पर छोड़ दें. - टूल कॉल, कोड एक्ज़ीक्यूशन या कई चरणों में तर्क करने की सुविधा वाले ऑटोनॉमस सब-एजेंट के लिए:
thinking_levelको"medium"या"high"पर सेट करें, ताकि टूल को समय से पहले बंद होने से रोका जा सके.
- ज़्यादा डेटा निकालने, रूट करने या क्लासिफ़ाई करने के लिए: ज़्यादा थ्रूपुट पाने के लिए,
- बंद किए गए पैरामीटर हटाएं और फ़ंक्शन कॉल करने की सुविधा की पुष्टि करें: 3.6 Flash वाले नियम लागू करें.
- Gemini 3.x के लिए ज़रूरी शर्तें: Gemini 3.5 पर माइग्रेट करने से जुड़ी चेकलिस्ट देखें.
अगले चरण
- मॉडल की खास जानकारी में जाकर, एपीआई की खास बातें देखें.
- Interactions API की गाइड में, एक से ज़्यादा एजेंट को मैनेज करने की सुविधा के बारे में जानें.
- Google AI Studio में प्रॉम्प्ट को टेस्ट करें और उन्हें बेहतर बनाएं.