Gemini 3.6 Flash (gemini-3.6-flash) และ Gemini 3.5 Flash-Lite
(gemini-3.5-flash-lite) พร้อมใช้งานสำหรับผู้ใช้ทั่วไป (GA) และพร้อมสำหรับการ
ใช้งานจริงแล้ว
- Gemini 3.6 Flash: ประสิทธิภาพที่ดียิ่งขึ้นในงานที่ซับซ้อนซึ่งต้องใช้เอเจนต์และมัลติโมดัล พร้อมทั้งลดการใช้โทเค็นในราคาที่ต่ำกว่า 3.5 Flash
- Gemini 3.5 Flash-Lite: โมเดลที่เร็วที่สุดและมีต้นทุนต่ำที่สุดในตระกูล 3.5 มีประสิทธิภาพสูงกว่า Flash-Lite รุ่นก่อนๆ สำหรับการดำเนินการที่มีปริมาณงานสูง
คู่มือนี้อธิบายสิ่งใหม่ๆ ในแต่ละโมเดล การเปลี่ยนแปลง API ที่ส่งผลต่อโค้ดของคุณ และวิธีย้ายข้อมูล
Gemini 3.6 Flash
ติดตั้งทักษะโดยทำดังนี้
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalนำทักษะไปใช้
/gemini-interactions-api migrate my app to Gemini 3.6 Flash
Gemini 3.5 Flash-Lite
ติดตั้งทักษะโดยทำดังนี้
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalนำทักษะไปใช้
/gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite
โมเดลใหม่
| รุ่น | รหัสโมเดล | ระดับการคิดเริ่มต้น | ราคา | คำอธิบาย |
|---|---|---|---|---|
| Gemini 3.6 Flash | gemini-3.6-flash |
medium |
$1.50/โทเค็นอินพุต 1 ล้านโทเค็น และ $7.50/โทเค็นเอาต์พุต 1 ล้านโทเค็น | ปรับสมดุลความเร็วกับความอัจฉริยะสำหรับงานแบบ Agent และ Multimodal |
| Gemini 3.5 Flash-Lite | gemini-3.5-flash-lite |
minimal |
$0.30/โทเค็นอินพุต 1 ล้านรายการ และ $2.50/โทเค็นเอาต์พุต 1 ล้านรายการ | โมเดล 3.5 ที่เร็วที่สุดและมีต้นทุนต่ำที่สุดสำหรับการดำเนินการที่มีปริมาณงานสูง |
ทั้ง 2 โมเดลรองรับหน้าต่างบริบทขนาด 1 ล้านโทเค็น โทเค็นเอาต์พุตสูงสุด 64,000 รายการ การคิด และชุดเครื่องมือในตัวทั้งหมด ซึ่งรวมถึง การใช้คอมพิวเตอร์
ดูข้อมูลจำเพาะทั้งหมดได้ในหน้าโมเดลต่อไปนี้
ดูราคาโดยละเอียดได้ที่หน้าการกำหนดราคา
คู่มือเริ่มใช้งานฉบับย่อ
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.6-flash",
input="Write a three.js script that renders an interactive 3D robot."
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
async function main() {
const interaction = await ai.interactions.create({
model: "gemini-3.6-flash",
input: "Write a three.js script that renders an interactive 3D robot.",
});
console.log(interaction.outputText);
}
main();
REST
curl "https://generativelanguage.googleapis.com/v1beta/interactions" -H "x-goog-api-key: $GEMINI_API_KEY" -H 'Content-Type: application/json' -X POST -d '{
"model": "gemini-3.6-flash",
"input": "Write a three.js script that renders an interactive 3D robot."
}'
มีอะไรใหม่ใน Gemini 3.6 Flash
- การลดโทเค็นและรอบการสนทนา: ทำเวิร์กโฟลว์แบบหลายขั้นตอนให้เสร็จสมบูรณ์โดยมีขั้นตอนการให้เหตุผล รอบการสนทนา และการเรียกใช้เครื่องมือที่น้อยกว่า Gemini 3.5 นอกจากนี้ ยังช่วยลดการวนซ้ำของการดำเนินการด้วย
- การสร้างโค้ดที่ดียิ่งขึ้น: สร้างโค้ดที่พร้อมใช้งานจริงคุณภาพสูงขึ้น โดยมีการแก้ไขที่ไม่ต้องการและลูปการแก้ไขข้อบกพร่องน้อยลง
- ทำตามคำสั่งได้ดีขึ้น: ลดการเปลี่ยนแปลงไฟล์ที่ไม่ต้องการในระหว่างงานการวินิจฉัย
- การให้เหตุผลแบบมัลติโมดอลและเชิงพื้นที่ที่มีประสิทธิภาพ: ประสิทธิภาพที่ดียิ่งขึ้นในการตีความแผนภูมิ การแปลงพิมพ์เขียวภาพ และการสร้างเลย์เอาต์เว็บแบบหลายองค์ประกอบ
- การตรวจสอบแบบเป็นโปรแกรมล่วงหน้า: ชอบเรียกใช้สคริปต์โค้ดการวินิจฉัย ก่อนทำการเปลี่ยนแปลงบ่อยกว่า Gemini 3.5 Flash ซึ่งจะช่วยเพิ่มความแม่นยำในงานที่ซับซ้อน แต่ก็อาจเพิ่มขั้นตอนการสำรวจเพิ่มเติมในงานส่วนหน้าตามปกติ
- การสนับสนุนการใช้คอมพิวเตอร์: รองรับในฐานะเครื่องมือในตัวสำหรับการทำงานอัตโนมัติของ UI แบบเอเจนต์
- ค่ากำหนดการจัดรูปแบบ UI: สร้างโค้ดที่ใช้งานได้ดีขึ้น แต่ผู้ประเมินที่เป็นมนุษย์ชอบโมเดลก่อนหน้ามากกว่าสำหรับการจัดวางและการจัดรูปแบบภาพ คุณ ลดปัญหานี้ได้โดยระบุหลักเกณฑ์การออกแบบอย่างชัดเจน
- ความพยายามในการคิดเริ่มต้น (ปานกลาง): ใช้
mediumระดับการคิดเริ่มต้นเดียวกันกับ Gemini 3.5 Flash - ราคาที่ลดลง: ต้นทุนโทเค็นเอาต์พุตที่ต่ำลง ($7.50/1M เทียบกับ $9.00/1M สำหรับ 3.5 Flash) โทเค็นอินพุตจะยังคงอยู่ที่ $1.50/1M
มีอะไรใหม่ใน Gemini 3.5 Flash-Lite
- ลดเวลาในการตอบสนองของการดำเนินการงาน: อัตราการส่งข้อมูลสูงสุดในตระกูล 3.5 สำหรับการแยกวิเคราะห์ข้อมูลปริมาณมากและการแยกเอกสาร
- ประสิทธิภาพการให้เหตุผลและมัลติโมดัลที่ดียิ่งขึ้น: เส้นทางการย้ายข้อมูลที่ราบรื่นจาก Gemini 2.5 Flash โดยมีคะแนนสูงขึ้นในงานการให้เหตุผล เช่น HLE (18.0% เทียบกับ 11.0%) และการเปรียบเทียบมัลติโมดัล เช่น CharXIV (74.5% เทียบกับ 63.7%)
- การจัดระเบียบเอเจนต์ย่อยและความน่าเชื่อถือของเครื่องมือ: ปรับปรุงความน่าเชื่อถือในการดำเนินการเครื่องมือสำหรับการดำเนินการโค้ด การค้นหา และเวิร์กโฟลว์ MCP เพิ่ม ระดับการคิดสำหรับการวางแผนอัตโนมัติและงานของ Subagent ที่ซับซ้อน
- ความเข้าใจเอกสารที่ดีขึ้น: ปรับปรุงความแม่นยำในการแยกวิเคราะห์เอกสารและการแยก Structured Data ทดลองใช้ทั้งระดับการคิดขั้นต่ำและขั้นสูง ทั้งนี้ขึ้นอยู่กับความซับซ้อนของเอกสาร
- การเขียนโค้ดบนเว็บแบบอินเทอร์แอกทีฟและการประมวลผลข้อมูลตาราง: ทำงานได้ดีกับ JavaScript ฝั่งฟรอนท์เอนด์และการประมวลผลข้อมูลแบบตารางโดยการวางแผนโดยใช้การเรียกใช้โค้ดที่มีน้ำหนักเบา
- ความคงที่ของแชทบ็อตและลักษณะตัวตน: การปฏิบัติตามคำสั่งแบบการสนทนาไปมาที่ดียิ่งขึ้นและความสอดคล้องของลักษณะตัวตนเมื่อเทียบกับ Gemini 3.1 Flash-Lite
- การสนับสนุนการใช้คอมพิวเตอร์: รองรับในฐานะเครื่องมือในตัวสำหรับการทำงานอัตโนมัติของ UI แบบเอเจนต์
การเลือกรุ่น Flash หรือ Flash-Lite ที่เหมาะสม
ใช้ตารางนี้เพื่อเลือกโมเดลและเส้นทางการย้ายข้อมูลที่เหมาะสมสำหรับภาระงาน
ทั้ง 2 โมเดลต้องนำพารามิเตอร์การสุ่มตัวอย่างที่เลิกใช้งานแล้ว (temperature,
top_p, top_k) และรอบการโต้ตอบของโมเดลที่กำหนดไว้ล่วงหน้าออก ดูรายละเอียดได้ที่การเปลี่ยนแปลง API
| รุ่น | กรณีการใช้งานหลัก | เป้าหมายการย้ายข้อมูลที่แนะนำ |
|---|---|---|
Gemini 3.6 Flashgemini-3.6-flash |
การสร้างโค้ด การให้เหตุผลเชิงพื้นที่/แบบ Multimodal เวิร์กโฟลว์แบบ Agent หลายขั้นตอน | Gemini 3.5 Flash, Gemini 3 Flash (เวอร์ชันตัวอย่าง) หรือ Gemini 3.1 Pro |
Gemini 3.5 Flash-Litegemini-3.5-flash-lite |
การดำเนินการของ Subagent แบบอัตโนมัติ การวิเคราะห์ข้อมูลและการแยกเอกสารจำนวนมาก การแยกวิเคราะห์ JSON ที่มีโครงสร้าง | Gemini 3.1 Flash-Lite หรือ Gemini 2.5 Flash |
การสนับสนุน Agent ของ Antigravity
Gemini 3.6 Flash ได้เปิดตัวการรองรับเอเจนต์ Antigravity ใน Gemini Managed Agents
ดูตัวอย่างโค้ดปัจจุบันและการกำหนดค่าเอเจนต์เริ่มต้นล่าสุดได้ที่คู่มือเอเจนต์ Antigravity และคู่มือ Gemini 3.8 Flash
การเปลี่ยนแปลง API และการอัปเดตพารามิเตอร์
ตั้งแต่ Gemini 3.6 Flash และ Gemini 3.5 Flash-Lite เป็นต้นไป การเปลี่ยนแปลง API ต่อไปนี้จะมีผลกับโมเดลเหล่านี้และโมเดล Gemini ทั้งหมดที่จะเปิดตัวในอนาคต
- การเลิกใช้งานพารามิเตอร์การสุ่มตัวอย่าง:
temperature,top_pและtop_kถูกเลิกใช้งานแล้ว API จะไม่สนใจพารามิเตอร์เหล่านี้และจะแสดงข้อผิดพลาดในรุ่นโมเดลในอนาคต - การตรวจสอบรอบการโต้ตอบของโมเดลที่กำหนดไว้ล่วงหน้า: ระบบไม่รองรับการกำหนดรอบการโต้ตอบของโมเดลไว้ล่วงหน้าอีกต่อไป หากเทิร์นสุดท้ายที่ไม่ว่างในคำขอเป็นเทิร์น
modelAPI จะแสดงข้อผิดพลาด400
ส่วนต่อไปนี้จะอธิบายโดยละเอียดและแสดงตัวอย่างโค้ดสำหรับการเปลี่ยนแปลง API แต่ละรายการ
1. การเลิกใช้งานพารามิเตอร์การสุ่มตัวอย่าง (temperature, top_p, top_k)
temperature, top_p และ top_k จะเลิกใช้งานและระบบจะเพิกเฉย ในรุ่นโมเดลในอนาคต
การระบุพารามิเตอร์เหล่านี้จะแสดงข้อผิดพลาด HTTP 400 นำพารามิเตอร์เหล่านี้ออกจากคำขอทั้งหมด
# ⚠️ Remove these parameters (deprecated)
generation_config = {
"temperature": 0.7,
"top_p": 0.9,
"top_k": 40,
}
หากต้องการปรับปรุงความแน่นอน ให้กำหนดคำสั่งของระบบด้วยกฎที่ชัดเจนสำหรับกรณีการใช้งานเฉพาะของคุณ
2. การตรวจสอบรอบการโต้ตอบของโมเดลที่กำหนดไว้ล่วงหน้า
ระบบจะไม่อนุญาตคำขอ API ที่สิ้นสุดด้วยบทบาทของโมเดลที่ไม่ว่างเปล่า และจะแสดงข้อผิดพลาด HTTP 400
⚠️ หลีกเลี่ยง
ใน generateContent รุ่นเดิมหรือเพย์โหลด REST ดิบ ระบบไม่อนุญาตให้จบด้วยเทิร์นของบทบาทโมเดล
อีกต่อไป
/* ❌ DO NOT: End payload contents with a 'model' role turn */
{
"contents": [
{"role": "user", "parts": [{"text": "Translate 'Hello world' to Spanish."}]},
{"role": "model", "parts": [{"text": "Translation:"}]} /* ❌ Returns error */
]
}
✅ การย้ายข้อมูลที่แนะนำ (Interactions API)
ใน Interactions API ระบบจะไม่ป้อนข้อมูลการตอบกลับของโมเดลล่วงหน้าด้วยตนเอง หากก่อนหน้านี้แอปพลิเคชันของคุณกรอกข้อมูลล่วงหน้าในเทิร์นของโมเดลเพื่อระงับคำนำหรือบังคับการจัดรูปแบบ JSON ให้ใช้ system_instruction หรือเอาต์พุตที่มีโครงสร้างแทน
# ✅ RECOMMENDED: Use system_instruction in the Interactions API to specify output format
interaction = client.interactions.create(
model="gemini-3.6-flash",
input="Translate 'Hello world' to Spanish.",
system_instruction="Output only the translation without introductory text.",
)
รายการตรวจสอบการย้ายข้อมูล
Gemini 3.6 Flash
ติดตั้งทักษะโดยทำดังนี้
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalนำทักษะไปใช้
/gemini-interactions-api migrate my app to Gemini 3.6 Flash
Gemini 3.5 Flash-Lite
ติดตั้งทักษะโดยทำดังนี้
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalนำทักษะไปใช้
/gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite
ย้ายข้อมูลไปยัง gemini-3.6-flash
- อัปเดตรหัสโมเดล: เปลี่ยนสตริงโมเดลเป้าหมายเป็น
gemini-3.6-flash - ใช้การอัปเดตพารามิเตอร์: นำพารามิเตอร์การสุ่มตัวอย่างที่เลิกใช้งานแล้ว (
temperature,top_p,top_k),candidate_count(ไม่รองรับใน Gemini 3 ขึ้นไป) และเทิร์นของโมเดลที่กรอกข้อมูลไว้ล่วงหน้าออกตามที่ระบุไว้ในการเปลี่ยนแปลง API และการอัปเดตพารามิเตอร์ - กำหนดค่าระดับการคิด: แทนที่
thinking_budgetด้วยthinking_level("medium"หรือ"high") - การตรวจสอบการเรียกใช้ฟังก์ชัน:
- วางชิ้นงานมัลติโมดอลไว้ในเพย์โหลดการตอบกลับ
- จัดรูปแบบวิธีการในบรรทัดโดยใช้
\n\n - หากเห็น
Malformed_Function_Callข้อผิดพลาดที่เชื่อมโยงกับข้อความก่อนเครื่องมือ โปรดดูวิธีแก้ปัญหาข้อกำหนดของข้อความก่อนเครื่องมือ
- ข้อกำหนดพื้นฐานของ Gemini 3.x: ดูการอัปเดต SDK และการเก็บรักษาลายเซ็นความคิดได้ในรายการตรวจสอบการย้ายข้อมูล Gemini 3.5
ย้ายข้อมูลไปยัง gemini-3.5-flash-lite
- อัปเดตรหัสโมเดล: เปลี่ยนสตริงโมเดลเป้าหมายเป็น
gemini-3.5-flash-lite - กำหนดค่าระดับความพยายามในการคิด
- สำหรับการแยก การกำหนดเส้นทาง หรือการจัดประเภทปริมาณมาก ให้ปล่อย
thinking_levelไว้ที่"minimal"(ค่าเริ่มต้น) เพื่อให้มีอัตราการรับส่งข้อมูลสูงสุด - สำหรับ Subagent แบบอัตโนมัติที่มีการเรียกใช้เครื่องมือ การเรียกใช้โค้ด หรือการให้เหตุผลหลายขั้นตอน ให้ตั้งค่า
thinking_levelเป็น"medium"หรือ"high"เพื่อป้องกันไม่ให้เครื่องมือสิ้นสุดก่อนเวลาอันควร
- สำหรับการแยก การกำหนดเส้นทาง หรือการจัดประเภทปริมาณมาก ให้ปล่อย
- นำพารามิเตอร์ที่เลิกใช้งานแล้วออกและตรวจสอบการเรียกใช้ฟังก์ชัน: ใช้กฎเดียวกันกับ 3.6 Flash
- ข้อกำหนดพื้นฐานของ Gemini 3.x: ดูรายการตรวจสอบการย้ายข้อมูล Gemini 3.5
ขั้นตอนถัดไป
- ดูข้อกำหนดของ API ได้ที่ภาพรวมของโมเดล
- สำรวจการประสานงานแบบหลายเอเจนต์ในคู่มือ Interactions API
- ทดสอบและปรับแต่งพรอมต์ใน Google AI Studio