Gemini 3.6 Flash (gemini-3.6-flash) dan Gemini 3.5 Flash-Lite (gemini-3.5-flash-lite) kini tersedia secara umum (GA) dan siap digunakan untuk produksi.
- Gemini 3.6 Flash: Performa yang lebih baik pada tugas multimodal dan agentik yang kompleks sekaligus mengurangi penggunaan token, dengan titik harga yang lebih rendah daripada 3.5 Flash.
- Gemini 3.5 Flash-Lite: Model tercepat dan berbiaya terendah dalam rangkaian 3.5. Mengungguli generasi Flash-Lite sebelumnya untuk eksekusi dengan throughput tinggi.
Panduan ini menjelaskan hal-hal baru di setiap model, perubahan API yang memengaruhi kode Anda, dan cara melakukan migrasi.
Gemini 3.6 Flash
Instal keahlian:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalTerapkan keahlian:
/gemini-interactions-api migrate my app to Gemini 3.6 Flash
Gemini 3.5 Flash-Lite
Instal keahlian:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalTerapkan keahlian:
/gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite
Model baru
| Model | ID Model | Tingkat penalaran default | Harga | Deskripsi |
|---|---|---|---|---|
| Gemini 3.6 Flash | gemini-3.6-flash |
medium |
$1,50/1 Juta token input dan $7,50/1 Juta token output | Menyeimbangkan kecepatan dengan kecerdasan untuk tugas agentic dan multimodal. |
| Gemini 3.5 Flash-Lite | gemini-3.5-flash-lite |
minimal |
$0,30/1 juta token input dan $2,50/1 juta token output | Model 3.5 tercepat dan berbiaya terendah untuk eksekusi throughput tinggi. |
Kedua model mendukung jendela konteks 1 juta token, 64 ribu token output maksimum, kemampuan berpikir, dan rangkaian lengkap alat bawaan termasuk Penggunaan Komputer.
Untuk melihat spesifikasi lengkap, lihat halaman model:
Untuk mengetahui harga mendetail, lihat halaman harga.
Panduan memulai
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.6-flash",
input="Write a three.js script that renders an interactive 3D robot."
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
async function main() {
const interaction = await ai.interactions.create({
model: "gemini-3.6-flash",
input: "Write a three.js script that renders an interactive 3D robot.",
});
console.log(interaction.outputText);
}
main();
REST
curl "https://generativelanguage.googleapis.com/v1beta/interactions" -H "x-goog-api-key: $GEMINI_API_KEY" -H 'Content-Type: application/json' -X POST -d '{
"model": "gemini-3.6-flash",
"input": "Write a three.js script that renders an interactive 3D robot."
}'
Yang baru di Gemini 3.6 Flash
- Pengurangan token dan giliran: Menyelesaikan alur kerja multi-langkah dengan lebih sedikit langkah penalaran, giliran percakapan, dan panggilan alat dibandingkan Gemini 3.5. Hal ini juga mengurangi perulangan eksekusi yang tidak terkendali.
- Pembuatan kode yang lebih baik: Menghasilkan kode siap produksi berkualitas lebih tinggi dengan lebih sedikit pengeditan yang tidak diinginkan dan lebih sedikit loop proses debug.
- Kualitas mengikuti petunjuk yang lebih baik: Mengurangi perubahan file yang tidak diinginkan selama tugas diagnostik.
- Kemampuan penalaran multimodal dan spasial yang kuat: Peningkatan performa dalam interpretasi diagram, konversi cetak biru visual, dan pembuatan tata letak web multi-elemen.
- Pemeriksaan terprogram di awal: Lebih memilih menjalankan skrip kode diagnostik sebelum melakukan perubahan lebih sering daripada Gemini 3.5 Flash. Hal ini meningkatkan akurasi pada tugas yang kompleks, tetapi dapat menambahkan langkah-langkah eksplorasi ekstra pada pekerjaan frontend rutin.
- Dukungan Penggunaan Komputer: Didukung sebagai alat bawaan untuk otomatisasi UI berbasis agen.
- Preferensi gaya UI: Lebih baik dalam membuat kode fungsional, meskipun evaluator manusia lebih menyukai model sebelumnya untuk tata letak visual dan gaya. Anda dapat mengurangi risiko ini dengan memberikan pedoman desain yang jelas.
- Upaya penalaran default (sedang): Menggunakan tingkat penalaran default
mediumyang sama dengan Gemini 3.5 Flash. - Harga yang lebih rendah: Biaya token output yang lebih rendah ($7,50/1 juta token versus $9,00/1 juta token untuk 3.5 Flash). Token input tetap $1,50/1M.
Yang baru di Gemini 3.5 Flash-Lite
- Latensi eksekusi tugas yang lebih rendah: Throughput tertinggi dalam keluarga 3.5 untuk penguraian data dan ekstraksi dokumen dalam volume tinggi.
- Peningkatan performa multimodal dan penalaran: Jalur migrasi yang kuat dari Gemini 2.5 Flash, dengan skor yang lebih tinggi pada tugas penalaran seperti HLE (18,0% vs. 11,0%) dan tolok ukur multimodal seperti CharXIV (74,5% vs. 63,7%).
- Orkestrasi sub-agen dan keandalan alat: Meningkatkan keandalan eksekusi alat untuk eksekusi kode, penelusuran, dan alur kerja MCP. Meningkatkan tingkat pemikiran untuk perencanaan mandiri dan tugas sub-agen yang kompleks.
- Peningkatan pemahaman dokumen: Meningkatkan akurasi penguraian dokumen dan ekstraksi data terstruktur. Bereksperimenlah dengan tingkat penalaran minimal dan tinggi, bergantung pada kompleksitas dokumen.
- Coding web interaktif dan pemrosesan data tabular: Berperforma baik dalam pemrosesan data tabular dan JavaScript frontend dengan perencanaan menggunakan eksekusi kode ringan.
- Persistensi chatbot dan persona: Kemampuan mengikuti petunjuk multi-turn dan konsistensi persona yang lebih baik dibandingkan Gemini 3.1 Flash-Lite.
- Dukungan Penggunaan Komputer: Didukung sebagai alat bawaan untuk otomatisasi UI berbasis agen.
Memilih model Flash atau Flash-Lite yang tepat
Gunakan tabel ini untuk memilih model dan jalur migrasi yang tepat untuk workload Anda.
Kedua model memerlukan penghapusan parameter pengambilan sampel yang tidak digunakan lagi (temperature,
top_p, top_k) dan giliran model yang telah diisi otomatis. Lihat
Perubahan API untuk mengetahui detailnya.
| Model | Kasus penggunaan utama | Target migrasi yang direkomendasikan |
|---|---|---|
Gemini 3.6 Flashgemini-3.6-flash |
Pembuatan kode, penalaran spasial/multimodal, alur kerja agentic multi-langkah | Gemini 3.5 Flash, Gemini 3 Flash (Pratinjau), atau Gemini 3.1 Pro |
Gemini 3.5 Flash-Litegemini-3.5-flash-lite |
Eksekusi sub-agen otonom, analisis data dan ekstraksi dokumen dalam volume tinggi, penguraian JSON terstruktur | Gemini 3.1 Flash-Lite atau Gemini 2.5 Flash |
Dukungan agen antigravitasi
Gemini 3.6 Flash memperkenalkan dukungan untuk agen Antigravity di Agen Terkelola Gemini.
Untuk contoh kode saat ini dan konfigurasi agen default terbaru, lihat panduan agen Antigravity dan panduan Gemini 3.8 Flash.
Perubahan API dan pembaruan parameter
Mulai dari Gemini 3.6 Flash dan Gemini 3.5 Flash-Lite, perubahan API berikut berlaku untuk model ini dan semua rilis model Gemini mendatang.
- Penghentian parameter pengambilan sampel:
temperature,top_p, dantop_ktidak digunakan lagi. API akan mengabaikan parameter ini dan menampilkan error dalam pembuatan model mendatang. - Validasi respons model yang telah disiapkan: Pengisian otomatis respons model tidak lagi didukung. Jika giliran non-kosong terakhir dalam permintaan adalah giliran
model, API akan menampilkan error400.
Bagian berikut memberikan penjelasan mendetail dan contoh kode untuk setiap perubahan API.
1. Penghentian penggunaan parameter pengambilan sampel (temperature, top_p, top_k)
temperature, top_p, dan top_k tidak digunakan lagi dan diabaikan. Pada generasi model mendatang, memberikan parameter ini akan menampilkan error HTTP 400. Hapus
parameter ini dari semua permintaan.
# ⚠️ Remove these parameters (deprecated)
generation_config = {
"temperature": 0.7,
"top_p": 0.9,
"top_k": 40,
}
Untuk meningkatkan determinisme, tentukan petunjuk sistem dengan aturan eksplisit untuk kasus penggunaan spesifik Anda.
2. Validasi respons model yang telah diisi sebelumnya
Permintaan API yang diakhiri dengan giliran peran model yang tidak kosong tidak diizinkan dan akan menampilkan Error HTTP 400.
⚠️ Hindari
Dalam payload REST mentah atau generateContent lama, mengakhiri dengan pergantian peran model
kini tidak diizinkan:
/* ❌ DO NOT: End payload contents with a 'model' role turn */
{
"contents": [
{"role": "user", "parts": [{"text": "Translate 'Hello world' to Spanish."}]},
{"role": "model", "parts": [{"text": "Translation:"}]} /* ❌ Returns error */
]
}
✅ Migrasi yang Direkomendasikan (Interactions API)
Di Interactions API, giliran model tidak diisi otomatis secara manual. Jika aplikasi Anda sebelumnya mengisi otomatis belokan model untuk menekan kata pengantar atau memaksakan pemformatan JSON, gunakan system_instruction atau Output terstruktur.
# ✅ RECOMMENDED: Use system_instruction in the Interactions API to specify output format
interaction = client.interactions.create(
model="gemini-3.6-flash",
input="Translate 'Hello world' to Spanish.",
system_instruction="Output only the translation without introductory text.",
)
Checklist migrasi
Gemini 3.6 Flash
Instal keahlian:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalTerapkan keahlian:
/gemini-interactions-api migrate my app to Gemini 3.6 Flash
Gemini 3.5 Flash-Lite
Instal keahlian:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalTerapkan keahlian:
/gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite
Bermigrasi ke gemini-3.6-flash
- Perbarui ID Model: Ubah string model target Anda menjadi
gemini-3.6-flash. - Terapkan pembaruan parameter: Hapus parameter pengambilan sampel yang tidak digunakan lagi (
temperature,top_p,top_k),candidate_count(tidak didukung di Gemini 3 dan yang lebih baru), serta giliran model yang telah diisi sebelumnya seperti yang dijelaskan dalam Perubahan API dan pembaruan parameter. - Mengonfigurasi tingkat pemikiran: Ganti
thinking_budgetdenganthinking_level("medium"atau"high"). - Panggilan fungsi audit:
- Tempatkan aset multimodal di dalam payload respons.
- Format petunjuk inline menggunakan
\n\n. - Jika Anda melihat error
Malformed_Function_Callyang terkait dengan teks sebelum alat, lihat Solusi untuk persyaratan teks sebelum alat.
- Persyaratan dasar Gemini 3.x: Untuk update SDK dan pelestarian tanda tangan pemikiran, lihat Daftar Periksa Migrasi Gemini 3.5.
Bermigrasi ke gemini-3.5-flash-lite
- Perbarui ID Model: Ubah string model target Anda menjadi
gemini-3.5-flash-lite. - Mengonfigurasi tingkat upaya penalaran:
- Untuk ekstraksi, perutean, atau klasifikasi volume tinggi: biarkan
thinking_leveldi"minimal"(default) untuk throughput maksimum. - Untuk subagen otonom dengan panggilan alat, eksekusi kode, atau penalaran multi-langkah: tetapkan
thinking_levelke"medium"atau"high"untuk mencegah penghentian alat sebelum waktunya.
- Untuk ekstraksi, perutean, atau klasifikasi volume tinggi: biarkan
- Menghapus parameter yang tidak digunakan lagi dan memvalidasi panggilan fungsi: Menerapkan aturan yang sama seperti 3.6 Flash.
- Persyaratan dasar Gemini 3.x: Lihat Daftar Periksa Migrasi Gemini 3.5.
Langkah berikutnya
- Tinjau spesifikasi API di Ringkasan Model.
- Pelajari orkestrasi multi-agen di Panduan Interactions API.
- Uji dan sempurnakan perintah di Google AI Studio.