Halaman ini membahas Gemini 3.5 Flash
Gemini 3.6 Flash (gemini-3.6-flash) dan Gemini 3.5 Flash-Lite (gemini-3.5-flash-lite) tersedia secara umum (GA) dan siap digunakan dalam produksi.
- Gemini 3.6 Flash: Performa yang lebih kuat pada tugas agentic dan multimodal yang kompleks sekaligus mengurangi penggunaan token, dengan harga yang lebih rendah daripada 3.5 Flash.
- Gemini 3.5 Flash-Lite: Model tercepat dan termurah dalam keluarga 3.5. Mengungguli generasi Flash-Lite sebelumnya untuk eksekusi throughput tinggi.
Panduan ini menjelaskan hal baru di setiap model, perubahan API yang memengaruhi kode Anda, dan cara melakukan migrasi.
Gemini 3.6 Flash
Instal keterampilan:
npx skills add google-gemini/gemini-skills --skill gemini-api-dev --globalTerapkan keterampilan:
/gemini-interactions-api migrate my app to Gemini 3.6 Flash
Gemini 3.5 Flash-Lite
Instal keterampilan:
npx skills add google-gemini/gemini-skills --skill gemini-api-dev --globalTerapkan keterampilan:
/gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite
Model baru
| Model | ID Model | Tingkat penalaran default | Harga | Deskripsi |
|---|---|---|---|---|
| Gemini 3.6 Flash | gemini-3.6-flash |
medium |
$1,50/1 juta token input dan $7,50/1 juta token output | Menyeimbangkan kecepatan dengan kecerdasan untuk tugas agentic dan multimodal. |
| Gemini 3.5 Flash-Lite | gemini-3.5-flash-lite |
minimal |
$0,30/1 juta token input dan $2,50/1 juta token output | Model 3.5 tercepat dan termurah untuk eksekusi throughput tinggi. |
Kedua model mendukung jendela konteks 1 juta token, token output maks 64 ribu, penalaran, dan rangkaian lengkap alat bawaan termasuk Penggunaan Komputer.
Untuk mengetahui spesifikasi lengkap, lihat halaman model:
Untuk mengetahui harga mendetail, lihat halaman harga.
Panduan memulai
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.6-flash",
input="Write a three.js script that renders an interactive 3D robot."
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
async function main() {
const interaction = await ai.interactions.create({
model: "gemini-3.6-flash",
input: "Write a three.js script that renders an interactive 3D robot.",
});
console.log(interaction.outputText);
}
main();
REST
curl "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-X POST \
-d '{
"model": "gemini-3.6-flash",
"input": {
"parts": [{"text": "Write a three.js script that renders an interactive 3D robot."}]
}
}'
Yang baru di Gemini 3.6 Flash
- Pengurangan token dan giliran percakapan: Menyelesaikan alur kerja multilangkah dengan langkah penalaran, giliran percakapan, dan panggilan alat yang lebih sedikit daripada Gemini 3.5. Fitur ini juga mengurangi spiral loop eksekusi.
- Peningkatan pembuatan kode: Menghasilkan kode siap produksi berkualitas lebih tinggi dengan lebih sedikit pengeditan yang tidak diinginkan dan lebih sedikit loop proses debug.
- Peningkatan kepatuhan terhadap petunjuk: Mengurangi perubahan file yang tidak diinginkan selama tugas diagnostik.
- Penalaran multimodal dan spasial yang kuat: Peningkatan performa pada interpretasi diagram, konversi cetak biru visual, dan pembuatan tata letak web multi-elemen.
- Pemeriksaan terprogram di awal: Lebih sering menjalankan skrip kode diagnostik sebelum melakukan perubahan daripada Gemini 3.5 Flash. Hal ini meningkatkan akurasi pada tugas yang kompleks, tetapi dapat menambahkan langkah eksplorasi tambahan pada pekerjaan frontend sederhana.
- Dukungan Penggunaan Komputer: Didukung sebagai alat native untuk otomatisasi UI agentic.
- Preferensi gaya UI: Lebih baik dalam membuat kode fungsional, meskipun evaluator manusia lebih menyukai model sebelumnya untuk tata letak visual dan gaya. Anda dapat mengurangi hal ini dengan memberikan panduan desain yang eksplisit.
- Upaya penalaran default (sedang): Menggunakan tingkat penalaran default
mediumyang sama dengan Gemini 3.5 Flash. - Pengurangan harga: Biaya token output yang lebih rendah ($7,50/1 juta vs. $9,00/1 juta untuk 3.5 Flash). Token input tetap $1,50/1 juta.
Yang baru di Gemini 3.5 Flash-Lite
- Pengurangan latensi eksekusi tugas: Throughput tertinggi dalam keluarga 3.5 untuk penguraian data dan ekstraksi dokumen bervolume tinggi.
- Peningkatan penalaran dan performa multimodal: Jalur migrasi yang kuat dari Gemini 2.5 Flash, dengan skor yang lebih tinggi pada tugas penalaran seperti HLE (18,0% vs. 11,0%) dan benchmark multimodal seperti CharXIV (74,5% vs. 63,7%).
- Orkestrasi subagen dan keandalan alat: Meningkatkan keandalan eksekusi alat untuk eksekusi kode, penelusuran, dan alur kerja MCP. Tingkatkan tingkat penalaran untuk perencanaan otonom dan tugas subagen yang kompleks.
- Peningkatan pemahaman dokumen: Meningkatkan akurasi pada penguraian dokumen dan ekstraksi data terstruktur. Bereksperimenlah dengan tingkat penalaran minimal dan tinggi, bergantung pada kompleksitas dokumen.
- Coding web interaktif dan pemrosesan data tabel: Performa yang kuat pada JavaScript frontend dan pemrosesan data tabel dengan perencanaan melalui eksekusi kode ringan.
- Ketahanan chatbot dan persona: Kepatuhan terhadap petunjuk multi-giliran percakapan dan konsistensi persona yang lebih kuat dibandingkan Gemini 3.1 Flash-Lite.
- Dukungan Penggunaan Komputer: Didukung sebagai alat native untuk otomatisasi UI agentic.
Memilih model Flash atau Flash-Lite yang tepat
Gunakan tabel ini untuk memilih model dan jalur migrasi yang tepat untuk workload Anda.
Kedua model mengharuskan penghapusan parameter pengambilan sampel yang tidak digunakan lagi (temperature, top_p, top_k) dan giliran percakapan model yang telah diisi sebelumnya. Lihat perubahan API untuk mengetahui detailnya.
| Model | Kasus penggunaan utama | Target migrasi yang direkomendasikan |
|---|---|---|
Gemini 3.6 Flashgemini-3.6-flash |
Pembuatan kode, penalaran spasial/multimodal, alur kerja agentic multilangkah | Gemini 3.5 Flash, Gemini 3 Flash (Pratinjau), atau Gemini 3.1 Pro |
Gemini 3.5 Flash-Litegemini-3.5-flash-lite |
Eksekusi subagen otonom, analisis data dan ekstraksi dokumen bervolume tinggi, penguraian JSON terstruktur | Gemini 3.1 Flash-Lite atau Gemini 2.5 Flash |
Agen Antigravity yang diperbarui
Karena performanya yang ditingkatkan, Gemini 3.6 Flash kini menjadi model default baru yang mendukung agen Antigravity di Agen Terkelola Gemini. Hal ini dapat diubah dengan menetapkan kolom baru di API.
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
agent="antigravity-preview-05-2026",
input="Read Hacker News, summarize the top 10 stories, and save the results as a PDF.",
environment="remote",
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const client = new GoogleGenAI({});
const interaction = await client.interactions.create({
agent: "antigravity-preview-05-2026",
input: "Read Hacker News, summarize the top 10 stories, and save the results as a PDF.",
environment: "remote",
}, { timeout: 300000 });
console.log(interaction.output_text);
REST
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "Content-Type: application/json" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-d '{
"agent": "antigravity-preview-05-2026",
"input": "Read Hacker News, summarize the top 10 stories, and save the results as a PDF.",
"environment": "remote"
}'
Perubahan API dan update parameter
Mulai dari Gemini 3.6 Flash dan Gemini 3.5 Flash-Lite, perubahan API berikut berlaku untuk model ini dan semua rilis model Gemini mendatang.
- Penghentian parameter pengambilan sampel:
temperature,top_p, dantop_ktidak digunakan lagi. API mengabaikan parameter ini dan menampilkan error pada generasi model mendatang. - Validasi giliran percakapan model yang telah diisi sebelumnya: Pengisian giliran percakapan model yang telah diisi sebelumnya tidak lagi didukung. Jika giliran percakapan terakhir yang tidak kosong dalam permintaan adalah giliran percakapan
model, API akan menampilkan error400.
Di bawah ini adalah penjelasan mendetail dan contoh kode untuk setiap perubahan API.
1. Penghentian parameter pengambilan sampel (temperature, top_p, top_k)
temperature, top_p, dan top_k tidak digunakan lagi dan diabaikan. Pada generasi model mendatang, penyediaan parameter ini akan menampilkan error HTTP 400. Hapus parameter ini dari semua permintaan.
# ⚠️ Remove these parameters (deprecated)
generation_config = {
"temperature": 0.7,
"top_p": 0.9,
"top_k": 40,
}
Untuk meningkatkan determinisme, tentukan petunjuk sistem dengan aturan eksplisit untuk kasus penggunaan tertentu.
2. Validasi giliran percakapan model yang telah diisi sebelumnya
Permintaan API yang diakhiri dengan giliran percakapan peran model yang tidak kosong tidak diizinkan dan akan menampilkan Error HTTP 400.
⚠️ Hindari
Di payload REST generateContent atau mentah lama, mengakhiri dengan giliran percakapan peran model kini tidak diizinkan:
/* ❌ DO NOT: End payload contents with a 'model' role turn */
{
"contents": [
{"role": "user", "parts": [{"text": "Translate 'Hello world' to Spanish."}]},
{"role": "model", "parts": [{"text": "Translation:"}]} /* ❌ Returns error */
]
}
✅ Migrasi yang Direkomendasikan (Interactions API)
Di Interactions API, giliran percakapan model tidak diisi sebelumnya secara manual. Jika aplikasi Anda sebelumnya mengisi giliran percakapan model untuk menekan pembukaan atau memaksa pemformatan JSON, gunakan system_instruction atau Output terstruktur sebagai gantinya.
# ✅ RECOMMENDED: Use system_instruction in the Interactions API to specify output format
interaction = client.interactions.create(
model="gemini-3.6-flash",
input="Translate 'Hello world' to Spanish.",
system_instruction="Output only the translation without introductory text.",
)
Checklist migrasi
Gemini 3.6 Flash
Instal keterampilan:
npx skills add google-gemini/gemini-skills --skill gemini-api-dev --globalTerapkan keterampilan:
/gemini-interactions-api migrate my app to Gemini 3.6 Flash
Gemini 3.5 Flash-Lite
Instal keterampilan:
npx skills add google-gemini/gemini-skills --skill gemini-api-dev --globalTerapkan keterampilan:
/gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite
Bermigrasi ke gemini-3.6-flash
- Perbarui ID Model: Ubah string model target Anda menjadi
gemini-3.6-flash. - Hapus parameter pengambilan sampel yang tidak digunakan lagi:
- Hapus
temperature,top_p, dantop_kdari konfigurasi pembuatan. - Ganti
thinking_budgetdengan enum stringthinking_levelyang ditetapkan ke"medium"atau"high". - Hapus
candidate_count(tidak didukung di Gemini 3.x).
- Hapus
- Terapkan aturan validasi giliran percakapan:
- Standarkan percakapan multi-giliran percakapan di
previous_interaction_idsisi server. - Hapus giliran percakapan model yang telah diisi sebelumnya.
- Standarkan percakapan multi-giliran percakapan di
- Audit pemanggilan fungsi:
- Tempatkan aset multimodal di dalam payload respons.
- Format petunjuk inline menggunakan
\n\n. - Jika Anda melihat
Malformed_Function_Callerror yang terkait dengan teks pra-alat, lihat Solusi untuk persyaratan teks pra-alat. - Hanya jika menggunakan generateContent API: Pastikan semua objek
FunctionResponsemenyertakancall_iddanname.
- Persyaratan dasar Gemini 3.x: Untuk mengetahui update SDK dan penyimpanan tanda tangan pemikiran, lihat Checklist Migrasi Gemini 3.5.
Bermigrasi ke gemini-3.5-flash-lite
- Perbarui ID Model: Ubah string model target Anda menjadi
gemini-3.5-flash-lite. - Konfigurasi tingkat upaya penalaran:
- Untuk ekstraksi, perutean, atau klasifikasi bervolume tinggi: biarkan
thinking_leveldi"minimal"(default) untuk throughput maksimum. - Untuk subagen otonom dengan panggilan alat, eksekusi kode, atau penalaran multi-langkah: tetapkan
thinking_levelke"medium"atau"high"untuk mencegah penghentian alat yang terlalu cepat.
- Untuk ekstraksi, perutean, atau klasifikasi bervolume tinggi: biarkan
- Hapus parameter yang tidak digunakan lagi dan validasi pemanggilan fungsi: Terapkan aturan yang sama dengan 3.6 Flash.
- Persyaratan dasar Gemini 3.x: Lihat Checklist Migrasi Gemini 3.5.
Langkah berikutnya
- Tinjau spesifikasi API di Ringkasan Model.
- Pelajari orkestrasi multi-agen di Panduan Interactions API.
- Uji dan sempurnakan perintah di Google AI Studio.