Menggunakan model Gemini terbaru

Halaman ini membahas Gemini 3.5 Flash

Gemini 3.6 Flash (gemini-3.6-flash) dan Gemini 3.5 Flash-Lite (gemini-3.5-flash-lite) tersedia secara umum (GA) dan siap digunakan dalam produksi.

  • Gemini 3.6 Flash: Performa yang lebih kuat pada tugas agentic dan multimodal yang kompleks sekaligus mengurangi penggunaan token, dengan harga yang lebih rendah daripada 3.5 Flash.
  • Gemini 3.5 Flash-Lite: Model tercepat dan termurah dalam keluarga 3.5. Mengungguli generasi Flash-Lite sebelumnya untuk eksekusi throughput tinggi.

Panduan ini menjelaskan hal baru di setiap model, perubahan API yang memengaruhi kode Anda, dan cara melakukan migrasi.

Gemini 3.6 Flash

  1. Instal keterampilan:

    npx skills add google-gemini/gemini-skills --skill gemini-api-dev --global
  2. Terapkan keterampilan:

    /gemini-interactions-api migrate my app to Gemini 3.6 Flash

Gemini 3.5 Flash-Lite

  1. Instal keterampilan:

    npx skills add google-gemini/gemini-skills --skill gemini-api-dev --global
  2. Terapkan keterampilan:

    /gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite

Model baru

Model ID Model Tingkat penalaran default Harga Deskripsi
Gemini 3.6 Flash gemini-3.6-flash medium $1,50/1 juta token input dan $7,50/1 juta token output Menyeimbangkan kecepatan dengan kecerdasan untuk tugas agentic dan multimodal.
Gemini 3.5 Flash-Lite gemini-3.5-flash-lite minimal $0,30/1 juta token input dan $2,50/1 juta token output Model 3.5 tercepat dan termurah untuk eksekusi throughput tinggi.

Kedua model mendukung jendela konteks 1 juta token, token output maks 64 ribu, penalaran, dan rangkaian lengkap alat bawaan termasuk Penggunaan Komputer.

Untuk mengetahui spesifikasi lengkap, lihat halaman model:

Untuk mengetahui harga mendetail, lihat halaman harga.

Panduan memulai

Python

from google import genai

client = genai.Client()

interaction = client.interactions.create(
    model="gemini-3.6-flash",
    input="Write a three.js script that renders an interactive 3D robot."
)

print(interaction.output_text)

JavaScript

import { GoogleGenAI } from "@google/genai";

const ai = new GoogleGenAI({});

async function main() {
  const interaction = await ai.interactions.create({
    model: "gemini-3.6-flash",
    input: "Write a three.js script that renders an interactive 3D robot.",
  });
  console.log(interaction.outputText);
}

main();

REST

curl "https://generativelanguage.googleapis.com/v1beta/interactions" \
  -H "x-goog-api-key: $GEMINI_API_KEY" \
  -H 'Content-Type: application/json' \
  -X POST \
  -d '{
    "model": "gemini-3.6-flash",
    "input": {
      "parts": [{"text": "Write a three.js script that renders an interactive 3D robot."}]
    }
  }'

Yang baru di Gemini 3.6 Flash

  • Pengurangan token dan giliran percakapan: Menyelesaikan alur kerja multilangkah dengan langkah penalaran, giliran percakapan, dan panggilan alat yang lebih sedikit daripada Gemini 3.5. Fitur ini juga mengurangi spiral loop eksekusi.
  • Peningkatan pembuatan kode: Menghasilkan kode siap produksi berkualitas lebih tinggi dengan lebih sedikit pengeditan yang tidak diinginkan dan lebih sedikit loop proses debug.
  • Peningkatan kepatuhan terhadap petunjuk: Mengurangi perubahan file yang tidak diinginkan selama tugas diagnostik.
  • Penalaran multimodal dan spasial yang kuat: Peningkatan performa pada interpretasi diagram, konversi cetak biru visual, dan pembuatan tata letak web multi-elemen.
  • Pemeriksaan terprogram di awal: Lebih sering menjalankan skrip kode diagnostik sebelum melakukan perubahan daripada Gemini 3.5 Flash. Hal ini meningkatkan akurasi pada tugas yang kompleks, tetapi dapat menambahkan langkah eksplorasi tambahan pada pekerjaan frontend sederhana.
  • Dukungan Penggunaan Komputer: Didukung sebagai alat native untuk otomatisasi UI agentic.
  • Preferensi gaya UI: Lebih baik dalam membuat kode fungsional, meskipun evaluator manusia lebih menyukai model sebelumnya untuk tata letak visual dan gaya. Anda dapat mengurangi hal ini dengan memberikan panduan desain yang eksplisit.
  • Upaya penalaran default (sedang): Menggunakan tingkat penalaran default medium yang sama dengan Gemini 3.5 Flash.
  • Pengurangan harga: Biaya token output yang lebih rendah ($7,50/1 juta vs. $9,00/1 juta untuk 3.5 Flash). Token input tetap $1,50/1 juta.

Yang baru di Gemini 3.5 Flash-Lite

  • Pengurangan latensi eksekusi tugas: Throughput tertinggi dalam keluarga 3.5 untuk penguraian data dan ekstraksi dokumen bervolume tinggi.
  • Peningkatan penalaran dan performa multimodal: Jalur migrasi yang kuat dari Gemini 2.5 Flash, dengan skor yang lebih tinggi pada tugas penalaran seperti HLE (18,0% vs. 11,0%) dan benchmark multimodal seperti CharXIV (74,5% vs. 63,7%).
  • Orkestrasi subagen dan keandalan alat: Meningkatkan keandalan eksekusi alat untuk eksekusi kode, penelusuran, dan alur kerja MCP. Tingkatkan tingkat penalaran untuk perencanaan otonom dan tugas subagen yang kompleks.
  • Peningkatan pemahaman dokumen: Meningkatkan akurasi pada penguraian dokumen dan ekstraksi data terstruktur. Bereksperimenlah dengan tingkat penalaran minimal dan tinggi, bergantung pada kompleksitas dokumen.
  • Coding web interaktif dan pemrosesan data tabel: Performa yang kuat pada JavaScript frontend dan pemrosesan data tabel dengan perencanaan melalui eksekusi kode ringan.
  • Ketahanan chatbot dan persona: Kepatuhan terhadap petunjuk multi-giliran percakapan dan konsistensi persona yang lebih kuat dibandingkan Gemini 3.1 Flash-Lite.
  • Dukungan Penggunaan Komputer: Didukung sebagai alat native untuk otomatisasi UI agentic.

Memilih model Flash atau Flash-Lite yang tepat

Gunakan tabel ini untuk memilih model dan jalur migrasi yang tepat untuk workload Anda.

Kedua model mengharuskan penghapusan parameter pengambilan sampel yang tidak digunakan lagi (temperature, top_p, top_k) dan giliran percakapan model yang telah diisi sebelumnya. Lihat perubahan API untuk mengetahui detailnya.

Model Kasus penggunaan utama Target migrasi yang direkomendasikan
Gemini 3.6 Flash
gemini-3.6-flash
Pembuatan kode, penalaran spasial/multimodal, alur kerja agentic multilangkah Gemini 3.5 Flash, Gemini 3 Flash (Pratinjau), atau Gemini 3.1 Pro
Gemini 3.5 Flash-Lite
gemini-3.5-flash-lite
Eksekusi subagen otonom, analisis data dan ekstraksi dokumen bervolume tinggi, penguraian JSON terstruktur Gemini 3.1 Flash-Lite atau Gemini 2.5 Flash

Agen Antigravity yang diperbarui

Karena performanya yang ditingkatkan, Gemini 3.6 Flash kini menjadi model default baru yang mendukung agen Antigravity di Agen Terkelola Gemini. Hal ini dapat diubah dengan menetapkan kolom baru di API.

Python

from google import genai

client = genai.Client()

interaction = client.interactions.create(
    agent="antigravity-preview-05-2026",
    input="Read Hacker News, summarize the top 10 stories, and save the results as a PDF.",
    environment="remote",
)

print(interaction.output_text)

JavaScript

import { GoogleGenAI } from "@google/genai";

const client = new GoogleGenAI({});

const interaction = await client.interactions.create({
    agent: "antigravity-preview-05-2026",
    input: "Read Hacker News, summarize the top 10 stories, and save the results as a PDF.",
    environment: "remote",
}, { timeout: 300000 });

console.log(interaction.output_text);

REST

curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "Content-Type: application/json" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-d '{
    "agent": "antigravity-preview-05-2026",
    "input": "Read Hacker News, summarize the top 10 stories, and save the results as a PDF.",
    "environment": "remote"
}'

Perubahan API dan update parameter

Mulai dari Gemini 3.6 Flash dan Gemini 3.5 Flash-Lite, perubahan API berikut berlaku untuk model ini dan semua rilis model Gemini mendatang.

  • Penghentian parameter pengambilan sampel: temperature, top_p, dan top_k tidak digunakan lagi. API mengabaikan parameter ini dan menampilkan error pada generasi model mendatang.
  • Validasi giliran percakapan model yang telah diisi sebelumnya: Pengisian giliran percakapan model yang telah diisi sebelumnya tidak lagi didukung. Jika giliran percakapan terakhir yang tidak kosong dalam permintaan adalah giliran percakapan model, API akan menampilkan error 400.

Di bawah ini adalah penjelasan mendetail dan contoh kode untuk setiap perubahan API.

1. Penghentian parameter pengambilan sampel (temperature, top_p, top_k)

temperature, top_p, dan top_k tidak digunakan lagi dan diabaikan. Pada generasi model mendatang, penyediaan parameter ini akan menampilkan error HTTP 400. Hapus parameter ini dari semua permintaan.

# ⚠️ Remove these parameters (deprecated)
generation_config = {
     "temperature": 0.7,
     "top_p": 0.9,
     "top_k": 40,
}

Untuk meningkatkan determinisme, tentukan petunjuk sistem dengan aturan eksplisit untuk kasus penggunaan tertentu.

2. Validasi giliran percakapan model yang telah diisi sebelumnya

Permintaan API yang diakhiri dengan giliran percakapan peran model yang tidak kosong tidak diizinkan dan akan menampilkan Error HTTP 400.

⚠️ Hindari

Di payload REST generateContent atau mentah lama, mengakhiri dengan giliran percakapan peran model kini tidak diizinkan:

/* ❌ DO NOT: End payload contents with a 'model' role turn */
{
  "contents": [
    {"role": "user", "parts": [{"text": "Translate 'Hello world' to Spanish."}]},
    {"role": "model", "parts": [{"text": "Translation:"}]}  /* ❌ Returns error */
  ]
}

Di Interactions API, giliran percakapan model tidak diisi sebelumnya secara manual. Jika aplikasi Anda sebelumnya mengisi giliran percakapan model untuk menekan pembukaan atau memaksa pemformatan JSON, gunakan system_instruction atau Output terstruktur sebagai gantinya.

# ✅ RECOMMENDED: Use system_instruction in the Interactions API to specify output format
interaction = client.interactions.create(
    model="gemini-3.6-flash",
    input="Translate 'Hello world' to Spanish.",
    system_instruction="Output only the translation without introductory text.",
)

Checklist migrasi

Gemini 3.6 Flash

  1. Instal keterampilan:

    npx skills add google-gemini/gemini-skills --skill gemini-api-dev --global
  2. Terapkan keterampilan:

    /gemini-interactions-api migrate my app to Gemini 3.6 Flash

Gemini 3.5 Flash-Lite

  1. Instal keterampilan:

    npx skills add google-gemini/gemini-skills --skill gemini-api-dev --global
  2. Terapkan keterampilan:

    /gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite

Bermigrasi ke gemini-3.6-flash

  • Perbarui ID Model: Ubah string model target Anda menjadi gemini-3.6-flash.
  • Hapus parameter pengambilan sampel yang tidak digunakan lagi:
    • Hapus temperature, top_p, dan top_k dari konfigurasi pembuatan.
    • Ganti thinking_budget dengan enum string thinking_level yang ditetapkan ke "medium" atau "high".
    • Hapus candidate_count (tidak didukung di Gemini 3.x).
  • Terapkan aturan validasi giliran percakapan:
    • Standarkan percakapan multi-giliran percakapan di previous_interaction_id sisi server.
    • Hapus giliran percakapan model yang telah diisi sebelumnya.
  • Audit pemanggilan fungsi:
    • Tempatkan aset multimodal di dalam payload respons.
    • Format petunjuk inline menggunakan \n\n.
    • Jika Anda melihat Malformed_Function_Call error yang terkait dengan teks pra-alat, lihat Solusi untuk persyaratan teks pra-alat.
    • Hanya jika menggunakan generateContent API: Pastikan semua objek FunctionResponse menyertakan call_id dan name.
  • Persyaratan dasar Gemini 3.x: Untuk mengetahui update SDK dan penyimpanan tanda tangan pemikiran, lihat Checklist Migrasi Gemini 3.5.

Bermigrasi ke gemini-3.5-flash-lite

  • Perbarui ID Model: Ubah string model target Anda menjadi gemini-3.5-flash-lite.
  • Konfigurasi tingkat upaya penalaran:
    • Untuk ekstraksi, perutean, atau klasifikasi bervolume tinggi: biarkan thinking_level di "minimal" (default) untuk throughput maksimum.
    • Untuk subagen otonom dengan panggilan alat, eksekusi kode, atau penalaran multi-langkah: tetapkan thinking_level ke "medium" atau "high" untuk mencegah penghentian alat yang terlalu cepat.
  • Hapus parameter yang tidak digunakan lagi dan validasi pemanggilan fungsi: Terapkan aturan yang sama dengan 3.6 Flash.
  • Persyaratan dasar Gemini 3.x: Lihat Checklist Migrasi Gemini 3.5.

Langkah berikutnya