Yang baru di Gemini 3.8 Flash

Lihat semua model

Gemini 3.8 Flash (gemini-3.8-flash) tersedia secara umum (GA) dan siap digunakan dalam produksi. Model ini adalah model Flash kami yang paling cerdas, yang dirancang untuk rekayasa software jangka panjang, agen otonom, dan alur kerja perusahaan yang kompleks.

Panduan ini menjelaskan fitur baru di Gemini 3.8 Flash, perubahan API, contoh kode, dan panduan migrasi.

Model baru

Model ID Model Tingkat penalaran default Harga Deskripsi
Gemini 3.8 Flash gemini-3.8-flash medium 3.8 Flash tersedia hingga akhir tahun dengan harga perkenalan $0,75/1 juta token input dan $3,75/1 juta token output; lihat harga untuk mengetahui detail selengkapnya. Model Flash kami yang paling cerdas, yang dirancang untuk rekayasa software jangka panjang, agen otonom, dan alur kerja perusahaan yang kompleks.

Gemini 3.8 Flash mendukung jendela konteks 1 juta token, 64 ribu token output maksimum, tingkat penalaran yang dapat disesuaikan (low, medium, high), dan rangkaian lengkap alat bawaan yang sama.

Untuk mengetahui spesifikasi lengkapnya, lihat halaman model Gemini 3.8 Flash. Untuk mengetahui detail harga perkenalan, lihat bagian harga di bawah atau halaman harga.

Panduan memulai

Python

from google import genai

client = genai.Client()

interaction = client.interactions.create(
    model="gemini-3.8-flash",
    input="Write a three.js script that renders a realistic 3D black hole."
)

print(interaction.output_text)

JavaScript

import { GoogleGenAI } from "@google/genai";

const client = new GoogleGenAI({});

const interaction = await client.interactions.create({
  model: "gemini-3.8-flash",
  input: "Write a three.js script that renders a realistic 3D black hole.",
});

console.log(interaction.output_text);

Java

import com.google.genai.Client;
import com.google.genai.gaos.models.interactions.CreateModelInteraction;
import com.google.genai.gaos.models.interactions.Interaction;
import com.google.genai.gaos.models.interactions.InteractionsInput;
import com.google.genai.gaos.models.interactions.Model;
import com.google.genai.gaos.models.operations.CreateInteractionRequestBody;

Client client = new Client();
CreateModelInteraction req = CreateModelInteraction.builder()
    .model(Model.of("gemini-3.8-flash"))
    .input(InteractionsInput.of("Hello world"))
    .build();
Interaction interaction =
    client.interactions.create(CreateInteractionRequestBody.of(req)).interaction().get();
System.out.println(interaction.outputText().orElse(""));

REST

curl "https://generativelanguage.googleapis.com/v1beta/interactions" \
  -H "x-goog-api-key: $GEMINI_API_KEY" \
  -H 'Content-Type: application/json' \
  -X POST \
  -d '{
    "model": "gemini-3.8-flash",
    "input": "Write a three.js script that renders a realistic 3D black hole."
  }'

Fitur baru di Gemini 3.8 Flash

  • Rekayasa software jangka panjang: Memberikan hasil yang kuat pada benchmark coding dunia nyata, refactoring multi-file yang kompleks, dan eksekusi alat yang deterministik. Lihat metodologi evaluasi untuk mengetahui detailnya.
  • Agen otonom: Memungkinkan Anda membuat alur kerja perencanaan multi-langkah dan orkestrasi alat yang tangguh, sehingga mengurangi loop dan error yang gagal secara signifikan.
  • Alur kerja perusahaan yang kompleks: Memberikan akurasi yang unggul, penalaran yang mendalam, dan ketelitian faktual yang tinggi di seluruh tugas domain yang menantang dan pipeline data skala besar.
  • Model default untuk Agen Terkelola: Agen default untuk agen terkelola: agen Antigravity, kini menggunakan Gemini 3.8 Flash. Antigravity SDK juga menggunakan Gemini 3.8 Flash secara default.
  • Harga perkenalan: Gemini 3.8 Flash tersedia dengan harga perkenalan $0,75/1 juta token input dan $3,75/1 juta token output hingga 31 Desember 2026. Harga standar $1,50/1 juta token input dan $7,50/1 juta token output berlaku mulai 1 Januari 2027.

Gemini 3.8 Flash dapat menggunakan lebih banyak token pada tugas yang berjalan lebih lama dan kompleks, berdasarkan desain. Untuk memberikan hasil berkualitas lebih tinggi pada tujuan multi-langkah yang sulit, model ini mengambil langkah penalaran yang lebih kecil, memanggil alat secara berulang, dan memverifikasi pekerjaannya sepanjang proses. Tidak semua alur kerja memerlukan tingkat verifikasi ini. Untuk tugas sehari-hari, Anda dapat menurunkan upaya penalaran untuk mengurangi konsumsi token. Atau, Gemini 3.7 Flash tetap didukung sepenuhnya.

Memahami tingkat penalaran

Gemini 3.8 Flash memberi Anda kontrol yang fleksibel atas latensi dan kecerdasan dengan menyesuaikan tingkat penalaran model:

  • Upaya penalaran rendah: Mengurangi waktu untuk menjawab tugas yang penting latensinya seperti pipeline respons insiden, chat real-time, draf penulisan, dan analisis data cepat.
  • Sedang (default): Kualitas terbaik untuk sebagian besar tugas. Direkomendasikan untuk kode kompleks dan kasus penggunaan agentik, yang memberikan akurasi lulus pertama yang lebih tinggi.
  • Upaya penalaran tinggi: Memaksimalkan kemampuan penalaran dan orkestrasi alat model. Terbaik untuk penalaran mendalam, matematika, dan tugas multi-langkah yang sulit.

Contoh berikut menetapkan thinking_level ke medium untuk permintaan analisis kode yang kompleks:

Python

from google import genai

client = genai.Client()

interaction = client.interactions.create(
    model="gemini-3.8-flash",
    input="Analyze this payment processing pipeline for race conditions during retry attempts and rewrite the transaction locks safely.",
    generation_config={
        "thinking_level": "medium"  # Balanced reasoning effort for complex tasks
    }
)

print(interaction.output_text)

JavaScript

import { GoogleGenAI } from "@google/genai";

const client = new GoogleGenAI({});

const interaction = await client.interactions.create({
  model: "gemini-3.8-flash",
  input: "Analyze this payment processing pipeline for race conditions during retry attempts and rewrite the transaction locks safely.",
  generation_config: {
    thinking_level: "medium"
  }
});

console.log(interaction.output_text);

Java

import com.google.genai.Client;
import com.google.genai.gaos.models.interactions.CreateModelInteraction;
import com.google.genai.gaos.models.interactions.Interaction;
import com.google.genai.gaos.models.interactions.InteractionsInput;
import com.google.genai.gaos.models.interactions.Model;
import com.google.genai.gaos.models.operations.CreateInteractionRequestBody;

Client client = new Client();
CreateModelInteraction req = CreateModelInteraction.builder()
    .model(Model.of("gemini-3.8-flash"))
    .input(InteractionsInput.of("Hello world"))
    .build();
Interaction interaction =
    client.interactions.create(CreateInteractionRequestBody.of(req)).interaction().get();
System.out.println(interaction.outputText().orElse(""));

REST

curl "https://generativelanguage.googleapis.com/v1beta/interactions" \
  -H "x-goog-api-key: $GEMINI_API_KEY" \
  -H 'Content-Type: application/json' \
  -X POST \
  -d '{
    "model": "gemini-3.8-flash",
    "input": "Analyze this payment processing pipeline for race conditions during retry attempts and rewrite the transaction locks safely.",
    "generation_config": {
      "thinking_level": "medium"
    }
  }'

Agen Antigravity yang diperbarui

Karena performa dan penalaran yang ditingkatkan, agen Antigravity di Agen Terkelola Gemini kini dibuat dengan Gemini 3.8 Flash secara default.

Python

from google import genai

client = genai.Client()

interaction = client.interactions.create(
    agent="antigravity-preview-05-2026",
    input=(
        "Audit https://web.dev for performance, Core Web Vitals, and SEO. "
        "Query Google's PageSpeed Insights API for both Mobile and Desktop strategies. "
        "Check search indexing with Google Search for site:web.dev. "
        "Format the output as a side-by-side scorecard table with prioritized fixes."
    ),
    environment="remote",
)

print(interaction.output_text)

JavaScript

import { GoogleGenAI } from "@google/genai";

const client = new GoogleGenAI({});

const interaction = await client.interactions.create({
  agent: "antigravity-preview-05-2026",
  input: "Audit https://web.dev for performance, Core Web Vitals, and SEO. Query Google's PageSpeed Insights API for both Mobile and Desktop strategies. Check search indexing with Google Search for site:web.dev. Format the output as a side-by-side scorecard table with prioritized fixes.",
  environment: "remote",
}, { timeout: 300000 });

console.log(interaction.output_text);

Java

import com.google.genai.Client;
import com.google.genai.gaos.models.interactions.CreateModelInteraction;
import com.google.genai.gaos.models.interactions.Interaction;
import com.google.genai.gaos.models.interactions.InteractionsInput;
import com.google.genai.gaos.models.interactions.Model;
import com.google.genai.gaos.models.operations.CreateInteractionRequestBody;

Client client = new Client();
CreateModelInteraction req = CreateModelInteraction.builder()
    .model(Model.of("gemini-3.8-flash"))
    .input(InteractionsInput.of("Hello world"))
    .build();
Interaction interaction =
    client.interactions.create(CreateInteractionRequestBody.of(req)).interaction().get();
System.out.println(interaction.outputText().orElse(""));

REST

curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "Content-Type: application/json" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-d '{
    "agent": "antigravity-preview-05-2026",
    "input": "Audit https://web.dev for performance, Core Web Vitals, and SEO. Query Google'\''s PageSpeed Insights API for both Mobile and Desktop strategies. Check search indexing with Google Search for site:web.dev. Format the output as a side-by-side scorecard table with prioritized fixes.",
    "environment": "remote"
}'

Model Gemini yang mendasarinya dapat dikonfigurasi menggunakan agent_config.

Checklist migrasi

  `/gemini-api-dev migrate my app to Gemini 3.8 Flash`

Bermigrasi ke gemini-3.8-flash

  • Perbarui ID Model: Ubah string model target Anda menjadi gemini-3.8-flash.
  • Hapus parameter sampling yang tidak digunakan lagi:
    • Hapus temperature, top_p, dan top_k dari konfigurasi pembuatan.
    • Ganti thinking_budget dengan enum string thinking_level. Perhatikan bahwa minimal tidak didukung di 3.8 Flash.
    • Hapus candidate_count (tidak didukung di Gemini 3 dan yang lebih baru).
  • Terapkan aturan validasi giliran:
    • Standarkan percakapan multi-giliran di previous_interaction_id sisi server.
    • Hapus giliran model yang telah diisi sebelumnya.
  • Audit pemanggilan fungsi:
    • Tempatkan aset multimodal di dalam payload respons.
    • Format petunjuk inline menggunakan \n\n.
    • Jika Anda melihat Malformed_Function_Call error yang terkait dengan teks pra-alat, lihat Solusi untuk persyaratan teks pra-alat.
    • Hanya jika menggunakan generateContent API: Pastikan semua objek FunctionResponse menyertakan call_id dan name.
  • Persyaratan dasar Gemini 3: Untuk mengetahui update SDK dan penyimpanan tanda tangan pemikiran, lihat Checklist Migrasi Gemini 3.5.

Harga

Manfaatkan harga perkenalan di Google AI Studio dan Gemini Enterprise Agent Platform hingga 31 Desember 2026 untuk Gemini 3.8 Flash, Gemini 3.7 Flash, dan Gemini 3.6 Flash. Harga standar berlaku mulai 1 Januari 2027. Untuk mengetahui tingkat harga lengkap, lihat halaman harga.

Langkah berikutnya