Batas kapasitas

Batas laju mengatur jumlah permintaan yang dapat Anda ajukan ke Gemini API dalam jangka waktu tertentu. Batasan ini membantu mempertahankan penggunaan yang adil, melindungi dari penyalahgunaan, dan membantu mempertahankan performa sistem untuk semua pengguna.

Melihat batas frekuensi aktif di AI Studio

Cara kerja batas laju

Batas laju biasanya diukur di tiga dimensi:

  • Permintaan per menit (RPM)
  • Token per menit (input) (TPM)
  • Permintaan per hari (RPD)

Penggunaan Anda dievaluasi terhadap setiap batas, dan jika salah satu batas terlampaui, error batas laju akan dipicu. Misalnya, jika batas RPM Anda adalah 20, membuat 21 permintaan dalam satu menit akan menghasilkan error, meskipun Anda belum melampaui batas TPM atau batas lainnya.

Batas kecepatan diterapkan per project, bukan per kunci API. Kuota permintaan per hari (RPD) direset pada tengah malam waktu Pasifik.

Batas bervariasi bergantung pada model spesifik yang digunakan, dan beberapa batas hanya berlaku untuk model tertentu. Misalnya, Gambar per menit (IPM) hanya dihitung untuk model yang mampu menghasilkan gambar (Imagen 3), tetapi secara konseptual mirip dengan TPM. Model lainnya mungkin memiliki batas token per hari (TPD).

Batas penggunaan lebih ketat untuk model eksperimental dan pratinjau.

Tingkat penggunaan

Pembatasan kapasitas terkait dengan tingkat penggunaan project. Seiring peningkatan penggunaan dan pembelanjaan API, Anda akan memiliki opsi untuk mengupgrade ke tingkat yang lebih tinggi dengan batas kapasitas yang lebih tinggi.

Kualifikasi untuk Tingkat 2 dan 3 didasarkan pada total pembelanjaan kumulatif untuk layanan Google Cloud (termasuk, tetapi tidak terbatas pada, Gemini API) untuk akun penagihan yang ditautkan ke project Anda.

Tingkat Kualifikasi
Gratis Pengguna di negara yang memenuhi syarat
Tingkat 1 Akun Penagihan berbayar penuh yang ditautkan ke project
Tingkat 2 Total pembelanjaan: > $250 dan setidaknya 30 hari sejak pembayaran berhasil
Tingkat 3 Total pembelanjaan: > $1.000 dan setidaknya 30 hari sejak pembayaran berhasil

Saat Anda meminta upgrade, sistem perlindungan dari penyalahgunaan otomatis kami akan melakukan pemeriksaan tambahan. Meskipun memenuhi kriteria kelayakan yang dinyatakan umumnya sudah cukup untuk mendapatkan persetujuan, dalam kasus yang jarang terjadi, permintaan upgrade dapat ditolak berdasarkan faktor lain yang diidentifikasi selama proses peninjauan.

Sistem ini membantu menjaga keamanan dan integritas platform Gemini API bagi semua pengguna.

Batas kapasitas Gemini API

Batas frekuensi bergantung pada berbagai faktor (seperti tingkat kuota Anda) dan dapat dilihat di Google AI Studio. Seiring perubahan tingkat dan status akun Anda dari waktu ke waktu, batas frekuensi Anda akan otomatis diperbarui.

Melihat batas frekuensi aktif di AI Studio

Batas frekuensi yang ditentukan tidak dijamin dan kapasitas sebenarnya dapat bervariasi.

Batas kapasitas API batch

Permintaan Batch API tunduk pada batas kapasitasnya sendiri, terpisah dari panggilan API non-batch.

  • Permintaan batch serentak: 100
  • Batas ukuran file input: 2 GB
  • Batas penyimpanan file: 20 GB
  • Token dalam antrean per model: Tabel Token dalam antrean batch mencantumkan jumlah maksimum token yang dapat dimasukkan dalam antrean untuk pemrosesan batch di semua tugas batch aktif Anda untuk model tertentu.

Tingkat 1

Model Token yang dimasukkan dalam antrean batch
Model teks keluar
Pratinjau Gemini 3 Pro 50.000.000
Gemini 2.5 Pro 5.000.000
Gemini 2.5 Flash 3.000.000
Pratinjau Gemini 2.5 Flash 3.000.000
Gemini 2.5 Flash-Lite 10.000.000
Pratinjau Gemini 2.5 Flash-Lite 10.000.000
Gemini 2.0 Flash 10.000.000
Gemini 2.0 Flash-Lite 10.000.000
Model pembuatan multi-modal
Pratinjau Gambar Gemini 3 Pro 🍌 2.000.000

Tingkat 2

Model Token yang dimasukkan dalam antrean batch
Model teks keluar
Pratinjau Gemini 3 Pro 500.000.000
Gemini 2.5 Pro 500.000.000
Gemini 2.5 Flash 400.000.000
Pratinjau Gemini 2.5 Flash 400.000.000
Gemini 2.5 Flash-Lite 500.000.000
Pratinjau Gemini 2.5 Flash-Lite 500.000.000
Gemini 2.0 Flash 1.000.000.000
Gemini 2.0 Flash-Lite 1.000.000.000
Model pembuatan multi-modal
Pratinjau Gambar Gemini 3 Pro 🍌 270.000.000

Tingkat 3

Model Token yang dimasukkan dalam antrean batch
Model teks keluar
Pratinjau Gemini 3 Pro 1.000.000.000
Gemini 2.5 Pro 1.000.000.000
Gemini 2.5 Flash 1.000.000.000
Pratinjau Gemini 2.5 Flash 1.000.000.000
Gemini 2.5 Flash-Lite 1.000.000.000
Pratinjau Gemini 2.5 Flash-Lite 1.000.000.000
Gemini 2.0 Flash 5.000.000.000
Gemini 2.0 Flash-Lite 5.000.000.000
Model pembuatan multi-modal
Pratinjau Gambar Gemini 3 Pro 🍌 1.000.000.000

Cara mengupgrade ke tingkat berikutnya

Gemini API menggunakan Penagihan Cloud untuk semua layanan penagihan. Untuk beralih dari paket Gratis ke paket berbayar, Anda harus mengaktifkan Penagihan Cloud untuk project Google Cloud terlebih dahulu.

Setelah project Anda memenuhi kriteria yang ditentukan, project tersebut akan memenuhi syarat untuk di-upgrade ke tingkat berikutnya. Untuk meminta upgrade, ikuti langkah-langkah berikut:

Setelah validasi cepat, project akan diupgrade ke tingkat berikutnya.

Meminta peningkatan batas rasio

Setiap variasi model memiliki batas frekuensi panggilan yang terkait (permintaan per menit, RPM). Untuk mengetahui detail tentang batas kapasitas tersebut, lihat Model Gemini.

Meminta peningkatan batas rasio tingkat berbayar

Kami tidak memberikan jaminan tentang peningkatan batas laju Anda, tetapi kami akan berupaya sebaik mungkin untuk meninjau permintaan Anda.