Gemini API adalah jalur tercepat dari perintah ke produksi dengan Gemini, Veo, Nano Banana, dan lainnya. Dengan Gemini API, Anda dapat mengintegrasikan model generatif ini ke dalam aplikasi untuk membuat teks dan gambar, menganalisis input multimodal, dan membangun agen percakapan.
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.7-flash",
input="Explain how AI works in a few words"
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
const interaction = await ai.interactions.create({
model: "gemini-3.7-flash",
input: "Explain how AI works in a few words",
});
console.log(interaction.output_text);
REST
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-d '{
"model": "gemini-3.7-flash",
"input": "Explain how AI works in a few words"
}'
Ikuti panduan memulai kami untuk mendapatkan kunci API dan melakukan panggilan API pertama Anda dalam hitungan menit.
Perkenalkan model kami
Lihat semuaGemini 3.1 Pro Baru
Model tercerdas kami, yang terbaik di dunia untuk pemahaman multimodal, semuanya dibangun berdasarkan penalaran canggih.
Gemini 3.7 Flash Baru
Model Flash terbaru dan tercanggih kami, yang dibuat untuk coding yang kompleks, alur kerja agentik, dan eksekusi multi-langkah yang andal.
Gemini 3.6 Flash
Model Flash generasi sebelumnya, yang menyeimbangkan kecepatan dan kemampuan multimodal di berbagai tugas agentic umum dan sehari-hari.
Gemini 3.5 Flash
Model Flash lama kami, yang memberikan kecepatan dasar dan performa fundamental untuk beban kerja rutin dengan throughput tinggi.
Gemini 3.5 Flash-Lite Baru
Model bervolume tinggi dan sensitif biaya yang dioptimalkan untuk tugas sub-agen dengan throughput tinggi dan latensi rendah.
Gemini 3.1 Flash-Lite
Model volume tinggi yang sensitif terhadap biaya dengan performa dan kualitas seri Gemini 3.
Gemini 3 Flash
Performa kelas terdepan yang menyaingi model yang lebih besar dengan sebagian kecil biaya.
Nano Banana 2 dan Nano Banana Pro
Model pengeditan dan pembuatan gambar tercanggih.
Veo 3.1
Model pembuatan video tercanggih kami, dengan audio native.
Gemini Robotics
Model bahasa-penglihatan (VLM) yang menghadirkan kemampuan seperti agen Gemini ke robotika dan memungkinkan penalaran tingkat lanjut di dunia fisik.
Ketahui Kemampuannya
Pembuatan Gambar Native (Nano Banana)
Buat dan edit gambar yang sangat kontekstual secara native dengan Gemini 2.5 Flash Image.
Konteks Panjang
Masukkan jutaan token ke model Gemini dan dapatkan pemahaman dari gambar, video, dan dokumen yang tidak terstruktur.
Output Terstruktur
Batasi Gemini untuk merespons dengan JSON, format data terstruktur yang cocok untuk pemrosesan otomatis.
Pemanggilan Fungsi
Bangun alur kerja agentic dengan menghubungkan Gemini ke API dan alat eksternal.
Pembuatan Video dengan Veo 3.1
Buat konten video berkualitas tinggi dari perintah teks atau gambar dengan model tercanggih kami.
Agen Suara dengan Live API
Bangun aplikasi dan agen suara real-time dengan Live API.
Alat
Hubungkan Gemini ke dunia melalui alat bawaan seperti Google Penelusuran, Konteks URL, Google Maps, Eksekusi Kode, dan Penggunaan Komputer.
Document Understanding
Memproses hingga 1.000 halaman file PDF dengan pemahaman multimodal penuh atau jenis file berbasis teks lainnya.
Penalaran
Pelajari cara kemampuan berpikir meningkatkan penalaran untuk tugas dan agen yang kompleks.
Interactions API
Interactions API telah menjadi antarmuka default kami mulai Juni 2026 dan merupakan cara terbaik untuk membangun dengan model dan agen Gemini ke depannya. Jika Anda memulai project baru, Anda harus menggunakan Interactions API. Meskipun tetap didukung, generateContent API kini dianggap sebagai API lama.
Ringkasan Interaksi
Pelajari cara Interactions API mengelola status percakapan, pesan, dan format output.
Panduan Migrasi
Panduan langkah demi langkah untuk mentransisikan kode Anda dari generateContent ke Interactions API.
Streaming
Streaming token real-time, pemikiran inkremental, dan peristiwa panggilan alat.