Gemini API adalah jalur tercepat dari perintah ke tahap produksi dengan Gemini, Veo, Nano Banana, dan lainnya. API ini memungkinkan Anda mengintegrasikan model generatif ini ke dalam aplikasi untuk membuat teks dan gambar, menganalisis input multimodal, dan membuat agen percakapan.
Interactions API adalah cara terbaik untuk membangun dengan Gemini API dan model serta agen Gemini. Pelajari lebih lanjut di Ringkasan Interactions API.
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.6-flash",
input="Explain how AI works in a few words"
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
const interaction = await ai.interactions.create({
model: "gemini-3.6-flash",
input: "Explain how AI works in a few words",
});
console.log(interaction.output_text);
REST
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-d '{
"model": "gemini-3.6-flash",
"input": "Explain how AI works in a few words"
}'
Ikuti panduan memulai kami untuk mendapatkan kunci API dan melakukan panggilan API pertama Anda dalam hitungan menit.
Perkenalkan model kami
Lihat semuaGemini 3.1 Pro Baru
Model tercerdas kami, yang terbaik di dunia untuk pemahaman multimodal, semuanya dibangun berdasarkan penalaran canggih.
Gemini 3.6 Flash Baru
Performa kelas terdepan yang menyaingi model yang lebih besar dengan biaya yang lebih murah.
Gemini 3.5 Flash-Lite Baru
Model bervolume tinggi dan sensitif terhadap biaya yang dioptimalkan untuk tugas subagen dengan latensi rendah dan throughput tinggi.
Gemini 3 Flash
Performa kelas terdepan yang menyaingi model yang lebih besar dengan biaya yang lebih murah.
🍌 Nano Banana 2 dan Nano Banana Pro
Model pengeditan dan pembuatan gambar tercanggih.
Veo 3.1
Model pembuatan video tercanggih kami, dengan audio native.
Gemini Robotics
Model bahasa visi (VLM) yang menghadirkan kemampuan agen Gemini ke robotika dan memungkinkan penalaran canggih di dunia fisik.
Ketahui Kemampuannya
Pembuatan Gambar Native (Nano Banana)
Buat dan edit gambar yang sangat kontekstual secara native dengan Gemini 2.5 Flash Image.
Konteks Panjang
Masukkan jutaan token ke model Gemini dan dapatkan pemahaman dari gambar, video, dan dokumen yang tidak terstruktur.
Output Terstruktur
Batasi Gemini untuk merespons dengan JSON, format data terstruktur yang sesuai untuk pemrosesan otomatis.
Pemanggilan Fungsi
Buat alur kerja agen dengan menghubungkan Gemini ke API dan alat eksternal.
Pembuatan Video dengan Veo 3.1
Buat konten video berkualitas tinggi dari perintah teks atau gambar dengan model tercanggih kami.
Agen Suara dengan Live API
Buat aplikasi dan agen suara real-time dengan Live API.
Alat
Hubungkan Gemini ke dunia melalui alat bawaan seperti Google Penelusuran, Konteks URL, Google Maps, Eksekusi Kode, dan Penggunaan Komputer.
Document Understanding
Proses hingga 1.000 halaman file PDF dengan pemahaman multimodal penuh atau jenis file berbasis teks lainnya.
Penalaran
Pelajari cara kemampuan berpikir meningkatkan penalaran untuk tugas dan agen yang kompleks.