Gemini API เป็นเส้นทางที่เร็วที่สุดจากพรอมต์ไปสู่การใช้งานจริงด้วย Gemini, Veo, Nano Banana และอื่นๆ โดยช่วยให้คุณผสานรวมโมเดล Generative เหล่านี้เข้ากับแอปพลิเคชันเพื่อสร้างข้อความและรูปภาพ วิเคราะห์อินพุตแบบหลายรูปแบบ และสร้าง Agent ที่ใช้สนทนา
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.7-flash",
input="Explain how AI works in a few words"
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
const interaction = await ai.interactions.create({
model: "gemini-3.7-flash",
input: "Explain how AI works in a few words",
});
console.log(interaction.output_text);
REST
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-d '{
"model": "gemini-3.7-flash",
"input": "Explain how AI works in a few words"
}'
ทำตามคู่มือเริ่มต้นใช้งานเพื่อรับคีย์ API และทำการเรียก API ครั้งแรกภายในไม่กี่นาที
พบกับโมเดล
ดูทั้งหมดGemini 3.1 Pro ใหม่
โมเดลที่ชาญฉลาดที่สุดของเรา ซึ่งดีที่สุดในโลกสำหรับการทำความเข้าใจข้อมูลหลายรูปแบบ โดยทั้งหมดสร้างขึ้นจากการให้เหตุผลที่ล้ำสมัย
Gemini 3.7 Flash ใหม่
โมเดล Flash ล่าสุดและมีความสามารถมากที่สุดของเรา ซึ่งสร้างขึ้นสำหรับการเขียนโค้ดที่ซับซ้อน เวิร์กโฟลว์แบบ Agent และการดำเนินการหลายขั้นตอนที่เชื่อถือได้
Gemini 3.6 Flash
โมเดล Flash รุ่นก่อนหน้าของเรา ซึ่งมีความสมดุลระหว่างความเร็วและความสามารถแบบหลายรูปแบบสำหรับงานทั่วไปแบบ Agent และงานประจำวัน
Gemini 3.5 Flash
โมเดล Flash รุ่นเก่าของเรา ซึ่งมีความเร็วพื้นฐานและประสิทธิภาพพื้นฐานสำหรับภาระงานประจำที่มีปริมาณงานสูง
Gemini 3.5 Flash-Lite ใหม่
โมเดลที่มีปริมาณงานสูงและคำนึงถึงต้นทุน ซึ่งได้รับการเพิ่มประสิทธิภาพสำหรับงานของ Subagent ที่มีเวลาในการตอบสนองต่ำและการส่งข้อความปริมาณมาก
Gemini 3.1 Flash-Lite
โมเดลที่มีปริมาณงานสูงและคำนึงถึงต้นทุน ซึ่งมีประสิทธิภาพและคุณภาพของ Gemini 3 Series
Gemini 3 Flash
ประสิทธิภาพระดับแนวหน้าเทียบเท่าโมเดลขนาดใหญ่กว่าในราคาที่ถูกกว่ามาก
🍌 Nano Banana 2 และ Nano Banana Pro
โมเดลการสร้างและแก้ไขรูปภาพที่ล้ำสมัย
Veo 3.1
โมเดลการสร้างวิดีโอที่ล้ำสมัยของเราพร้อมเสียงในตัว
Gemini Robotics
โมเดลวิสัยทัศน์และภาษา (VLM) ที่นำความสามารถด้าน Agentic AI ของ Gemini มาใช้กับหุ่นยนต์และช่วยให้การให้เหตุผลขั้นสูงในโลกทางกายภาพเป็นไปได้
สำรวจความสามารถ
การสร้างรูปภาพในตัว (Nano Banana)
สร้างและแก้ไขรูปภาพที่มีบริบทสูงในตัวด้วย Gemini 2.5 Flash Image
บริบทแบบยาว
ป้อนโทเค็นหลายล้านรายการลงในโมเดล Gemini และรับข้อมูลเชิงลึกจากรูปภาพ วิดีโอ และเอกสารที่ไม่มีโครงสร้าง
เอาต์พุตที่มีโครงสร้าง
จำกัดให้ Gemini ตอบกลับด้วย JSON ซึ่งเป็นรูปแบบข้อมูลที่มี Structured Data ที่เหมาะสำหรับการประมวลผลอัตโนมัติ
การเรียกใช้ฟังก์ชัน
สร้างเวิร์กโฟลว์แบบ Agent โดยเชื่อมต่อ Gemini กับ API และเครื่องมือภายนอก
การสร้างวิดีโอด้วย Veo 3.1
สร้างเนื้อหาวิดีโอคุณภาพสูงจากพรอมต์ข้อความหรือรูปภาพด้วยโมเดลที่ล้ำสมัยของเรา
Agent เสียงพร้อม Live API
สร้างแอปพลิเคชันและ Agent เสียงแบบเรียลไทม์ด้วย Live API
เครื่องมือ
เชื่อมต่อ Gemini กับโลกภายนอกผ่านเครื่องมือในตัว เช่น Google Search, บริบท URL, Google Maps, การดำเนินการโค้ด และการใช้คอมพิวเตอร์
การทำความเข้าใจเอกสาร
ประมวลผลไฟล์ PDF ได้สูงสุด 1,000 หน้าด้วยความเข้าใจข้อมูลหลายรูปแบบอย่างเต็มรูปแบบหรือไฟล์ประเภทอื่นๆ ที่อิงตามข้อความ
กำลังคิด
สำรวจวิธีที่ความสามารถในการคิดช่วยปรับปรุงการให้เหตุผลสำหรับงานและ Agent ที่ซับซ้อน
Interactions API
Interactions API ได้กลายเป็นอินเทอร์เฟซเริ่มต้นของเราตั้งแต่เดือนมิถุนายน 2026 และเป็นวิธีที่ดีที่สุดในการสร้างด้วยโมเดลและ Agent ของ Gemini ในอนาคต หากคุณกำลังเริ่มโปรเจ็กต์ใหม่ คุณควรใช้ Interactions API แม้ว่าเราจะยังคงให้การสนับสนุน แต่ตอนนี้ generateContent API ถือเป็น API รุ่นเก่า