Gemini API เป็นเส้นทางที่เร็วที่สุดจากพรอมต์ไปสู่การใช้งานจริงด้วย Gemini, Veo, Nano Banana และอื่นๆ โดยจะช่วยให้คุณผสานรวมโมเดล Generative เหล่านี้เข้ากับแอปพลิเคชันเพื่อสร้างข้อความและรูปภาพ วิเคราะห์อินพุตแบบหลายรูปแบบ และสร้าง Agent ที่ใช้สนทนาได้
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.8-flash",
input="Explain how AI works in a few words"
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
const interaction = await ai.interactions.create({
model: "gemini-3.8-flash",
input: "Explain how AI works in a few words",
});
console.log(interaction.output_text);
Java
import com.google.genai.Client;
import com.google.genai.gaos.models.interactions.CreateModelInteraction;
import com.google.genai.gaos.models.interactions.Interaction;
import com.google.genai.gaos.models.interactions.InteractionsInput;
import com.google.genai.gaos.models.interactions.Model;
import com.google.genai.gaos.models.operations.CreateInteractionRequestBody;
Client client = new Client();
CreateModelInteraction params =
CreateModelInteraction.builder()
.model(Model.of("gemini-3.7-flash"))
.input(InteractionsInput.of("Explain how AI works in a few words"))
.build();
Interaction interaction =
client.interactions.create(CreateInteractionRequestBody.of(params)).interaction().get();
System.out.println(interaction.outputText().orElse(""));
REST
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-d '{
"model": "gemini-3.8-flash",
"input": "Explain how AI works in a few words"
}'
ทำความรู้จักกับโมเดล
ดูทั้งหมดGemini 3.8 Flash ใหม่
โมเดล Flash ที่ชาญฉลาดที่สุดของเรา ซึ่งออกแบบมาเพื่อการพัฒนาซอฟต์แวร์ในระยะยาว, Agent ที่ทำงานได้ด้วยตัวเอง และเวิร์กโฟลว์ที่ซับซ้อนขององค์กร
Gemini 3.5 Flash-Lite
โมเดลที่รองรับปริมาณงานสูงและคำนึงถึงต้นทุน ซึ่งได้รับการปรับให้เหมาะกับงานของ Subagent ที่มีเวลาในการตอบสนองต่ำและมีการส่งข้อความปริมาณมาก
Gemini 3.1 Pro
โมเดลที่ชาญฉลาดที่สุดของเรา ซึ่งเป็นโมเดลที่ดีที่สุดในโลกสำหรับการทำความเข้าใจข้อมูลหลายรูปแบบ โดยทั้งหมดนี้สร้างขึ้นจากการให้เหตุผลที่ล้ำสมัย
🍌 Nano Banana 2 และ Nano Banana Pro
โมเดลการสร้างและแก้ไขรูปภาพที่ล้ำสมัย
Gemini Omni Flash
โมเดลการสร้างและแก้ไขวิดีโอที่ล้ำสมัยของเรา
Gemini 3.5 Transcribe ใหม่
โมเดลการแปลงคำพูดเป็นข้อความที่มีเวลาในการตอบสนองต่ำ พร้อมการตรวจหาภาษาตามคำพูด การแยกเสียงพูดของแต่ละบุคคล และการประทับเวลาของคำ
Gemini Robotics
โมเดลวิสัยทัศน์และภาษา (VLM) ที่นำความสามารถด้าน Agentic AI ของ Gemini มาใช้กับหุ่นยนต์ และช่วยให้สามารถให้เหตุผลขั้นสูงในโลกทางกายภาพได้
สำรวจความสามารถ
การสร้างรูปภาพ
สร้างและแก้ไขรูปภาพที่มีบริบทสูงได้โดยตรงด้วย Nano Banana
บริบทแบบยาว
ป้อนข้อมูลโทเค็นหลายล้านรายการลงในโมเดล Gemini และรับข้อมูลเชิงลึกจากรูปภาพ วิดีโอ และเอกสารที่ไม่มีโครงสร้าง
เอาต์พุตที่มีโครงสร้าง
จำกัดให้ Gemini ตอบกลับด้วย JSON ซึ่งเป็นรูปแบบข้อมูลที่มี Structured Data ที่เหมาะสำหรับการประมวลผลอัตโนมัติ
การเรียกใช้ฟังก์ชัน
สร้างเวิร์กโฟลว์ของ Agent โดยการเชื่อมต่อ Gemini กับ API และเครื่องมือภายนอก
การสร้างวิดีโอด้วย Veo 3.1
สร้างเนื้อหาวิดีโอคุณภาพสูงจากพรอมต์ข้อความหรือรูปภาพด้วยโมเดลที่ล้ำสมัยของเรา
Agent เสียงพร้อม Live API
สร้างแอปพลิเคชันและ Agent เสียงแบบเรียลไทม์ด้วย Live API
เครื่องมือ
เชื่อมต่อ Gemini กับโลกภายนอกผ่านเครื่องมือในตัว เช่น Google Search, บริบท URL, Google Maps, การดำเนินการโค้ด และการใช้คอมพิวเตอร์
การทำความเข้าใจเอกสาร
ประมวลผลไฟล์ PDF ได้สูงสุด 1,000 หน้าด้วยความสามารถในการทำความเข้าใจข้อมูลหลายรูปแบบอย่างเต็มที่ หรือไฟล์ประเภทอื่นๆ ที่อิงตามข้อความ
กำลังคิด
ดูว่าความสามารถในการคิดช่วยปรับปรุงการให้เหตุผลสำหรับงานและ Agent ที่ซับซ้อนได้อย่างไร
Interactions API
Interactions API ได้กลายเป็นอินเทอร์เฟซเริ่มต้นของเราตั้งแต่เดือนมิถุนายน 2026 และเป็นวิธีที่ดีที่สุดในการสร้างด้วยโมเดลและ Agent ของ Gemini ในอนาคต หากเริ่มต้นโปรเจ็กต์ใหม่ คุณควรใช้ Interactions API แม้ว่าเราจะยังคงให้การสนับสนุน แต่ตอนนี้ generateContent API ถือเป็น API รุ่นเก่า