Gemini API היא הדרך הכי מהירה להפוך הנחיה למוצר מוגמר באמצעות Gemini, Veo, Nano Banana ועוד. הוא מאפשר לכם לשלב את המודלים הגנרטיביים האלה באפליקציות שלכם כדי ליצור טקסט ותמונות, לנתח קלט מולטי-מודאלי ולבנות סוכנים שיכולים לנהל שיחות.
Interactions API הוא הדרך הכי טובה לפתח באמצעות Gemini API ומודלים וסוכנים של Gemini. מידע נוסף על Interactions API
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.6-flash",
input="Explain how AI works in a few words"
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
const interaction = await ai.interactions.create({
model: "gemini-3.6-flash",
input: "Explain how AI works in a few words",
});
console.log(interaction.output_text);
REST
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-d '{
"model": "gemini-3.6-flash",
"input": "Explain how AI works in a few words"
}'
במדריך לתחילת העבודה מוסבר איך לקבל מפתח API ולבצע את הקריאה הראשונה ל-API תוך כמה דקות.
היכרות עם המודלים
הצג הכולGemini 3.1 Pro חדש
המודל הכי חכם שלנו, הכי טוב בעולם בהבנה מולטימודלית, והכול מבוסס על יכולות רציונליות מתקדמות.
Gemini 3.6 Flash חדש
ביצועים ברמה של Frontier, שמתחרים במודלים גדולים יותר בעלות נמוכה בהרבה.
Gemini 3.5 Flash-Lite חדש
מודל בנפח גבוה ובעלות נמוכה, שעבר אופטימיזציה למשימות של סוכני משנה עם זמן אחזור נמוך וקצב העברה גבוה.
Gemini 3 Flash
ביצועים ברמה של Frontier, שמתחרים במודלים גדולים יותר בעלות נמוכה בהרבה.
Nano Banana 2 ו-Nano Banana Pro
מודלים חדשניים ומתקדמים ליצירה ולעריכה של תמונות.
Veo 3.1
מודל ליצירת וידאו המתקדם ביותר שלנו, עם אודיו מובנה.
Gemini Robotics
מודל שפה ויזואלי (VLM) שמביא את יכולות אג'נטיות של Gemini לרובוטיקה ומאפשר חשיבה רציונלית משופרת בעולם הפיזי.
יכולות נוספות
יצירת תמונות באופן מובנה (Nano Banana)
אתם יכולים ליצור ולערוך תמונות עם הקשר רחב באמצעות Gemini 2.5 Flash Image.
הקשר רחב
להזין מיליוני טוקנים למודלים של Gemini ולקבל תובנות מתמונות, סרטונים ומסמכים לא מובנים.
פלט מובנה
מגבילים את Gemini לתגובה ב-JSON, שהוא פורמט נתונים מובְנה שמתאים לעיבוד אוטומטי.
בקשה להפעלת פונקציה
אפשר לבנות תהליכי עבודה מבוססי-סוכנים על ידי חיבור של Gemini לממשקי API ולכלים חיצוניים.
יצירת סרטונים באמצעות Veo 3.1
אתם יכולים ליצור תוכן וידאו באיכות גבוהה מפרומפטים של טקסט או תמונה באמצעות המודל המתקדם ביותר (SOTA) שלנו.
סוכני קוליים עם Live API
אפשר ליצור סוכנים ואפליקציות קוליות בזמן אמת באמצעות Live API.
כלים
אפשר לחבר את Gemini לעולם באמצעות כלים מובנים כמו חיפוש Google, הקשר של כתובת URL, מפות Google, הפעלת קוד ושימוש במחשב.
הבנת מסמכים
לעבד עד 1,000 דפים של קובצי PDF עם הבנה מולטי-מודאלית מלאה או סוגים אחרים של קבצים מבוססי-טקסט.
מעמיק
כאן אפשר לראות איך יכולות החשיבה משפרות את החשיבה הרציונלית במשימות מורכבות ובסוכנים.