Gemini API هو أسرع طريقة للانتقال من الطلب إلى مرحلة الإنتاج باستخدام Gemini وVeo وNano Banana والمزيد. تتيح لك هذه الواجهة دمج هذه النماذج التوليدية في تطبيقاتك لإنشاء النصوص والصور، وتحليل المدخلات المتعددة الوسائط، وإنشاء وكلاء محادثة.
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.8-flash",
input="Explain how AI works in a few words"
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
const interaction = await ai.interactions.create({
model: "gemini-3.8-flash",
input: "Explain how AI works in a few words",
});
console.log(interaction.output_text);
جافا
import com.google.genai.Client;
import com.google.genai.gaos.models.interactions.CreateModelInteraction;
import com.google.genai.gaos.models.interactions.Interaction;
import com.google.genai.gaos.models.interactions.InteractionsInput;
import com.google.genai.gaos.models.interactions.Model;
import com.google.genai.gaos.models.operations.CreateInteractionRequestBody;
Client client = new Client();
CreateModelInteraction params =
CreateModelInteraction.builder()
.model(Model.of("gemini-3.7-flash"))
.input(InteractionsInput.of("Explain how AI works in a few words"))
.build();
Interaction interaction =
client.interactions.create(CreateInteractionRequestBody.of(params)).interaction().get();
System.out.println(interaction.outputText().orElse(""));
REST
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-d '{
"model": "gemini-3.8-flash",
"input": "Explain how AI works in a few words"
}'
التعرّف على النماذج
عرض الكلGemini 3.8 Flash جديد
نموذج Flash الأكثر ذكاءً لدينا، تم تصميمه لهندسة البرامج على المدى الطويل والوكلاء المستقلين ومهام سير العمل المعقّدة في المؤسسات.
Gemini 3.5 Flash-Lite
نموذج عالي الحجم ومراعي للتكلفة ومحسّن لمهام الوكلاء الفرعيين ذات معدّل أعلى لنقل البيانات والوقت القليل للاستجابة
Gemini 3.1 Pro
نموذجنا الأكثر ذكاءً، وهو الأفضل في العالم لفهم المحتوى المتعدد الوسائط، وقد تم تصميمه بالكامل استنادًا إلى مهارات استدلالية متقدّمة.
🍌 Nano Banana 2 وNano Banana Pro
أحدث النماذج لإنشاء الصور وتعديلها
Gemini Omni Flash
أحدث نموذج لدينا لإنشاء الفيديوهات وتعديلها
Gemini 3.5 Transcribe جديد
نموذج من الكلام إلى النص مع وقت قليل للاستجابة، ويتميّز باكتشاف اللغة المستند إلى الجمل، وتحديد المتحدث، والطوابع الزمنية للكلمات
Gemini Robotics
نموذج للرؤية واللغة (VLM) يوفّر إمكانات Gemini المستندة إلى الوكلاء في مجال الروبوتات ويتيح الاستدلال المتقدّم في العالم المادي
استكشاف الإمكانات
إنشاء الصور
يمكنك إنشاء الصور وتعديلها بشكل أصلي باستخدام Nano Banana مع مراعاة السياق بشكل كبير.
سياق طويل
يمكنك إدخال ملايين الرموز المميّزة إلى نماذج Gemini واستخلاص الفهم من الصور والفيديوهات والمستندات غير المنظّمة.
مُخرجات منظَّمة
يمكنك حصر استجابات Gemini بتنسيق JSON، وهو تنسيق بيانات منظَّمة مناسب للمعالجة الآلية.
استدعاء الدالة
يمكنك إنشاء مهام سير عمل مستندة إلى الوكلاء من خلال ربط Gemini بواجهات برمجة التطبيقات والأدوات الخارجية.
إنشاء الفيديوهات باستخدام Veo 3.1
يمكنك إنشاء محتوى فيديو عالي الجودة من طلبات نصية أو صور باستخدام أحدث نموذج لدينا.
الوكلاء الصوتيون باستخدام Live API
يمكنك إنشاء تطبيقات ووكلاء صوتيين في الوقت الفعلي باستخدام Live API.
الأدوات
يمكنك ربط Gemini بالعالم من خلال أدوات مضمّنة، مثل "بحث Google" و"سياق عنوان URL" و"خرائط Google" و"تنفيذ الرموز البرمجية" و"استخدام الكمبيوتر".
فهم المستندات
يمكنك معالجة ما يصل إلى 1,000 صفحة من ملفات PDF مع فهم كامل لمختلف الوسائط أو أنواع الملفات الأخرى المستندة إلى النصوص.
جارٍ التفكير
يمكنك استكشاف كيفية تحسين إمكانات التفكير للاستدلال في المهام المعقّدة والوكلاء.
Interactions API
أصبحت Interactions API واجهتنا التلقائية اعتبارًا من يونيو 2026، وهي أفضل طريقة للإنشاء باستخدام نماذج Gemini والوكلاء من الآن فصاعدًا. إذا كنت تبدأ مشروعًا جديدًا، عليك استخدام Interactions API. على الرغم من أنّ واجهة برمجة التطبيقات generateContent لا تزال متاحة، إلا أنّها تُعتبر الآن قديمة.