Gemini API هو أسرع طريقة للانتقال من الطلب إلى مرحلة الإنتاج باستخدام Gemini وVeo وNano Banana والمزيد. تتيح لك هذه الواجهة دمج هذه النماذج التوليدية في تطبيقاتك لإنشاء النصوص والصور، وتحليل المدخلات المتعددة الوسائط، وإنشاء وكلاء محادثة.
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.7-flash",
input="Explain how AI works in a few words"
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
const interaction = await ai.interactions.create({
model: "gemini-3.7-flash",
input: "Explain how AI works in a few words",
});
console.log(interaction.output_text);
راحة
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-d '{
"model": "gemini-3.7-flash",
"input": "Explain how AI works in a few words"
}'
اتّبِع دليل البدء للحصول على مفتاح واجهة برمجة التطبيقات وإجراء أول طلب بيانات من واجهة برمجة التطبيقات في غضون دقائق.
التعرّف على النماذج
عرض الكلGemini 3.1 Pro جديد
أكثر نماذجنا ذكاءً، وهو الأفضل في العالم لفهم المحتوى المتعدد الوسائط، وكل ذلك استنادًا إلى مهارات استدلالية متقدّمة.
Gemini 3.7 Flash جديد
أحدث نماذج Flash وأكثرها تطورًا، وهو مصمّم للترميز المعقّد، ومهام سير العمل المستندة إلى الذكاء الاصطناعي الوكيل، والتنفيذ الموثوق به لعدة خطوات.
Gemini 3.6 Flash
نموذج Flash من الجيل السابق، يوازن بين السرعة والإمكانات المتعددة الوسائط في المهام العامة المستندة إلى الذكاء الاصطناعي الوكيل والمهام اليومية.
Gemini 3.5 Flash
نموذج Flash القديم، يوفّر سرعة أساسية وأداءً أساسيًا لأحمال العمل الروتينية ذات الإنتاجية العالية.
Gemini 3.5 Flash-Lite جديد
نموذج عالي الحجم وحساس للتكلفة ومحسّن لمهام الوكلاء الفرعيين ذات معدّل أعلى لنقل البيانات والوقت القليل للانتظار.
Gemini 3.1 Flash-Lite
نموذج عالي الحجم وحساس للتكلفة يتميّز بأداء وجودة سلسلة Gemini 3.
Gemini 3 Flash
أداء متقدّم يضاهي النماذج الأكبر حجمًا بجزء بسيط من التكلفة.
🍌 Nano Banana 2 وNano Banana Pro
أحدث النماذج لإنشاء الصور وتعديلها.
Veo 3.1
أحدث نماذجنا لإنشاء الفيديوهات، مع صوت أصلي.
Gemini Robotics
نموذج للرؤية واللغة (VLM) يوفّر إمكانات Gemini المستندة إلى الذكاء الاصطناعي الوكيل في مجال الروبوتات ويتيح الاستدلال المتقدّم في العالم المادي.
استكشاف الإمكانات
إنشاء الصور الأصلي (Nano Banana)
يمكنك إنشاء الصور وتعديلها بشكل أصلي باستخدام Gemini 2.5 Flash Image، مع مراعاة السياق بشكل كبير.
سياق طويل
يمكنك إدخال ملايين الرموز إلى نماذج Gemini واستخلاص الفهم من الصور والفيديوهات والمستندات غير المنظّمة.
مُخرجات منظَّمة
يمكنك حصر ردود Gemini بتنسيق JSON، وهو تنسيق بيانات منظَّمة مناسب للمعالجة الآلية.
استدعاء الدالة
يمكنك إنشاء مهام سير عمل مستندة إلى الذكاء الاصطناعي الوكيل من خلال ربط Gemini بواجهات برمجة التطبيقات والأدوات الخارجية.
إنشاء الفيديوهات باستخدام Veo 3.1
يمكنك إنشاء محتوى فيديو عالي الجودة من النصوص أو طلبات الصور باستخدام أحدث نماذجنا.
الوكلاء الصوتيون باستخدام Live API
يمكنك إنشاء تطبيقات ووكلاء صوتيين في الوقت الفعلي باستخدام Live API.
الأدوات
يمكنك ربط Gemini بالعالم من خلال أدوات مضمّنة، مثل "بحث Google" و"سياق عنوان URL" و"خرائط Google" و"تنفيذ الرموز البرمجية" و"استخدام الكمبيوتر".
فهم المستندات
يمكنك معالجة ما يصل إلى 1,000 صفحة من ملفات PDF مع فهم كامل لمختلف الوسائط أو أنواع الملفات الأخرى المستندة إلى النصوص.
جارٍ التفكير
يمكنك استكشاف كيفية تحسين إمكانات التفكير للاستدلال في المهام والوكلاء المعقّدين.
Interactions API
أصبحت Interactions API واجهتنا التلقائية اعتبارًا من يونيو 2026، وهي أفضل طريقة للإنشاء باستخدام نماذج Gemini والوكلاء من الآن فصاعدًا. إذا كنت تبدأ مشروعًا جديدًا، عليك استخدام Interactions API. على الرغم من أنّ واجهة برمجة التطبيقات generateContent لا تزال متاحة، إلا أنّها تُعتبر الآن قديمة.