رابط برنامهنویسی کاربردی (API) تعاملات جمینی (Gemini Interactions API) به توسعهدهندگان اجازه میدهد تا با استفاده از مدلهای جمینی، برنامههای هوش مصنوعی مولد (generative AI applications) بسازند. جمینی توانمندترین مدل ما است که از پایه برای چندوجهی بودن ساخته شده است. این مدل میتواند انواع مختلف اطلاعات از جمله زبان، تصاویر، صدا، ویدئو و کد را تعمیم داده و به طور یکپارچه درک کند، در میان آنها عمل کند و ترکیب کند. میتوانید از رابط برنامهنویسی کاربردی جمینی برای موارد استفادهای مانند استدلال در متن و تصاویر، تولید محتوا، عاملهای گفتگو، سیستمهای خلاصهسازی و طبقهبندی و موارد دیگر استفاده کنید.
ایجاد تعامل
یک تعامل جدید ایجاد میکند.
پارامترهای مسیر/پرسوجو
از کدام نسخه API استفاده کنیم.
درخواست بدنه
بدنه درخواست شامل دادههایی با ساختار زیر است:
مدل ModelOption (اختیاری)
نام «مدل» مورد استفاده برای تولید تعامل.
در صورت عدم ارائه «عامل»، الزامی است.
مقادیر ممکن
-
models/gemini-2.5-flash-liteکوچکترین و مقرون به صرفه ترین مدل ما، ساخته شده برای استفاده در مقیاس بزرگ.
-
models/gemini-2.5-flash-imageمدل تولید تصویر بومی ما، که برای سرعت، انعطافپذیری و درک متنی بهینه شده است. ورودی و خروجی متن با همان قیمت ۲.۵ فلش ارائه میشود.
-
models/gemini-3.1-flash-liteمقرونبهصرفهترین مدل ما، بهینهشده برای وظایف عاملمحور با حجم بالا، ترجمه و پردازش دادههای ساده.
-
models/gemini-3.1-flash-imageهوش بصری حرفهای با کارایی فوقالعاده و قابلیتهای تولید محتوای مبتنی بر واقعیت.
-
models/gemini-3.5-flashهوشمندترین مدل ما برای عملکرد مرزی پایدار در وظایف عاملدار و کدنویسی.
-
models/gemini-3.6-flashهوشمندترین مدل ما برای عملکرد مرزی پایدار در وظایف عاملدار و کدنویسی.
-
models/gemini-3.7-flashهوشمندترین مدل ما برای عملکرد مرزی پایدار در وظایف عاملدار و کدنویسی.
گزینه عامل (اختیاری)
نام «عامل» مورد استفاده برای ایجاد تعامل.
در صورت عدم ارائه «مدل»، الزامی است.
مقادیر ممکن
-
deep-research-pro-preview-12-2025نماینده تحقیقات عمیق جمینی
-
deep-research-preview-04-2026نماینده تحقیقات عمیق جمینی
-
deep-research-max-preview-04-2026مامور مکس تحقیقات عمیق جمینی
-
antigravity-preview-05-2026از عامل مدیریتشدهی Antigravity برای انجام وظایف چند مرحلهای که نیاز به استدلال، عملیات فایل و استفاده از ابزار دارند، استفاده کنید.
ورودیهای تعامل (مشترک برای مدل و عامل).
دستورالعمل سیستم برای تعامل.
فهرستی از اعلانهای ابزار که مدل ممکن است در طول تعامل فراخوانی کند.
تأکید میکند که پاسخ تولید شده یک شیء JSON است که با طرحواره JSON مشخص شده در این فیلد مطابقت دارد.
فقط ورودی. اینکه آیا تعامل پخش زنده خواهد شد یا خیر.
فقط ورودی. آیا پاسخ و درخواست برای بازیابی بعدی ذخیره شود یا خیر.
فقط ورودی. اینکه آیا تعامل مدل در پسزمینه اجرا شود یا خیر.
generation_config GenerationConfig (اختیاری)
پیکربندی مدل
پارامترهای پیکربندی برای تعامل مدل.
جایگزینی برای `agent_config`. فقط زمانی قابل اجرا است که `model` تنظیم شده باشد.
فیلدها
حداکثر تعداد توکنهایی که باید در پاسخ گنجانده شوند.
بذر مورد استفاده در رمزگشایی برای تکرارپذیری.
اختیاری. پیکربندی گفتار و چند بلندگو.
فهرستی از توالیهای کاراکتری که تعامل خروجی را متوقف میکنند.
سطح_فکریسطح_فکری ( اختیاری )
سطح توکنهای فکری که مدل باید تولید کند.
مقادیر ممکن
-
minimalکم یا بدون فکر کردن.
-
lowسطح فکری پایین.
-
mediumسطح فکری متوسط.
-
highسطح فکری بالا.
خلاصههای تفکر ( اختیاری)
اینکه آیا خلاصه نظرات در پاسخ گنجانده شود یا خیر.
مقادیر ممکن
-
autoخلاصههای تفکر خودکار
-
noneبدون خلاصه نویسی فکری.
پیکربندی انتخاب ابزار.
مقادیر ممکن:
-
autoانتخاب خودکار ابزار.
-
anyهر انتخاب ابزاری.
-
noneبدون انتخاب ابزار.
-
validatedانتخاب ابزار معتبر.
پیکربندی عامل پویا (اختیاری)
پیکربندی عامل
پیکربندی برای عامل.
جایگزینی برای `generation_config`. فقط زمانی قابل اجرا است که `agent` تنظیم شده باشد.
فیلدها
هیچ توضیحی ارائه نشده است.
همیشه روی "dynamic" تنظیم شود.
برچسبهایی با فرادادههای تعریفشده توسط کاربر برای درخواست.
حداکثر مجموع توکنها برای اجرای عامل.
شناسهی تعامل قبلی، در صورت وجود.
تنظیمات ایمنی برای تعامل.
پاسخ
یک منبع تعامل (Interaction) را برمیگرداند.
درخواست ساده
پاسخ نمونه
{ "created": "2025-11-26T12:25:15Z", "id": "v1_ChdPU0F4YWFtNkFwS2kxZThQZ05lbXdROBIXT1NBeGFhbTZBcEtpMWU4UGdOZW13UTg", "model": "gemini-3.6-flash", "object": "interaction", "status": "completed", "steps": [ { "type": "model_output", "content": [ { "type": "text", "text": "Hello! I'm functioning perfectly and ready to assist you.\n\nHow are you doing today?" } ] } ], "updated": "2025-11-26T12:25:15Z", "usage": { "input_tokens_by_modality": [ { "modality": "text", "tokens": 7 } ], "total_cached_tokens": 0, "total_input_tokens": 7, "total_output_tokens": 20, "total_thought_tokens": 22, "total_tokens": 49, "total_tool_use_tokens": 0 } }
چند نوبتی
پاسخ نمونه
{ "created": "2025-11-26T12:22:47Z", "id": "v1_ChdPU0F4YWFtNkFwS2kxZThQZ05lbXdROBIXT1NBeGFhbTZBcEtpMWU4UGdOZW13UTg", "model": "gemini-3.6-flash", "object": "interaction", "status": "completed", "steps": [ { "type": "model_output", "content": [ { "type": "text", "text": "The capital of France is Paris." } ] } ], "updated": "2025-11-26T12:22:47Z", "usage": { "input_tokens_by_modality": [ { "modality": "text", "tokens": 50 } ], "total_cached_tokens": 0, "total_input_tokens": 50, "total_output_tokens": 10, "total_thought_tokens": 0, "total_tokens": 60, "total_tool_use_tokens": 0 } }
ورودی تصویر
پاسخ نمونه
{ "created": "2025-11-26T12:22:47Z", "id": "v1_ChdPU0F4YWFtNkFwS2kxZThQZ05lbXdROBIXT1NBeGFhbTZBcEtpMWU4UGdOZW13UTg", "model": "gemini-3.6-flash", "object": "interaction", "status": "completed", "steps": [ { "type": "model_output", "content": [ { "type": "text", "text": "A white humanoid robot with glowing blue eyes stands holding a red skateboard." } ] } ], "updated": "2025-11-26T12:22:47Z", "usage": { "input_tokens_by_modality": [ { "modality": "text", "tokens": 10 }, { "modality": "image", "tokens": 258 } ], "total_cached_tokens": 0, "total_input_tokens": 268, "total_output_tokens": 20, "total_thought_tokens": 0, "total_tokens": 288, "total_tool_use_tokens": 0 } }
فراخوانی تابع
پاسخ نمونه
{ "created": "2025-11-26T12:22:47Z", "id": "v1_ChdPU0F4YWFtNkFwS2kxZThQZ05lbXdROBIXT1NBeGFhbTZBcEtpMWU4UGdOZW13UTg", "model": "gemini-3.6-flash", "object": "interaction", "status": "requires_action", "steps": [ { "name": "get_weather", "type": "function_call", "arguments": { "location": "Boston, MA" }, "id": "gth23981" } ], "updated": "2025-11-26T12:22:47Z", "usage": { "input_tokens_by_modality": [ { "modality": "text", "tokens": 100 } ], "total_cached_tokens": 0, "total_input_tokens": 100, "total_output_tokens": 25, "total_thought_tokens": 0, "total_tokens": 125, "total_tool_use_tokens": 50 } }
لغو یک تعامل
یک تعامل را بر اساس شناسه لغو میکند. این فقط برای تعاملات پسزمینهای که هنوز در حال اجرا هستند، اعمال میشود.
پارامترهای مسیر/پرسوجو
از کدام نسخه API استفاده کنیم.
شناسه منحصر به فرد تعاملی که باید لغو شود.
پاسخ
یک منبع تعامل (Interaction) را برمیگرداند.
لغو تعامل
پاسخ نمونه
{ "created": "2025-11-26T12:25:15Z", "id": "v1_ChdPU0F4YWFtNkFwS2kxZThQZ05lbXdROBIXT1NBeGFhbTZBcEtpMWU4UGdOZW13UTg", "model": "gemini-3.6-flash", "object": "interaction", "status": "cancelled", "updated": "2025-11-26T12:25:15Z" }
بازیابی یک تعامل
جزئیات کامل یک تعامل واحد را بر اساس `Interaction.id` آن بازیابی میکند.
پارامترهای مسیر/پرسوجو
از کدام نسخه API استفاده کنیم.
شناسه منحصر به فرد تعاملی که قرار است بازیابی شود.
اختیاری. در صورت تنظیم، جریان تعامل را از بخش بعدی پس از رویداد مشخص شده توسط شناسه رویداد از سر میگیرد. فقط در صورتی قابل استفاده است که `stream` برابر با true باشد.
اگر روی درست تنظیم شود، محتوای تولید شده به صورت تدریجی پخش میشود.
پیشفرض: False
پاسخ
یک منبع تعامل (Interaction) را برمیگرداند.
تعامل دریافت کنید
پاسخ نمونه
{ "created": "2025-11-26T12:25:15Z", "id": "v1_ChdPU0F4YWFtNkFwS2kxZThQZ05lbXdROBIXT1NBeGFhbTZBcEtpMWU4UGdOZW13UTg", "model": "gemini-3.6-flash", "object": "interaction", "status": "completed", "steps": [ { "type": "model_output", "content": [ { "type": "text", "text": "I'm doing great, thank you for asking! How can I help you today?" } ] } ], "updated": "2025-11-26T12:25:15Z" }
حذف یک تعامل
تعامل را بر اساس شناسه حذف میکند.
پارامترهای مسیر/پرسوجو
از کدام نسخه API استفاده کنیم.
شناسه منحصر به فرد تعاملی که باید حذف شود.
پاسخ
در صورت موفقیت، پاسخ خالی است.
حذف
منابع
تعامل
منبع تعامل.
فیلدها
گزینه عامل (اختیاری)
نام «عامل» مورد استفاده برای ایجاد تعامل.
مقادیر ممکن
-
deep-research-pro-preview-12-2025نماینده تحقیقات عمیق جمینی
-
deep-research-preview-04-2026نماینده تحقیقات عمیق جمینی
-
deep-research-max-preview-04-2026مامور مکس تحقیقات عمیق جمینی
-
antigravity-preview-05-2026از عامل مدیریتشدهی Antigravity برای انجام وظایف چند مرحلهای که نیاز به استدلال، عملیات فایل و استفاده از ابزار دارند، استفاده کنید.
پیکربندی عامل پویا (اختیاری)
پارامترهای پیکربندی برای تعامل عامل.
فیلدها
هیچ توضیحی ارائه نشده است.
همیشه روی "dynamic" تنظیم شود.
فقط خروجی. زمانی که پاسخ در قالب ISO 8601 (YYYY-MM-DDThh:mm:ssZ) ایجاد شده است.
آرایه خطاها (Error) (اختیاری)
فقط خروجی. خطاهای تشخیصی / خطاهای پلتفرم که در تعامل ثبت شدهاند.
فیلدها
یک URI که نوع خطا را مشخص میکند.
یک پیام خطا که برای انسان قابل خواندن باشد.
الزامی. فقط خروجی. یک شناسه منحصر به فرد برای تکمیل تعامل.
پیشفرضها به:
برچسبهایی با فرادادههای تعریفشده توسط کاربر برای درخواست.
حداکثر مجموع توکنها برای اجرای عامل.
مدل ModelOption (اختیاری)
نام «مدل» مورد استفاده برای تولید تعامل.
مقادیر ممکن
-
models/gemini-2.5-flash-liteکوچکترین و مقرون به صرفه ترین مدل ما، ساخته شده برای استفاده در مقیاس بزرگ.
-
models/gemini-2.5-flash-imageمدل تولید تصویر بومی ما، که برای سرعت، انعطافپذیری و درک متنی بهینه شده است. ورودی و خروجی متن با همان قیمت ۲.۵ فلش ارائه میشود.
-
models/gemini-3.1-flash-liteمقرونبهصرفهترین مدل ما، بهینهشده برای وظایف عاملمحور با حجم بالا، ترجمه و پردازش دادههای ساده.
-
models/gemini-3.1-flash-imageهوش بصری حرفهای با کارایی فوقالعاده و قابلیتهای تولید محتوای مبتنی بر واقعیت.
-
models/gemini-3.5-flashهوشمندترین مدل ما برای عملکرد مرزی پایدار در وظایف عاملدار و کدنویسی.
-
models/gemini-3.6-flashهوشمندترین مدل ما برای عملکرد مرزی پایدار در وظایف عاملدار و کدنویسی.
-
models/gemini-3.7-flashهوشمندترین مدل ما برای عملکرد مرزی پایدار در وظایف عاملدار و کدنویسی.
محتوای صوتی output_audio (اختیاری)
آخرین صدای تولید شده توسط مدل در پاسخ به درخواست فعلی. توجه: این توسط SDK اضافه شده است.
فیلدها
تعداد کانالهای صوتی
محتوای صوتی.
نوع مایم صدا.
مقادیر ممکن:
-
audio/wavفرمت صوتی WAV
-
audio/mp3فرمت صوتی MP3
-
audio/aiffفرمت صوتی AIFF
-
audio/aacفرمت صوتی AAC
-
audio/oggفرمت صوتی OGG
-
audio/flacفرمت صوتی FLAC
-
audio/mpegفرمت صوتی MPEG
-
audio/m4aفرمت صوتی M4A
-
audio/l16فرمت صوتی L16
-
audio/opusفرمت صوتی OPUS
-
audio/alawفرمت صوتی ALAW
-
audio/mulawفرمت صوتی MULAW
نرخ نمونهبرداری صدا.
هیچ توضیحی ارائه نشده است.
همیشه روی "audio" تنظیم شود.
آدرس اینترنتی (URI) فایل صوتی.
آخرین تصویری که توسط مدل در پاسخ به درخواست فعلی تولید شده است. توجه: این تصویر توسط SDK اضافه شده است.
متن به هم پیوسته از آخرین خروجی مدل در پاسخ به درخواست فعلی. توجه: این توسط SDK اضافه شده است.
شناسهی تعامل قبلی، در صورت وجود.
تأکید میکند که پاسخ تولید شده یک شیء JSON است که با طرحواره JSON مشخص شده در این فیلد مطابقت دارد.
تنظیمات ایمنی برای تعامل.
الزامی. فقط خروجی. وضعیت تعامل.
مقادیر ممکن:
-
in_progressتعامل در حال انجام است.
-
requires_actionاین تعامل نیاز به اقدام/ورودی از سوی کاربر دارد.
-
completedتعامل تکمیل شده است.
-
failedتعامل شکست خورد.
-
cancelledتعامل لغو شد.
-
incompleteتعامل تکمیل شده است، اما شامل نتایج ناقص است (مثلاً رسیدن به max_tokens).
فقط خروجی. مراحلی که تعامل را تشکیل میدهند، زمانی که در پاسخ گنجانده شوند.
دستورالعمل سیستم برای تعامل.
فهرستی از اعلانهای ابزار که مدل ممکن است در طول تعامل فراخوانی کند.
فقط خروجی. زمانی که پاسخ آخرین بار در قالب ISO 8601 (YYYY-MM-DDThh:mm:ssZ) بهروزرسانی شده است.
کاربرد (اختیاری )
فقط خروجی. آمار مربوط به میزان استفاده از توکن درخواست تعامل.
فیلدها
آرایه cached_tokens_by_modality (ModalityTokens) (اختیاری)
تفکیک میزان استفاده از توکنهای ذخیرهشده بر اساس روش.
فیلدها
روش پاسخ (اختیاری)
روش مرتبط با شمارش توکنها.
مقادیر ممکن
-
textنشان میدهد که مدل باید متن را برگرداند.
-
imageنشان میدهد که مدل باید تصاویر را برگرداند.
-
audioنشان میدهد که مدل باید صدا را برگرداند.
-
videoنشان میدهد که مدل باید ویدیو برگرداند.
-
documentنشان میدهد که مدل باید اسناد را برگرداند.
تعداد توکنها برای روش.
آرایه grounding_tool_count (GroundingToolCount) (اختیاری)
تعداد ابزار اتصال به زمین
فیلدها
تعداد ابزار اتصال به زمین مهم است.
نوع ابزار اتصال زمین مرتبط با شمارش.
مقادیر ممکن:
-
google_searchاتصال به زمین با جستجوی وب و جستجوی تصویر گوگل، و اتصال به زمین وب برای سازمانها.
-
google_mapsاتصال به زمین با نقشههای گوگل.
آرایه input_tokens_by_modality (ModalityTokens) (اختیاری)
تفکیک استفاده از توکن ورودی بر اساس روش.
فیلدها
روش پاسخ (اختیاری)
روش مرتبط با شمارش توکنها.
مقادیر ممکن
-
textنشان میدهد که مدل باید متن را برگرداند.
-
imageنشان میدهد که مدل باید تصاویر را برگرداند.
-
audioنشان میدهد که مدل باید صدا را برگرداند.
-
videoنشان میدهد که مدل باید ویدیو برگرداند.
-
documentنشان میدهد که مدل باید اسناد را برگرداند.
تعداد توکنها برای روش.
آرایه output_tokens_by_modality (ModalityTokens) (اختیاری)
تفکیک استفاده از توکن خروجی بر اساس روش.
فیلدها
روش پاسخ (اختیاری)
روش مرتبط با شمارش توکنها.
مقادیر ممکن
-
textنشان میدهد که مدل باید متن را برگرداند.
-
imageنشان میدهد که مدل باید تصاویر را برگرداند.
-
audioنشان میدهد که مدل باید صدا را برگرداند.
-
videoنشان میدهد که مدل باید ویدیو برگرداند.
-
documentنشان میدهد که مدل باید اسناد را برگرداند.
تعداد توکنها برای روش.
آرایه tool_use_tokens_by_modality (ModalityTokens) (اختیاری)
تفکیک میزان استفاده از توکنهای ابزار بر اساس روش.
فیلدها
روش پاسخ (اختیاری)
روش مرتبط با شمارش توکنها.
مقادیر ممکن
-
textنشان میدهد که مدل باید متن را برگرداند.
-
imageنشان میدهد که مدل باید تصاویر را برگرداند.
-
audioنشان میدهد که مدل باید صدا را برگرداند.
-
videoنشان میدهد که مدل باید ویدیو برگرداند.
-
documentنشان میدهد که مدل باید اسناد را برگرداند.
تعداد توکنها برای روش.
تعداد توکنها در بخش ذخیرهشدهی اعلان (محتوای ذخیرهشده).
تعداد توکنها در اعلان (زمینه).
تعداد کل توکنها در تمام پاسخهای تولید شده.
تعداد توکنهای افکار برای مدلهای تفکر.
تعداد کل توکنها برای درخواست تعامل (درخواست + پاسخها + سایر توکنهای داخلی).
تعداد توکنهای موجود در اعلان(های) استفاده از ابزار.
مثالها
مثال
{ "created": "2025-12-04T15:01:45Z", "id": "v1_ChdXS0l4YWZXTk9xbk0xZThQczhEcmlROBIXV0tJeGFmV05PcW5NMWU4UHM4RHJpUTg", "model": "gemini-3.6-flash", "object": "interaction", "status": "completed", "steps": [ { "type": "model_output", "content": [ { "type": "text", "text": "Hello! I'm doing well, functioning as expected. Thank you for asking! How are you doing today?" } ] } ], "updated": "2025-12-04T15:01:45Z", "usage": { "input_tokens_by_modality": [ { "modality": "text", "tokens": 7 } ], "total_cached_tokens": 0, "total_input_tokens": 7, "total_output_tokens": 23, "total_thought_tokens": 49, "total_tokens": 79, "total_tool_use_tokens": 0 } }
مدلهای داده
محتوا
محتوای پاسخ.
انواع ممکن
محتوای صوتی
یک بلوک محتوای صوتی.
تعداد کانالهای صوتی
محتوای صوتی.
نوع مایم صدا.
مقادیر ممکن:
-
audio/wavفرمت صوتی WAV
-
audio/mp3فرمت صوتی MP3
-
audio/aiffفرمت صوتی AIFF
-
audio/aacفرمت صوتی AAC
-
audio/oggفرمت صوتی OGG
-
audio/flacفرمت صوتی FLAC
-
audio/mpegفرمت صوتی MPEG
-
audio/m4aفرمت صوتی M4A
-
audio/l16فرمت صوتی L16
-
audio/opusفرمت صوتی OPUS
-
audio/alawفرمت صوتی ALAW
-
audio/mulawفرمت صوتی MULAW
نرخ نمونهبرداری صدا.
هیچ توضیحی ارائه نشده است.
همیشه روی "audio" تنظیم شود.
آدرس اینترنتی (URI) فایل صوتی.
محتوای سند
یک بلوک محتوای سند.
محتوای سند.
نوع MIME سند.
مقادیر ممکن:
-
application/pdfفرمت سند PDF
-
text/csvفرمت سند CSV
هیچ توضیحی ارائه نشده است.
همیشه روی "document" تنظیم شود.
آدرس اینترنتی (URI) سند.
محتوای تصویر
یک بلوک محتوای تصویر.
محتوای تصویر.
نوع مایم تصویر.
مقادیر ممکن:
-
image/pngفرمت تصویر PNG
-
image/jpegفرمت تصویر JPEG
-
image/webpفرمت تصویر WebP
-
image/heicفرمت تصویر HEIC
-
image/heifفرمت تصویر HEIF
-
image/gifفرمت تصویر GIF
-
image/bmpفرمت تصویر BMP
-
image/tiffفرمت تصویر TIFF
وضوح تصویر MediaResolution (اختیاری)
قطعنامه رسانهها.
مقادیر ممکن
-
lowوضوح پایین.
-
mediumوضوح متوسط.
-
highوضوح بالا.
-
ultra_highوضوح فوق العاده بالا.
هیچ توضیحی ارائه نشده است.
همیشه روی "image" تنظیم شود.
آدرس اینترنتی (URI) تصویر.
محتوای متن
یک بلوک محتوای متنی.
آرایه حاشیهنویسیها (Annotation) (اختیاری)
اطلاعات استناد برای محتوای تولید شده توسط مدل.
انواع ممکن
استناد به فایل
حاشیهنویسی استناد به فایل.
فرادادههای ارائه شده توسط کاربر در مورد متن بازیابی شده.
آدرس اینترنتی (URI) فایل.
پایان بخش منسوب، منحصر به فرد.
نام فایل.
شناسه رسانه در صورت استناد به تصویر، در صورت لزوم.
شماره صفحه سند ذکر شده، در صورت وجود.
منبع برای بخشی از متن ذکر شده است.
شروع بخش پاسخی که به این منبع نسبت داده میشود. اندیس، شروع بخش را نشان میدهد که بر حسب بایت اندازهگیری میشود.
هیچ توضیحی ارائه نشده است.
همیشه روی "file_citation" تنظیم شود.
استناد به مکان
حاشیهنویسی برای استناد به مکان.
پایان بخش منسوب، منحصر به فرد.
عنوان مکان.
شناسه مکان، با فرمت `places/{place_id}`.
آرایه review_snippets (ReviewSnippet) (اختیاری)
گزیدههایی از نظرات که برای تولید پاسخ در مورد ویژگیهای یک مکان مشخص در نقشههای گوگل استفاده میشوند.
فیلدها
شناسهی قطعه نقد و بررسی.
عنوان نقد.
لینکی که مربوط به نظر کاربر در نقشه گوگل باشد.
شروع بخش پاسخی که به این منبع نسبت داده میشود. اندیس، شروع بخش را نشان میدهد که بر حسب بایت اندازهگیری میشود.
هیچ توضیحی ارائه نشده است.
همیشه روی "place_citation" تنظیم شود.
مرجع URI آن مکان.
استناد به آدرس اینترنتی
حاشیهنویسی استناد URL.
پایان بخش منسوب، منحصر به فرد.
شروع بخش پاسخی که به این منبع نسبت داده میشود. اندیس، شروع بخش را نشان میدهد که بر حسب بایت اندازهگیری میشود.
عنوان URL.
هیچ توضیحی ارائه نشده است.
همیشه روی "url_citation" تنظیم شود.
آدرس اینترنتی (URL).
محتوای متن الزامی است.
هیچ توضیحی ارائه نشده است.
همیشه روی "text" تنظیم شود.
مثالها
صوتی
{ "type": "audio", "data": "BASE64_ENCODED_AUDIO", "mime_type": "audio/wav" }
سند
{ "type": "document", "data": "BASE64_ENCODED_DOCUMENT", "mime_type": "application/pdf" }
تصویر
{ "type": "image", "data": "BASE64_ENCODED_IMAGE", "mime_type": "image/png" }
متن
{ "type": "text", "text": "Hello, how are you?" }
ابزار
ابزاری که میتواند توسط مدل مورد استفاده قرار گیرد.
انواع ممکن
اجرای کد
ابزاری که میتواند توسط مدل برای اجرای کد استفاده شود.
هیچ توضیحی ارائه نشده است.
همیشه روی "code_execution" تنظیم شود.
جستجوی فایل
ابزاری که میتواند توسط مدل برای جستجوی فایلها استفاده شود.
جستجوی فایل، نامهای فروشگاه را برای جستجو ذخیره میکند.
فیلتر فراداده برای اعمال روی اسناد و تکههای بازیابی معنایی.
تعداد تکههای بازیابی معنایی که باید بازیابی شوند.
هیچ توضیحی ارائه نشده است.
همیشه روی "file_search" تنظیم شود.
عملکرد
ابزاری که میتواند توسط مدل مورد استفاده قرار گیرد.
شرحی از تابع.
نام تابع.
طرحواره JSON برای پارامترهای تابع.
هیچ توضیحی ارائه نشده است.
همیشه روی "function" تنظیم شود.
گوگل مپ
ابزاری که میتواند توسط مدل برای فراخوانی نقشههای گوگل استفاده شود.
اینکه آیا در نتیجه فراخوانی ابزار، توکن زمینه ویجت برگردانده شود یا خیر.
عرض جغرافیایی محل کاربر.
طول جغرافیایی موقعیت مکانی کاربر.
هیچ توضیحی ارائه نشده است.
همیشه روی "google_maps" تنظیم شود.
جستجوی گوگل
ابزاری که میتواند توسط مدل برای جستجو در گوگل استفاده شود.
انواع زمینهسازی جستجو برای فعالسازی.
مقادیر ممکن:
-
web_searchتنظیم این فیلد، جستجوی وب را فعال میکند. فقط نتایج متنی برگردانده میشوند.
-
image_searchتنظیم این فیلد، جستجوی تصویر را فعال میکند. بایتهای تصویر برگردانده میشوند.
هیچ توضیحی ارائه نشده است.
همیشه روی "google_search" تنظیم شود.
متن آدرس
ابزاری که میتواند توسط مدل برای دریافت متن URL استفاده شود.
هیچ توضیحی ارائه نشده است.
همیشه روی "url_context" تنظیم شود.
مثالها
اجرای کد
جستجوی فایل
عملکرد
گوگل مپ
جستجوی گوگل
متن آدرس
رویداد تعامل
انواع ممکن
تفکیککننده چندریختی: event_type
رویداد خطا
خطا ( اختیاری )
هیچ توضیحی ارائه نشده است.
فیلدها
یک URI که نوع خطا را مشخص میکند.
یک پیام خطا که برای انسان قابل خواندن باشد.
توکن event_id که برای از سرگیری جریان تعامل، از این رویداد، استفاده میشود.
هیچ توضیحی ارائه نشده است.
همیشه روی "error" تنظیم شود.
رویداد تکمیلشدهی تعامل
توکن event_id که برای از سرگیری جریان تعامل، از این رویداد، استفاده میشود.
هیچ توضیحی ارائه نشده است.
همیشه روی "interaction.completed" تنظیم شود.
تعامل InteractionSseEventInteraction (الزامی)
منبع تعاملی که تا حدی تکمیل شده و در انتهای جریان منتشر شده است.
فیلدها
عاملی که باید با آن تعامل داشت.
فقط خروجی. زمانی که پاسخ در قالب ISO 8601 ایجاد شده است.
الزامی. فقط خروجی. یک شناسه منحصر به فرد برای تکمیل تعامل.
مدلی که درخواست شما را تکمیل میکند.
فقط خروجی. نوع منبع.
الزامی. فقط خروجی. وضعیت تعامل.
مقادیر ممکن:
-
in_progressتعامل در حال انجام است.
-
requires_actionاین تعامل نیاز به اقدام/ورودی از سوی کاربر دارد.
-
completedتعامل تکمیل شده است.
-
failedتعامل شکست خورد.
-
cancelledتعامل لغو شد.
-
incompleteتعامل تکمیل شده است، اما شامل نتایج ناقص است (مثلاً رسیدن به max_tokens).
فقط خروجی. مراحلی که تعامل را تشکیل میدهند، در صورتی که در این رویداد گنجانده شده باشند.
فقط خروجی. زمانی که پاسخ آخرین بار در قالب ISO 8601 بهروزرسانی شده است.
کاربرد (اختیاری )
فقط خروجی. آمار مربوط به میزان استفاده از توکن درخواست تعامل.
فیلدها
آرایه cached_tokens_by_modality (ModalityTokens) (اختیاری)
تفکیک میزان استفاده از توکنهای ذخیرهشده بر اساس روش.
فیلدها
روش پاسخ (اختیاری)
روش مرتبط با شمارش توکنها.
مقادیر ممکن
-
textنشان میدهد که مدل باید متن را برگرداند.
-
imageنشان میدهد که مدل باید تصاویر را برگرداند.
-
audioنشان میدهد که مدل باید صدا را برگرداند.
-
videoنشان میدهد که مدل باید ویدیو برگرداند.
-
documentنشان میدهد که مدل باید اسناد را برگرداند.
تعداد توکنها برای روش.
آرایه grounding_tool_count (GroundingToolCount) (اختیاری)
تعداد ابزار اتصال به زمین
فیلدها
تعداد ابزار اتصال به زمین مهم است.
نوع ابزار اتصال زمین مرتبط با شمارش.
مقادیر ممکن:
-
google_searchاتصال به زمین با جستجوی وب و جستجوی تصویر گوگل، و اتصال به زمین وب برای سازمانها.
-
google_mapsاتصال به زمین با نقشههای گوگل.
آرایه input_tokens_by_modality (ModalityTokens) (اختیاری)
تفکیک استفاده از توکن ورودی بر اساس روش.
فیلدها
روش پاسخ (اختیاری)
روش مرتبط با شمارش توکنها.
مقادیر ممکن
-
textنشان میدهد که مدل باید متن را برگرداند.
-
imageنشان میدهد که مدل باید تصاویر را برگرداند.
-
audioنشان میدهد که مدل باید صدا را برگرداند.
-
videoنشان میدهد که مدل باید ویدیو برگرداند.
-
documentنشان میدهد که مدل باید اسناد را برگرداند.
تعداد توکنها برای روش.
آرایه output_tokens_by_modality (ModalityTokens) (اختیاری)
تفکیک استفاده از توکن خروجی بر اساس روش.
فیلدها
روش پاسخ (اختیاری)
روش مرتبط با شمارش توکنها.
مقادیر ممکن
-
textنشان میدهد که مدل باید متن را برگرداند.
-
imageنشان میدهد که مدل باید تصاویر را برگرداند.
-
audioنشان میدهد که مدل باید صدا را برگرداند.
-
videoنشان میدهد که مدل باید ویدیو برگرداند.
-
documentنشان میدهد که مدل باید اسناد را برگرداند.
تعداد توکنها برای روش.
آرایه tool_use_tokens_by_modality (ModalityTokens) (اختیاری)
تفکیک میزان استفاده از توکنهای ابزار بر اساس روش.
فیلدها
روش پاسخ (اختیاری)
روش مرتبط با شمارش توکنها.
مقادیر ممکن
-
textنشان میدهد که مدل باید متن را برگرداند.
-
imageنشان میدهد که مدل باید تصاویر را برگرداند.
-
audioنشان میدهد که مدل باید صدا را برگرداند.
-
videoنشان میدهد که مدل باید ویدیو برگرداند.
-
documentنشان میدهد که مدل باید اسناد را برگرداند.
تعداد توکنها برای روش.
تعداد توکنها در بخش ذخیرهشدهی اعلان (محتوای ذخیرهشده).
تعداد توکنها در اعلان (زمینه).
تعداد کل توکنها در تمام پاسخهای تولید شده.
تعداد توکنهای افکار برای مدلهای تفکر.
تعداد کل توکنها برای درخواست تعامل (درخواست + پاسخها + سایر توکنهای داخلی).
تعداد توکنهای موجود در اعلان(های) استفاده از ابزار.
رویداد ایجاد شده توسط تعامل
توکن event_id که برای از سرگیری جریان تعامل، از این رویداد، استفاده میشود.
هیچ توضیحی ارائه نشده است.
همیشه روی "interaction.created" تنظیم شود.
تعامل InteractionSseEventInteraction (الزامی)
منبع تعامل جزئی هنگام ایجاد جریان منتشر میشود.
فیلدها
عاملی که باید با آن تعامل داشت.
فقط خروجی. زمانی که پاسخ در قالب ISO 8601 ایجاد شده است.
الزامی. فقط خروجی. یک شناسه منحصر به فرد برای تکمیل تعامل.
مدلی که درخواست شما را تکمیل میکند.
فقط خروجی. نوع منبع.
الزامی. فقط خروجی. وضعیت تعامل.
مقادیر ممکن:
-
in_progressتعامل در حال انجام است.
-
requires_actionاین تعامل نیاز به اقدام/ورودی از سوی کاربر دارد.
-
completedتعامل تکمیل شده است.
-
failedتعامل شکست خورد.
-
cancelledتعامل لغو شد.
-
incompleteتعامل تکمیل شده است، اما شامل نتایج ناقص است (مثلاً رسیدن به max_tokens).
فقط خروجی. مراحلی که تعامل را تشکیل میدهند، در صورتی که در این رویداد گنجانده شده باشند.
فقط خروجی. زمانی که پاسخ آخرین بار در قالب ISO 8601 بهروزرسانی شده است.
کاربرد (اختیاری )
فقط خروجی. آمار مربوط به میزان استفاده از توکن درخواست تعامل.
فیلدها
آرایه cached_tokens_by_modality (ModalityTokens) (اختیاری)
تفکیک میزان استفاده از توکنهای ذخیرهشده بر اساس روش.
فیلدها
روش پاسخ (اختیاری)
روش مرتبط با شمارش توکنها.
مقادیر ممکن
-
textنشان میدهد که مدل باید متن را برگرداند.
-
imageنشان میدهد که مدل باید تصاویر را برگرداند.
-
audioنشان میدهد که مدل باید صدا را برگرداند.
-
videoنشان میدهد که مدل باید ویدیو برگرداند.
-
documentنشان میدهد که مدل باید اسناد را برگرداند.
تعداد توکنها برای روش.
آرایه grounding_tool_count (GroundingToolCount) (اختیاری)
تعداد ابزار اتصال به زمین
فیلدها
تعداد ابزار اتصال به زمین مهم است.
نوع ابزار اتصال زمین مرتبط با شمارش.
مقادیر ممکن:
-
google_searchاتصال به زمین با جستجوی وب و جستجوی تصویر گوگل، و اتصال به زمین وب برای سازمانها.
-
google_mapsاتصال به زمین با نقشههای گوگل.
آرایه input_tokens_by_modality (ModalityTokens) (اختیاری)
تفکیک استفاده از توکن ورودی بر اساس روش.
فیلدها
روش پاسخ (اختیاری)
روش مرتبط با شمارش توکنها.
مقادیر ممکن
-
textنشان میدهد که مدل باید متن را برگرداند.
-
imageنشان میدهد که مدل باید تصاویر را برگرداند.
-
audioنشان میدهد که مدل باید صدا را برگرداند.
-
videoنشان میدهد که مدل باید ویدیو برگرداند.
-
documentنشان میدهد که مدل باید اسناد را برگرداند.
تعداد توکنها برای روش.
آرایه output_tokens_by_modality (ModalityTokens) (اختیاری)
تفکیک استفاده از توکن خروجی بر اساس روش.
فیلدها
روش پاسخ (اختیاری)
روش مرتبط با شمارش توکنها.
مقادیر ممکن
-
textنشان میدهد که مدل باید متن را برگرداند.
-
imageنشان میدهد که مدل باید تصاویر را برگرداند.
-
audioنشان میدهد که مدل باید صدا را برگرداند.
-
videoنشان میدهد که مدل باید ویدیو برگرداند.
-
documentنشان میدهد که مدل باید اسناد را برگرداند.
تعداد توکنها برای روش.
آرایه tool_use_tokens_by_modality (ModalityTokens) (اختیاری)
تفکیک میزان استفاده از توکنهای ابزار بر اساس روش.
فیلدها
روش پاسخ (اختیاری)
روش مرتبط با شمارش توکنها.
مقادیر ممکن
-
textنشان میدهد که مدل باید متن را برگرداند.
-
imageنشان میدهد که مدل باید تصاویر را برگرداند.
-
audioنشان میدهد که مدل باید صدا را برگرداند.
-
videoنشان میدهد که مدل باید ویدیو برگرداند.
-
documentنشان میدهد که مدل باید اسناد را برگرداند.
تعداد توکنها برای روش.
تعداد توکنها در بخش ذخیرهشدهی اعلان (محتوای ذخیرهشده).
تعداد توکنها در اعلان (زمینه).
تعداد کل توکنها در تمام پاسخهای تولید شده.
تعداد توکنهای افکار برای مدلهای تفکر.
تعداد کل توکنها برای درخواست تعامل (درخواست + پاسخها + سایر توکنهای داخلی).
تعداد توکنهای موجود در اعلان(های) استفاده از ابزار.
بهروزرسانی وضعیت تعامل
توکن event_id که برای از سرگیری جریان تعامل، از این رویداد، استفاده میشود.
هیچ توضیحی ارائه نشده است.
همیشه روی "interaction.status_update" تنظیم شود.
هیچ توضیحی ارائه نشده است.
هیچ توضیحی ارائه نشده است.
مقادیر ممکن:
-
in_progressتعامل در حال انجام است.
-
requires_actionاین تعامل نیاز به اقدام/ورودی از سوی کاربر دارد.
-
completedتعامل تکمیل شده است.
-
failedتعامل شکست خورد.
-
cancelledتعامل لغو شد.
-
incompleteتعامل تکمیل شده است، اما شامل نتایج ناقص است (مثلاً رسیدن به max_tokens).
استپ دلتا
دلتا گام دلتا داده (الزامی)
هیچ توضیحی ارائه نشده است.
انواع ممکن
آرگومانهادلتا
هیچ توضیحی ارائه نشده است.
هیچ توضیحی ارائه نشده است.
همیشه روی "arguments_delta" تنظیم شود.
آدیودلتا
تعداد کانالهای صوتی
هیچ توضیحی ارائه نشده است.
هیچ توضیحی ارائه نشده است.
مقادیر ممکن:
-
audio/wavفرمت صوتی WAV
-
audio/mp3فرمت صوتی MP3
-
audio/aiffفرمت صوتی AIFF
-
audio/aacفرمت صوتی AAC
-
audio/oggفرمت صوتی OGG
-
audio/flacفرمت صوتی FLAC
-
audio/mpegفرمت صوتی MPEG
-
audio/m4aفرمت صوتی M4A
-
audio/l16فرمت صوتی L16
-
audio/opusفرمت صوتی OPUS
-
audio/alawفرمت صوتی ALAW
-
audio/mulawفرمت صوتی MULAW
نرخ نمونهبرداری صدا.
هیچ توضیحی ارائه نشده است.
همیشه روی "audio" تنظیم شود.
هیچ توضیحی ارائه نشده است.
اجرای کدCallDelta
آرگومانهای CodeExecutionCallArguments (الزامی)
هیچ توضیحی ارائه نشده است.
فیلدها
کدی که قرار است اجرا شود.
زبان برنامهنویسی «کد».
مقادیر ممکن:
-
pythonپایتون >= 3.10، با numpy و simpy در دسترس است.
یک هش امضا برای اعتبارسنجی backend.
هیچ توضیحی ارائه نشده است.
همیشه روی "code_execution_call" تنظیم شود.
دلتای نتیجه اجرای کد
هیچ توضیحی ارائه نشده است.
هیچ توضیحی ارائه نشده است.
یک هش امضا برای اعتبارسنجی backend.
هیچ توضیحی ارائه نشده است.
همیشه روی "code_execution_result" تنظیم شود.
سند دلتا
هیچ توضیحی ارائه نشده است.
هیچ توضیحی ارائه نشده است.
مقادیر ممکن:
-
application/pdfفرمت سند PDF
-
text/csvفرمت سند CSV
هیچ توضیحی ارائه نشده است.
Always set to "document" .
No description provided.
FileSearchCallDelta
A signature hash for backend validation.
No description provided.
Always set to "file_search_call" .
FileSearchResultDelta
result array (FileSearchResult) (required)
No description provided.
A signature hash for backend validation.
No description provided.
Always set to "file_search_result" .
FunctionResultDelta
Required. ID to match the ID from the function call block.
No description provided.
No description provided.
No description provided.
No description provided.
Always set to "function_result" .
GoogleMapsCallDelta
arguments GoogleMapsCallArguments (optional)
The arguments to pass to the Google Maps tool.
فیلدها
The queries to be executed.
A signature hash for backend validation.
No description provided.
Always set to "google_maps_call" .
GoogleMapsResultDelta
result array (GoogleMapsResult) (optional)
The results of the Google Maps.
فیلدها
places array (Places) (optional)
The places that were found.
فیلدها
Title of the place.
The ID of the place, in `places/{place_id}` format.
review_snippets array (ReviewSnippet) (optional)
Snippets of reviews that are used to generate answers about the features of a given place in Google Maps.
فیلدها
The ID of the review snippet.
Title of the review.
A link that corresponds to the user review on Google Maps.
URI reference of the place.
Resource name of the Google Maps widget context token.
A signature hash for backend validation.
No description provided.
Always set to "google_maps_result" .
GoogleSearchCallDelta
arguments GoogleSearchCallArguments (required)
No description provided.
فیلدها
Web search queries for the following-up web search.
A signature hash for backend validation.
No description provided.
Always set to "google_search_call" .
GoogleSearchResultDelta
No description provided.
result array (GoogleSearchResult) (required)
No description provided.
فیلدها
Web content snippet that can be embedded in a web page or an app webview.
A signature hash for backend validation.
No description provided.
Always set to "google_search_result" .
ImageDelta
No description provided.
No description provided.
Possible values:
-
image/pngPNG image format
-
image/jpegJPEG image format
-
image/webpWebP image format
-
image/heicHEIC image format
-
image/heifHEIF image format
-
image/gifGIF image format
-
image/bmpBMP image format
-
image/tiffTIFF image format
resolution MediaResolution (optional)
The resolution of the media.
Possible values
-
lowLow resolution.
-
mediumMedium resolution.
-
highHigh resolution.
-
ultra_highUltra high resolution.
No description provided.
Always set to "image" .
No description provided.
TextAnnotationDelta
annotations array (Annotation) (optional)
Citation information for model-generated content.
Possible Types
FileCitation
A file citation annotation.
User provided metadata about the retrieved context.
The URI of the file.
End of the attributed segment, exclusive.
The name of the file.
Media ID in-case of image citations, if applicable.
Page number of the cited document, if applicable.
Source attributed for a portion of the text.
Start of segment of the response that is attributed to this source. Index indicates the start of the segment, measured in bytes.
No description provided.
Always set to "file_citation" .
PlaceCitation
A place citation annotation.
End of the attributed segment, exclusive.
Title of the place.
The ID of the place, in `places/{place_id}` format.
review_snippets array (ReviewSnippet) (optional)
Snippets of reviews that are used to generate answers about the features of a given place in Google Maps.
فیلدها
The ID of the review snippet.
Title of the review.
A link that corresponds to the user review on Google Maps.
Start of segment of the response that is attributed to this source. Index indicates the start of the segment, measured in bytes.
No description provided.
Always set to "place_citation" .
URI reference of the place.
UrlCitation
A URL citation annotation.
End of the attributed segment, exclusive.
Start of segment of the response that is attributed to this source. Index indicates the start of the segment, measured in bytes.
The title of the URL.
No description provided.
Always set to "url_citation" .
The URL.
No description provided.
Always set to "text_annotation_delta" .
TextDelta
No description provided.
No description provided.
Always set to "text" .
ThoughtSignatureDelta
Signature to match the backend source to be part of the generation.
No description provided.
Always set to "thought_signature" .
ThoughtSummaryDelta
A new summary item to be added to the thought.
No description provided.
Always set to "thought_summary" .
UrlContextCallDelta
arguments UrlContextCallArguments (required)
No description provided.
فیلدها
The URLs to fetch.
A signature hash for backend validation.
No description provided.
Always set to "url_context_call" .
UrlContextResultDelta
No description provided.
result array (UrlContextResult) (required)
No description provided.
فیلدها
The status of the URL retrieval.
Possible values:
-
successUrl retrieval is successful.
-
errorUrl retrieval is failed due to error.
-
paywallUrl retrieval is failed because the content is behind paywall.
-
unsafeUrl retrieval is failed because the content is unsafe.
The URL that was fetched.
A signature hash for backend validation.
No description provided.
Always set to "url_context_result" .
The event_id token to be used to resume the interaction stream, from this event.
No description provided.
Always set to "step.delta" .
No description provided.
metadata StepDeltaMetadata (optional)
No description provided.
فیلدها
total_usage Usage (optional)
Statistics on the interaction request's token usage.
فیلدها
cached_tokens_by_modality array (ModalityTokens) (optional)
A breakdown of cached token usage by modality.
فیلدها
modality ResponseModality (optional)
The modality associated with the token count.
Possible values
-
textIndicates the model should return text.
-
imageIndicates the model should return images.
-
audioIndicates the model should return audio.
-
videoIndicates the model should return video.
-
documentIndicates the model should return documents.
Number of tokens for the modality.
grounding_tool_count array (GroundingToolCount) (optional)
Grounding tool count.
فیلدها
The number of grounding tool counts.
The grounding tool type associated with the count.
Possible values:
-
google_searchGrounding with Google Web Search and Image Search, & Web Grounding for Enterprise.
-
google_mapsGrounding with Google Maps.
input_tokens_by_modality array (ModalityTokens) (optional)
A breakdown of input token usage by modality.
فیلدها
modality ResponseModality (optional)
The modality associated with the token count.
Possible values
-
textIndicates the model should return text.
-
imageIndicates the model should return images.
-
audioIndicates the model should return audio.
-
videoIndicates the model should return video.
-
documentIndicates the model should return documents.
Number of tokens for the modality.
output_tokens_by_modality array (ModalityTokens) (optional)
A breakdown of output token usage by modality.
فیلدها
modality ResponseModality (optional)
The modality associated with the token count.
Possible values
-
textIndicates the model should return text.
-
imageIndicates the model should return images.
-
audioIndicates the model should return audio.
-
videoIndicates the model should return video.
-
documentIndicates the model should return documents.
Number of tokens for the modality.
tool_use_tokens_by_modality array (ModalityTokens) (optional)
A breakdown of tool-use token usage by modality.
فیلدها
modality ResponseModality (optional)
The modality associated with the token count.
Possible values
-
textIndicates the model should return text.
-
imageIndicates the model should return images.
-
audioIndicates the model should return audio.
-
videoIndicates the model should return video.
-
documentIndicates the model should return documents.
Number of tokens for the modality.
Number of tokens in the cached part of the prompt (the cached content).
Number of tokens in the prompt (context).
Total number of tokens across all the generated responses.
Number of tokens of thoughts for thinking models.
Total token count for the interaction request (prompt + responses + other internal tokens).
Number of tokens present in tool-use prompt(s).
StepStart
The event_id token to be used to resume the interaction stream, from this event.
No description provided.
Always set to "step.start" .
No description provided.
No description provided.
StepStop
The event_id token to be used to resume the interaction stream, from this event.
No description provided.
Always set to "step.stop" .
No description provided.
step_usage Usage (optional)
Model usage stats for this specific step.
فیلدها
cached_tokens_by_modality array (ModalityTokens) (optional)
A breakdown of cached token usage by modality.
فیلدها
modality ResponseModality (optional)
The modality associated with the token count.
Possible values
-
textIndicates the model should return text.
-
imageIndicates the model should return images.
-
audioIndicates the model should return audio.
-
videoIndicates the model should return video.
-
documentIndicates the model should return documents.
Number of tokens for the modality.
grounding_tool_count array (GroundingToolCount) (optional)
Grounding tool count.
فیلدها
The number of grounding tool counts.
The grounding tool type associated with the count.
Possible values:
-
google_searchGrounding with Google Web Search and Image Search, & Web Grounding for Enterprise.
-
google_mapsGrounding with Google Maps.
input_tokens_by_modality array (ModalityTokens) (optional)
A breakdown of input token usage by modality.
فیلدها
modality ResponseModality (optional)
The modality associated with the token count.
Possible values
-
textIndicates the model should return text.
-
imageIndicates the model should return images.
-
audioIndicates the model should return audio.
-
videoIndicates the model should return video.
-
documentIndicates the model should return documents.
Number of tokens for the modality.
output_tokens_by_modality array (ModalityTokens) (optional)
A breakdown of output token usage by modality.
فیلدها
modality ResponseModality (optional)
The modality associated with the token count.
Possible values
-
textIndicates the model should return text.
-
imageIndicates the model should return images.
-
audioIndicates the model should return audio.
-
videoIndicates the model should return video.
-
documentIndicates the model should return documents.
Number of tokens for the modality.
tool_use_tokens_by_modality array (ModalityTokens) (optional)
A breakdown of tool-use token usage by modality.
فیلدها
modality ResponseModality (optional)
The modality associated with the token count.
Possible values
-
textIndicates the model should return text.
-
imageIndicates the model should return images.
-
audioIndicates the model should return audio.
-
videoIndicates the model should return video.
-
documentIndicates the model should return documents.
Number of tokens for the modality.
Number of tokens in the cached part of the prompt (the cached content).
Number of tokens in the prompt (context).
Total number of tokens across all the generated responses.
Number of tokens of thoughts for thinking models.
Total token count for the interaction request (prompt + responses + other internal tokens).
Number of tokens present in tool-use prompt(s).
usage Usage (optional)
Cumulative model usage stats from the start of the session.
فیلدها
cached_tokens_by_modality array (ModalityTokens) (optional)
A breakdown of cached token usage by modality.
فیلدها
modality ResponseModality (optional)
The modality associated with the token count.
Possible values
-
textIndicates the model should return text.
-
imageIndicates the model should return images.
-
audioIndicates the model should return audio.
-
videoIndicates the model should return video.
-
documentIndicates the model should return documents.
Number of tokens for the modality.
grounding_tool_count array (GroundingToolCount) (optional)
Grounding tool count.
فیلدها
The number of grounding tool counts.
The grounding tool type associated with the count.
Possible values:
-
google_searchGrounding with Google Web Search and Image Search, & Web Grounding for Enterprise.
-
google_mapsGrounding with Google Maps.
input_tokens_by_modality array (ModalityTokens) (optional)
A breakdown of input token usage by modality.
فیلدها
modality ResponseModality (optional)
The modality associated with the token count.
Possible values
-
textIndicates the model should return text.
-
imageIndicates the model should return images.
-
audioIndicates the model should return audio.
-
videoIndicates the model should return video.
-
documentIndicates the model should return documents.
Number of tokens for the modality.
output_tokens_by_modality array (ModalityTokens) (optional)
A breakdown of output token usage by modality.
فیلدها
modality ResponseModality (optional)
The modality associated with the token count.
Possible values
-
textIndicates the model should return text.
-
imageIndicates the model should return images.
-
audioIndicates the model should return audio.
-
videoIndicates the model should return video.
-
documentIndicates the model should return documents.
Number of tokens for the modality.
tool_use_tokens_by_modality array (ModalityTokens) (optional)
A breakdown of tool-use token usage by modality.
فیلدها
modality ResponseModality (optional)
The modality associated with the token count.
Possible values
-
textIndicates the model should return text.
-
imageIndicates the model should return images.
-
audioIndicates the model should return audio.
-
videoIndicates the model should return video.
-
documentIndicates the model should return documents.
Number of tokens for the modality.
Number of tokens in the cached part of the prompt (the cached content).
Number of tokens in the prompt (context).
Total number of tokens across all the generated responses.
Number of tokens of thoughts for thinking models.
Total token count for the interaction request (prompt + responses + other internal tokens).
Number of tokens present in tool-use prompt(s).
مثالها
Error Event
{ "error": { "code": "not_found", "message": "Failed to get completed interaction: Result not found." }, "event_type": "error" }
Interaction Completed
{ "event_id": "evt_123", "event_type": "interaction.completed", "interaction": { "created": "2025-12-04T15:01:45Z", "id": "v1_ChdXS0l4YWZXTk9xbk0xZThQczhEcmlROBIXV0tJeGFmV05PcW5NMWU4UHM4RHJpUTg", "model": "gemini-3.6-flash", "status": "completed", "updated": "2025-12-04T15:01:45Z" } }
Interaction Completed
{ "event_id": "evt_123", "event_type": "interaction.completed", "interaction": { "created": "2025-12-04T15:01:45Z", "id": "v1_ChdXS0l4YWZXTk9xbk0xZThQczhEcmlROBIXV0tJeGFmV05PcW5NMWU4UHM4RHJpUTg", "model": "gemini-3-flash-preview", "object": "interaction", "status": "completed", "updated": "2025-12-04T15:01:45Z" } }
Interaction Created
{ "event_id": "evt_123", "event_type": "interaction.created", "interaction": { "created": "2025-12-04T15:01:45Z", "id": "v1_ChdXS0l4YWZXTk9xbk0xZThQczhEcmlROBIXV0tJeGFmV05PcW5NMWU4UHM4RHJpUTg", "model": "gemini-3.6-flash", "status": "in_progress", "updated": "2025-12-04T15:01:45Z" } }
Interaction Created
{ "event_id": "evt_123", "event_type": "interaction.created", "interaction": { "id": "v1_ChdXS0l4YWZXTk9xbk0xZThQczhEcmlROBIXV0tJeGFmV05PcW5NMWU4UHM4RHJpUTg", "model": "gemini-3-flash-preview", "object": "interaction", "status": "in_progress" } }
Interaction Status Update
{ "event_type": "interaction.status_update", "interaction_id": "v1_ChdTMjQ0YWJ5TUF1TzcxZThQdjRpcnFRcxIXUzI0NGFieU1BdU83MWU4UHY0aXJxUXM", "status": "in_progress" }
Step Delta
{ "delta": { "type": "text", "text": "Hello" }, "event_type": "step.delta", "index": 0 }
Step Start
{ "event_type": "step.start", "index": 0, "step": { "type": "model_output" } }
Step Stop
{ "event_type": "step.stop", "index": 0 }
ResponseFormat
Possible Types
AudioResponseFormat
Configuration for audio output format.
Bit rate in bits per second (bps). Only applicable for compressed formats (MP3, Opus).
The delivery mode for the audio output.
Possible values:
-
inlineAudio data is returned inline in the response.
-
uriAudio data is returned as a URI.
The MIME type of the audio output.
Possible values:
-
audio/mp3MP3 audio format.
-
audio/ogg_opusOGG Opus audio format.
-
audio/l16Raw PCM (L16) audio format.
-
audio/wavWAV audio format.
-
audio/alawA-law audio format.
-
audio/mulawMu-law audio format.
Sample rate in Hz.
No description provided.
Always set to "audio" .
ImageResponseFormat
Configuration for image output format.
The aspect ratio for the image output.
Possible values:
-
1:1نسبت تصویر ۱:۱.
-
2:32:3 aspect ratio.
-
3:23:2 aspect ratio.
-
3:43:4 aspect ratio.
-
4:3نسبت تصویر ۴:۳.
-
4:54:5 aspect ratio.
-
5:45:4 aspect ratio.
-
9:16نسبت تصویر ۹:۱۶
-
16:9نسبت تصویر ۱۶:۹.
-
21:921:9 aspect ratio.
-
1:81:8 aspect ratio.
-
8:18:1 aspect ratio.
-
1:41:4 aspect ratio.
-
4:14:1 aspect ratio.
The delivery mode for the image output.
Possible values:
-
inlineImage data is returned inline in the response.
-
uriImage data is returned as a URI.
The size of the image output.
Possible values:
-
512512px image size.
-
1K1K image size.
-
2K2K image size.
-
4K4K image size.
The MIME type of the image output.
Possible values:
-
image/jpegJPEG image format.
No description provided.
Always set to "image" .
TextResponseFormat
Configuration for text output format.
The MIME type of the text output.
Possible values:
-
application/jsonJSON output format.
-
text/plainPlain text output format.
The JSON schema that the output should conform to. Only applicable when mime_type is application/json.
No description provided.
Always set to "text" .
VideoResponseFormat
Configuration for video output format.
The aspect ratio for the video output.
Possible values:
-
16:9نسبت تصویر ۱۶:۹.
-
9:16نسبت تصویر ۹:۱۶
The delivery mode for the video output.
Possible values:
-
inlineVideo data is returned inline in the response.
-
uriVideo data is returned as a URI.
The duration for the video output.
The video output resolution. Defaults to 720p.
Possible values:
-
360p360p resolution.
-
720p720p resolution.
-
1080p1080p resolution.
-
4kوضوح تصویر 4K.
No description provided.
Always set to "video" .
مثالها
Audio Output
{ "type": "audio", "sample_rate": 24000 }
Image Output
{ "type": "image", "aspect_ratio": "16:9", "image_size": "1K", "mime_type": "image/jpeg" }
Text Output (JSON Schema)
{ "type": "text", "mime_type": "application/json", "schema": { "type": "object", "properties": { "ingredients": { "type": "array", "items": { "type": "string" } }, "recipe_name": { "type": "string" } }, "required": [ "ingredients", "recipe_name" ] } }
VideoResponseFormat
No examples available for this type.
قدم
A step in the interaction.
Possible Types
CodeExecutionCallStep
Code execution call step.
arguments CodeExecutionCallStepArguments (optional)
The arguments to pass to the code execution.
فیلدها
The code to be executed.
Programming language of the `code`.
Possible values:
-
pythonPython >= 3.10, with numpy and simpy available.
Required. A unique ID for this specific tool call.
A signature hash for backend validation.
No description provided.
Always set to "code_execution_call" .
CodeExecutionResultStep
Code execution result step.
Required. ID to match the ID from the function call block.
Whether the code execution resulted in an error.
The output of the code execution.
A signature hash for backend validation.
No description provided.
Always set to "code_execution_result" .
FileSearchCallStep
File Search call step.
Required. A unique ID for this specific tool call.
A signature hash for backend validation.
No description provided.
Always set to "file_search_call" .
FileSearchResultStep
File Search result step.
Required. ID to match the ID from the function call block.
A signature hash for backend validation.
No description provided.
Always set to "file_search_result" .
FunctionCallStep
A function tool call step.
Required. The arguments to pass to the function.
Required. A unique ID for this specific tool call.
Required. The name of the tool to call.
No description provided.
Always set to "function_call" .
FunctionResultStep
Result of a function tool call.
Required. ID to match the ID from the function call block.
Whether the tool call resulted in an error.
The name of the tool that was called.
Required. The result of the tool call.
No description provided.
Always set to "function_result" .
GoogleMapsCallStep
Google Maps call step.
arguments GoogleMapsCallStepArguments (optional)
The arguments to pass to the Google Maps tool.
فیلدها
The queries to be executed.
Required. A unique ID for this specific tool call.
A signature hash for backend validation.
No description provided.
Always set to "google_maps_call" .
GoogleMapsResultStep
Google Maps result step.
Required. ID to match the ID from the function call block.
result array (GoogleMapsResultItem) (optional)
No description provided.
فیلدها
places array (GoogleMapsResultPlaces) (optional)
No description provided.
فیلدها
No description provided.
No description provided.
review_snippets array (ReviewSnippet) (optional)
No description provided.
فیلدها
The ID of the review snippet.
Title of the review.
A link that corresponds to the user review on Google Maps.
No description provided.
No description provided.
A signature hash for backend validation.
No description provided.
Always set to "google_maps_result" .
GoogleSearchCallStep
Google Search call step.
arguments GoogleSearchCallStepArguments (optional)
The arguments to pass to Google Search.
فیلدها
Web search queries for the following-up web search.
Required. A unique ID for this specific tool call.
The type of search grounding enabled.
Possible values:
-
web_searchSetting this field enables web search. Only text results are returned.
-
image_searchSetting this field enables image search. Image bytes are returned.
A signature hash for backend validation.
No description provided.
Always set to "google_search_call" .
GoogleSearchResultStep
Google Search result step.
Required. ID to match the ID from the function call block.
Whether the Google Search resulted in an error.
result array (GoogleSearchResultItem) (optional)
The results of the Google Search.
فیلدها
Web content snippet that can be embedded in a web page or an app webview.
A signature hash for backend validation.
No description provided.
Always set to "google_search_result" .
ModelOutputStep
Output generated by the model.
No description provided.
No description provided.
Always set to "model_output" .
ThoughtStep
A thought step.
A signature hash for backend validation.
A summary of the thought.
No description provided.
Always set to "thought" .
UrlContextCallStep
URL context call step.
arguments UrlContextCallArguments (optional)
The arguments to pass to the URL context.
فیلدها
The URLs to fetch.
Required. A unique ID for this specific tool call.
A signature hash for backend validation.
No description provided.
Always set to "url_context_call" .
UrlContextResultStep
URL context result step.
Required. ID to match the ID from the function call block.
Whether the URL context resulted in an error.
result array (UrlContextResult) (optional)
The results of the URL context.
فیلدها
The status of the URL retrieval.
Possible values:
-
successUrl retrieval is successful.
-
errorUrl retrieval is failed due to error.
-
paywallUrl retrieval is failed because the content is behind paywall.
-
unsafeUrl retrieval is failed because the content is unsafe.
The URL that was fetched.
A signature hash for backend validation.
No description provided.
Always set to "url_context_result" .
UserInputStep
Input provided by the user.
No description provided.
No description provided.
Always set to "user_input" .
مثالها
CodeExecutionCallStep
{ "type": "code_execution_call", "arguments": { "code": "print(sum(range(1, 11)))" }, "id": "code_call_71021" }
CodeExecutionResultStep
{ "type": "code_execution_result", "call_id": "code_call_71021", "result": "55\n" }
FileSearchCallStep
{ "type": "file_search_call", "id": "file_call_88192" }
FileSearchResultStep
{ "type": "file_search_result", "call_id": "file_call_88192" }
FunctionCallStep
{ "name": "get_weather", "type": "function_call", "arguments": { "location": "Boston, MA" }, "id": "call_98231" }
FunctionResultStep
{ "name": "get_weather", "type": "function_result", "call_id": "call_98231", "result": [ { "type": "text", "text": "{\"weather\":\"sunny\"}" } ] }
GoogleMapsCallStep
{ "type": "google_maps_call", "arguments": { "latitude": 37.7749, "longitude": -122.4194 }, "id": "maps_call_39201" }
GoogleMapsResultStep
{ "type": "google_maps_result", "call_id": "maps_call_39201", "result": [ { "name": "Golden Gate Park", "place_id": "ChIJIQBpAG2ahYAR9R7bNdTLg8M", "rating": 4.8 } ] }
GoogleSearchCallStep
{ "type": "google_search_call", "arguments": { "query": "Who won the men's 100m in Paris 2024?" }, "id": "search_call_19201" }
GoogleSearchResultStep
{ "type": "google_search_result", "call_id": "search_call_19201", "result": [ { "title": "Paris 2024 Olympics: Noah Lyles wins men's 100m gold", "url": "https://olympics.com/en/news/paris-2024-noah-lyles-wins-mens-100m-gold", "snippet": "American Noah Lyles won the Olympic men's 100m gold medal in a photo finish." } ] }
ModelOutputStep
{ "type": "model_output", "content": [ { "type": "text", "text": "The capital of France is Paris." } ] }
ThoughtStep
{ "type": "thought", "signature": "thought_sig_abcd1234", "summary": [ { "type": "text", "text": "The model is searching Google for the capital of France." } ] }
UrlContextCallStep
{ "type": "url_context_call", "arguments": { "urls": [ "https://www.example.com" ] }, "id": "url_call_10219" }
UrlContextResultStep
{ "type": "url_context_result", "call_id": "url_call_10219", "result": [ { "title": "Example Domain", "url": "https://www.example.com", "snippet": "This domain is for use in illustrative examples in documents." } ] }
UserInputStep
{ "type": "user_input", "content": [ { "type": "text", "text": "What is the capital of France?" } ] }
ToolChoiceConfig
The tool choice configuration containing allowed tools.
فیلدها
allowed_tools AllowedTools (optional)
The allowed tools.
فیلدها
The mode of the tool choice.
Possible values:
-
autoAuto tool choice.
-
anyAny tool choice.
-
noneNo tool choice.
-
validatedValidated tool choice.
The names of the allowed tools.
مثالها
مثال
{ "allowed_tools": { "mode": "any", "tools": [ "my_tool" ] } }
ImageContent
An image content block.
فیلدها
The image content.
The mime type of the image.
Possible values:
-
image/pngPNG image format
-
image/jpegJPEG image format
-
image/webpWebP image format
-
image/heicHEIC image format
-
image/heifHEIF image format
-
image/gifGIF image format
-
image/bmpBMP image format
-
image/tiffTIFF image format
resolution MediaResolution (optional)
The resolution of the media.
Possible values
-
lowLow resolution.
-
mediumMedium resolution.
-
highHigh resolution.
-
ultra_highUltra high resolution.
No description provided.
Always set to "image" .
The URI of the image.
مثالها
تصویر
{ "type": "image", "data": "BASE64_ENCODED_IMAGE", "mime_type": "image/png" }
TextContent
A text content block.
فیلدها
annotations array (Annotation) (optional)
Citation information for model-generated content.
Possible Types
FileCitation
A file citation annotation.
User provided metadata about the retrieved context.
The URI of the file.
End of the attributed segment, exclusive.
The name of the file.
Media ID in-case of image citations, if applicable.
Page number of the cited document, if applicable.
Source attributed for a portion of the text.
Start of segment of the response that is attributed to this source. Index indicates the start of the segment, measured in bytes.
No description provided.
Always set to "file_citation" .
PlaceCitation
A place citation annotation.
End of the attributed segment, exclusive.
Title of the place.
The ID of the place, in `places/{place_id}` format.
review_snippets array (ReviewSnippet) (optional)
Snippets of reviews that are used to generate answers about the features of a given place in Google Maps.
فیلدها
The ID of the review snippet.
Title of the review.
A link that corresponds to the user review on Google Maps.
Start of segment of the response that is attributed to this source. Index indicates the start of the segment, measured in bytes.
No description provided.
Always set to "place_citation" .
URI reference of the place.
UrlCitation
A URL citation annotation.
End of the attributed segment, exclusive.
Start of segment of the response that is attributed to this source. Index indicates the start of the segment, measured in bytes.
The title of the URL.
No description provided.
Always set to "url_citation" .
The URL.
Required. The text content.
No description provided.
Always set to "text" .
مثالها
متن
{ "type": "text", "text": "Hello, how are you?" }