تفکر گسترده زنده Gemini 3.8

مدل Gemini 3.8 Live Extended Thinking که یک مدل تبدیل صوت به صوت با استدلال بالا است، زمانی توصیه می‌شود که برای حل مسائل پیچیده و چند مرحله‌ای در طول تعاملات صوتی بلادرنگ، به استدلال پس‌زمینه‌ای بالاتری نیاز باشد. این مدل، استدلال پس‌زمینه‌ای و فراخوانی‌های ابزار ناهمزمان را همزمان با پخش مداوم پاسخ‌های صوتی پردازش می‌کند.

مستندات

برای پوشش کامل ویژگی‌ها و قابلیت‌ها، از راهنمای Live API دیدن کنید.

gemini-3.8-live-extended-thinking

ملک توضیحات
کد مدل gemini-3.8-live-extended-thinking
انواع داده پشتیبانی شده را

ورودی‌ها

متن، تصویر، صدا، ویدئو

خروجی

متن و صدا

محدودیت‌های توکن [*]

محدودیت توکن ورودی

۱۳۱,۰۷۲

محدودیت توکن خروجی

۶۵,۵۳۶

قابلیت‌های

تولید صدا

پشتیبانی شده

ذخیره سازی

پشتیبانی نمی‌شود

اجرای کد

پشتیبانی نمی‌شود

جستجوی فایل

پشتیبانی نمی‌شود

فراخوانی تابع

پشتیبانی می‌شود (فقط ناهمگام)

اتصال به زمین با نقشه‌های گوگل

پشتیبانی نمی‌شود

تولید تصویر

پشتیبانی نمی‌شود

API زنده

پشتیبانی شده

جستجوی اتصال به زمین

پشتیبانی شده

خروجی‌های ساختاریافته

پشتیبانی نمی‌شود

تفکر

پشتیبانی شده

زمینه URL

پشتیبانی نمی‌شود

گزینه‌های مصرف

API دسته‌ای

پشتیبانی نمی‌شود

نسخه
برای جزئیات بیشتر ، الگوهای نسخه مدل را مطالعه کنید.
  • پایدار: gemini-3.8-live-extended-thinking
آخرین به‌روزرسانی سپتامبر ۲۰۲۶
کارت مدل کارت مدل

ارتقا به Gemini 3.8 Live Extended Thinking

Gemini 3.8 Live Extended Thinking استدلال پس‌زمینه را در طول جلسات صوتی زنده معرفی می‌کند. هنگام ادغام این مدل، مدیریت وضعیت کلاینت خود را برای مدیریت سیگنال‌های استدلال ناهمزمان به‌روزرسانی کنید:

  • پروتکل استدلال ناهمزمان : هنگام تعامل با مدل‌هایی که از استدلال ناهمزمان استفاده می‌کنند، turnComplete: true دیگر نشان نمی‌دهد که مدل بیکار است. سرور ممکن است به پردازش استدلال پس‌زمینه یا فراخوانی‌های ابزار ادامه دهد. کلاینت شما باید پس از رسیدن turnComplete: true به گوش دادن به پیام‌های بعدی سرور (مانند فراخوانی‌های ابزار یا فریم‌های صوتی) ادامه دهد.
  • نظارت بر interaction_status : از فیلد interaction_status در پیام‌های دریافتی از سرور برای تعیین وضعیت فعلی سرور استفاده کنید:
    • IN_PROGRESS : سرور به طور فعال ورودی کاربر را پردازش می‌کند، استدلال پس‌زمینه را اجرا می‌کند یا منتظر پاسخ برای فراخوانی‌های ابزار ناهمزمان است. خروجی مدل یا فراخوانی‌های ابزار اضافی ممکن است در ادامه انجام شوند.
    • IDLE : سرور تمام پردازش‌ها، استدلال‌ها و فراخوانی‌های ابزار را به پایان رسانده است. جلسه غیرفعال و منتظر ورودی کاربر است.
  • فراخوانی ناهمزمان تابع : فقط اجرای غیرهمزمان غیر مسدودکننده ( behavior: NON_BLOCKING ) پشتیبانی می‌شود. حالت مسدودکننده همزمان پشتیبانی نمی‌شود و خطای سختی را برمی‌گرداند. پیکربندی‌های زمان‌بندی تابع پشتیبانی نمی‌شوند.
  • پیکربندی تفکر : استدلال پس‌زمینه را با استفاده thinking_config در پیکربندی تنظیمات خود پیکربندی کنید ( thinking_level : low ، medium یا high ). توجه داشته باشید که MINIMAL پشتیبانی نمی‌شود.
  • به‌روزرسانی‌های محتوای کلاینت : send_client_content در کل چرخه حیات جلسه با نقش‌های صریح ( user یا model ) پشتیبانی می‌شود. تنظیم turn_complete=true بلافاصله تولید فعال را متوقف می‌کند.
  • صدای فعال : به طور دائم فعال است. تنظیم proactive_audio: false خطا برمی‌گرداند.

برای مقایسه ویژگی‌ها در تمام مدل‌های Live API، به جدول مقایسه مدل‌ها مراجعه کنید.