Gemini API از ورودی PDF، از جمله اسناد طولانی (تا 3600 صفحه) پشتیبانی می کند. مدلهای Gemini فایلهای PDF را با دید بومی پردازش میکنند و بنابراین میتوانند محتوای متن و تصویر درون اسناد را درک کنند. با پشتیبانی از دید PDF بومی، مدلهای Gemini قادرند:
نمودارها، نمودارها و جداول داخل اسناد را تجزیه و تحلیل کنید
استخراج اطلاعات به فرمت های خروجی ساخت یافته
به سوالات مربوط به محتوای تصویری و متنی در اسناد پاسخ دهید
اسناد را خلاصه کنید
رونویسی محتوای سند (به عنوان مثال به HTML) با حفظ طرحبندی و قالببندی، برای استفاده در برنامههای پایین دست
این آموزش راه های ممکن برای استفاده از Gemini API برای پردازش اسناد PDF را نشان می دهد.
بعدش چی
برای کسب اطلاعات بیشتر به منابع زیر مراجعه کنید:
استراتژیهای درخواست فایل : Gemini API از درخواست با دادههای متنی، تصویری، صوتی و ویدیویی پشتیبانی میکند که به عنوان درخواست چندوجهی نیز شناخته میشود.
دستورالعملهای سیستم : دستورالعملهای سیستم به شما امکان میدهد رفتار مدل را بر اساس نیازهای خاص و موارد استفاده خود هدایت کنید.
تاریخ آخرین بهروزرسانی 2025-04-28 بهوقت ساعت هماهنگ جهانی.
[[["درک آسان","easyToUnderstand","thumb-up"],["مشکلم را برطرف کرد","solvedMyProblem","thumb-up"],["غیره","otherUp","thumb-up"]],[["اطلاعاتی که نیاز دارم وجود ندارد","missingTheInformationINeed","thumb-down"],["بیشازحد پیچیده/ مراحل بسیار زیاد","tooComplicatedTooManySteps","thumb-down"],["قدیمی","outOfDate","thumb-down"],["مشکل ترجمه","translationIssue","thumb-down"],["مشکل کد / نمونهها","samplesCodeIssue","thumb-down"],["غیره","otherDown","thumb-down"]],["تاریخ آخرین بهروزرسانی 2025-04-28 بهوقت ساعت هماهنگ جهانی."],[],[]]