Gemini Robotics ER 1.5

Gemini Robotics ER 1.5 เป็นโมเดลวิสัยทัศน์และภาษา (VLM) ที่นำความสามารถด้าน Agentic AI ของ Gemini มาใช้กับหุ่นยนต์ โดยได้รับการออกแบบมาเพื่อการให้เหตุผลขั้นสูงในโลกทางกายภาพ ซึ่งช่วยให้หุ่นยนต์ตีความข้อมูลภาพที่ซับซ้อน ทำการให้เหตุผลเชิงพื้นที่ และวางแผนการดำเนินการจากคำสั่งภาษาธรรมชาติได้

เอกสารประกอบ

ไปที่หน้า หุ่นยนต์ เพื่อดูฟีเจอร์และความสามารถทั้งหมด

gemini-robotics-er-1.5-preview

พร็อพเพอร์ตี้ คำอธิบาย
รหัสโมเดล gemini-robotics-er-1.5-preview
ประเภทข้อมูลที่รองรับ

อินพุต

ข้อความ รูปภาพ วิดีโอ เสียง

เอาต์พุต

ข้อความ

ขีดจำกัดโทเค็น[*]

ขีดจำกัดโทเค็นอินพุต

1,048,576

ขีดจำกัดโทเค็นเอาต์พุต

65,536

ความสามารถ

การสร้างเสียง

ไม่รองรับ

การแคช

ไม่รองรับ

การเรียกใช้โค้ด

สิ่งที่ทำได้

การเรียกฟังก์ชัน

สิ่งที่ทำได้

การเชื่อมต่อแหล่งข้อมูลกับ Google Maps

ไม่รองรับ

การสร้างรูปภาพ

ไม่รองรับ

Live API

ไม่รองรับ

การเชื่อมต่อแหล่งข้อมูลของ Search

สิ่งที่ทำได้

เอาต์พุตที่มีโครงสร้าง

สิ่งที่ทำได้

การคิด

สิ่งที่ทำได้

บริบท URL

สิ่งที่ทำได้

ตัวเลือกการใช้

Batch API

ไม่รองรับ

การอนุมานแบบยืดหยุ่น

ไม่รองรับ

การอนุมานแบบลำดับความสำคัญ

ไม่รองรับ

เวอร์ชัน
อ่านรูปแบบเวอร์ชันโมเดลเพื่อดูรายละเอียดเพิ่มเติม
  • ตัวอย่าง: gemini-robotics-er-1.5-preview
การอัปเดตล่าสุด กันยายน 2025
การตัดความรู้ มกราคม 2025