Gemini Robotics ER 2 (เวอร์ชันตัวอย่าง)

Gemini Robotics ER 2 เป็นโมเดลวิทัศน์ภาษา (VLM) สำหรับหุ่นยนต์ที่ รับอินพุตข้อความ รูปภาพ วิดีโอ และเสียง โดยรองรับการใช้เหตุผลเชิงพื้นที่ การทำความเข้าใจวิดีโอ การดำเนินการโค้ดแบบเอเจนต์ การจัดระเบียบเครื่องมือแบบหลายขั้นตอน และการประสานงานหุ่นยนต์หลายตัว

เอกสารประกอบ

ไปที่หน้าหุ่นยนต์เพื่อดูข้อมูลทั้งหมด เกี่ยวกับฟีเจอร์และความสามารถ

gemini-robotics-er-2-preview

Gemini Robotics ER 2 (เวอร์ชันตัวอย่าง)

พร็อพเพอร์ตี้ คำอธิบาย
รหัสโมเดล gemini-robotics-er-2-preview
ประเภทข้อมูลที่รองรับ

อินพุต

ข้อความ รูปภาพ วิดีโอ เสียง

เอาต์พุต

ข้อความ

ขีดจำกัดของโทเค็น[*]

ขีดจำกัดโทเค็นอินพุต

131,072

ขีดจำกัดโทเค็นเอาต์พุต

65,536

ความสามารถ

การสร้างเสียง

สิ่งที่ทำไม่ได้

การแคช

สิ่งที่ทำได้

การเรียกใช้โค้ด

สิ่งที่ทำได้

การใช้คอมพิวเตอร์

สิ่งที่ทำได้

การค้นหาไฟล์

สิ่งที่ทำได้

การเรียกใช้ฟังก์ชัน

สิ่งที่ทำได้

การเชื่อมต่อแหล่งข้อมูลกับ Google Maps

สิ่งที่ทำได้

การสร้างรูปภาพ

สิ่งที่ทำไม่ได้

Live API

สิ่งที่ทำไม่ได้

การเชื่อมต่อแหล่งข้อมูลของ Search

สิ่งที่ทำได้

เอาต์พุตที่มีโครงสร้าง

สิ่งที่ทำได้

การคิด

สิ่งที่ทำได้

บริบทของ URL

สิ่งที่ทำได้

ตัวเลือกการรับชม

Batch API

สิ่งที่ทำได้

การอนุมานแบบยืดหยุ่น

สิ่งที่ทำไม่ได้

การอนุมานตามลำดับความสำคัญ

สิ่งที่ทำไม่ได้

เวอร์ชัน
อ่านรายละเอียดเพิ่มเติมได้ในรูปแบบเวอร์ชันของโมเดล
  • ตัวอย่าง: gemini-robotics-er-2-preview
การอัปเดตล่าสุด กรกฎาคม 2026
การ์ดโมเดล การ์ดโมเดล

Gemini Robotics ER 2 Streaming Preview

พร็อพเพอร์ตี้ คำอธิบาย
รหัสโมเดล gemini-robotics-er-2-streaming-preview
ประเภทข้อมูลที่รองรับ

อินพุต

ข้อความ รูปภาพ วิดีโอ เสียง

เอาต์พุต

ข้อความ

ขีดจำกัดของโทเค็น[*]

ขีดจำกัดโทเค็นอินพุต

131,072

ขีดจำกัดโทเค็นเอาต์พุต

65,536

ความสามารถ

การสร้างเสียง

สิ่งที่ทำไม่ได้

การแคช

สิ่งที่ทำไม่ได้

การเรียกใช้โค้ด

สิ่งที่ทำไม่ได้

การใช้คอมพิวเตอร์

สิ่งที่ทำไม่ได้

การค้นหาไฟล์

สิ่งที่ทำไม่ได้

การเรียกใช้ฟังก์ชัน

สิ่งที่ทำได้

การเชื่อมต่อแหล่งข้อมูลกับ Google Maps

สิ่งที่ทำไม่ได้

การสร้างรูปภาพ

สิ่งที่ทำไม่ได้

Live API

สิ่งที่ทำได้

การเชื่อมต่อแหล่งข้อมูลของ Search

สิ่งที่ทำได้

เอาต์พุตที่มีโครงสร้าง

สิ่งที่ทำไม่ได้

การคิด

สิ่งที่ทำได้

บริบทของ URL

สิ่งที่ทำไม่ได้

ตัวเลือกการรับชม

Batch API

สิ่งที่ทำไม่ได้

การอนุมานแบบยืดหยุ่น

สิ่งที่ทำไม่ได้

การอนุมานตามลำดับความสำคัญ

สิ่งที่ทำไม่ได้

เวอร์ชัน
อ่านรายละเอียดเพิ่มเติมได้ในรูปแบบเวอร์ชันของโมเดล
  • ตัวอย่าง: gemini-robotics-er-2-streaming-preview
การอัปเดตล่าสุด กรกฎาคม 2026
การ์ดโมเดล การ์ดโมเดล

Gemini Robotics ER 1.6 (เวอร์ชันตัวอย่าง)

พร็อพเพอร์ตี้ คำอธิบาย
รหัสโมเดล gemini-robotics-er-1.6-preview
ประเภทข้อมูลที่รองรับ

อินพุต

ข้อความ รูปภาพ วิดีโอ เสียง

เอาต์พุต

ข้อความ

ขีดจำกัดของโทเค็น[*]

ขีดจำกัดโทเค็นอินพุต

131,072

ขีดจำกัดโทเค็นเอาต์พุต

65,536

ความสามารถ

การสร้างเสียง

สิ่งที่ทำไม่ได้

การแคช

สิ่งที่ทำได้

การเรียกใช้โค้ด

สิ่งที่ทำได้

การใช้คอมพิวเตอร์

สิ่งที่ทำได้

การค้นหาไฟล์

สิ่งที่ทำได้

การเรียกใช้ฟังก์ชัน

สิ่งที่ทำได้

การเชื่อมต่อแหล่งข้อมูลกับ Google Maps

สิ่งที่ทำได้

การสร้างรูปภาพ

สิ่งที่ทำไม่ได้

Live API

สิ่งที่ทำไม่ได้

การเชื่อมต่อแหล่งข้อมูลของ Search

สิ่งที่ทำได้

เอาต์พุตที่มีโครงสร้าง

สิ่งที่ทำได้

การคิด

สิ่งที่ทำได้

บริบทของ URL

สิ่งที่ทำได้

ตัวเลือกการรับชม

Batch API

สิ่งที่ทำได้

การอนุมานแบบยืดหยุ่น

สิ่งที่ทำไม่ได้

การอนุมานตามลำดับความสำคัญ

สิ่งที่ทำไม่ได้

เวอร์ชัน
อ่านรายละเอียดเพิ่มเติมได้ในรูปแบบเวอร์ชันของโมเดล
  • ตัวอย่าง: gemini-robotics-er-1.6-preview
การอัปเดตล่าสุด ธันวาคม 2025
การตัดข้อมูล มกราคม 2025