Gemini Robotics ER 1.5

Gemini Robotics ER 1.5 ist ein Vision-Language-Modell (VLM), das die agentischen Funktionen von Gemini in die Robotik bringt. Es wurde für komplexes Reasoning in der physischen Welt entwickelt und ermöglicht es Robotern, komplexe visuelle Daten zu interpretieren, räumliche Schlussfolgerungen zu ziehen und Aktionen aus Befehlen in natürlicher Sprache zu planen.

Dokumentation

Auf der Seite Robotik finden Sie eine vollständige Übersicht der Funktionen.

gemini-robotics-er-1.5-preview

Attribut Beschreibung
Modellcode gemini-robotics-er-1.5-preview
Unterstützte Datentypen

Eingaben

Text, Bilder, Video, Audio

Ausgabe

Text

Token limits[*]

Tokenlimit für Eingaben

1.048.576

Tokenlimit für Ausgaben

65.536

Funktionen

Audiogenerierung

Nicht unterstützt

Caching

Nicht unterstützt

Code-Ausführung

Unterstützt

Funktionsaufrufe

Unterstützt

Fundierung mit Google Maps

Nicht unterstützt

Bildgenerierung

Nicht unterstützt

Live-API

Nicht unterstützt

Suchfundierung

Unterstützt

Strukturierte Ausgaben

Unterstützt

Antwort wird generiert

Unterstützt

URL-Kontext

Unterstützt

Verbrauchsoptionen

Batch API

Nicht unterstützt

Flex-Inferenz

Nicht unterstützt

Prioritätsinferenz

Nicht unterstützt

Versionen
Weitere Informationen finden Sie unter Modellversionsmuster.
  • Vorschau für: gemini-robotics-er-1.5-preview
Letzte Aktualisierung September 2025
Wissensstand Januar 2025