Gemini Robotics ER 2는 텍스트, 이미지, 동영상, 오디오 입력을 허용하는 로봇용 비전 언어 모델 (VLM)입니다. 공간 추론, 동영상 이해, 에이전트 코드 실행, 다단계 도구 오케스트레이션, 다중 로봇 조정을 지원합니다.
문서
로보틱스 페이지에서 기능 및 기능의 전체 내용을 확인하세요.
gemini-robotics-er-2-preview
Gemini Robotics ER 2 프리뷰
| 속성 | 설명 |
|---|---|
| 모델 코드 | gemini-robotics-er-2-preview |
| 지원되는 데이터 유형 |
입력 텍스트, 이미지, 동영상, 오디오 출력 텍스트 |
| 토큰 한도[*] |
입력 토큰 한도 131,072 출력 토큰 한도 65,536 |
| 기능 | 지원되지 않음 지원됨 지원됨 지원됨 지원됨 지원됨 지원됨 지원되지 않음 지원되지 않음 지원됨 지원됨 지원됨 지원됨 |
| 소비 옵션 |
지원됨 지원되지 않음 지원되지 않음 |
| 버전 |
|
| 최신 업데이트 | 2026년 7월 |
| 모델 카드 | 모델 카드 |
Gemini Robotics ER 2 스트리밍 프리뷰
| 속성 | 설명 |
|---|---|
| 모델 코드 | gemini-robotics-er-2-streaming-preview |
| 지원되는 데이터 유형 |
입력 텍스트, 이미지, 동영상, 오디오 출력 텍스트 |
| 토큰 한도[*] |
입력 토큰 한도 131,072 출력 토큰 한도 65,536 |
| 기능 | 지원되지 않음 지원되지 않음 지원되지 않음 지원되지 않음 지원되지 않음 지원됨 지원되지 않음 지원되지 않음 지원됨 지원됨 지원되지 않음 지원됨 지원되지 않음 |
| 소비 옵션 |
지원되지 않음 지원되지 않음 지원되지 않음 |
| 버전 |
|
| 최신 업데이트 | 2026년 7월 |
| 모델 카드 | 모델 카드 |
Gemini Robotics ER 1.6 프리뷰
| 속성 | 설명 |
|---|---|
| 모델 코드 | gemini-robotics-er-1.6-preview |
| 지원되는 데이터 유형 |
입력 텍스트, 이미지, 동영상, 오디오 출력 텍스트 |
| 토큰 한도[*] |
입력 토큰 한도 131,072 출력 토큰 한도 65,536 |
| 기능 | 지원되지 않음 지원됨 지원됨 지원됨 지원됨 지원됨 지원됨 지원되지 않음 지원되지 않음 지원됨 지원됨 지원됨 지원됨 |
| 소비 옵션 |
지원됨 지원되지 않음 지원되지 않음 |
| 버전 |
|
| 최신 업데이트 | 2025년 12월 |
| 지식 단절 | 2025년 1월 |