Gemini Robotics ER 1.5
Gemini Robotics ER 1.5
Gemini의 에이전트 능력을 로보틱스로 확장한 비전-언어 모델(VLM)이에요. 물리적 세계에서의 고급 추론을 위해 설계되어, 자연어 명령으로 동작을 계획할 수 있게 도와줘요.
출처: 원문
본문
Gemini Robotics ER 1.5는 Gemini의 에이전트 능력을 로보틱스에 적용한 비전-언어 모델(VLM)이에요. 물리적 세계에서의 고급 추론을 위해 설계되어, 로봇이 복잡한 시각 데이터를 해석하고 공간 추론을 수행하며 자연어 명령으로 동작을 계획할 수 있게 해줘요.
참고: 이 버전은 곧 지원 종료될 예정이에요. 최신 모델 버전은 모델 페이지에서 확인하세요.
Google AI Studio에서 직접 사용해 볼 수 있어요.
문서
전체 기능과 사용법은 Robotics 페이지에서 확인할 수 있어요.
gemini-robotics-er-1.5-preview
| 속성 | 설명 |
|---|---|
| 모델 코드 | gemini-robotics-er-1.5-preview |
| 지원 데이터 타입 | 입력: 텍스트, 이미지, 비디오, 오디오 / 출력: 텍스트 |
| 토큰 한도 [*] | 입력 토큰 한도 1,048,576 / 출력 토큰 한도 65,536 |
| 기능 | 오디오 생성 미지원 / 캐싱 미지원 / 코드 실행 지원 / 함수 호출 지원 / Google Maps 접지 미지원 / 이미지 생성 미지원 / Live API 미지원 / 검색 접지 지원 / 구조화 출력 지원 / Thinking 지원 / URL 컨텍스트 지원 |
| 소비 옵션 | Batch API 미지원 / Flex 추론 미지원 / Priority 추론 미지원 |
| 버전 | 모델 버전 패턴 참고. Preview: gemini-robotics-er-1.5-preview |
| 최근 업데이트 | 2025년 9월 |
| 지식 컷오프 | 2025년 1월 |