Gemini Robotics ER 1.5

Gemini Robotics ER 1.5

Gemini의 에이전트 능력을 로보틱스로 확장한 비전-언어 모델(VLM)이에요. 물리적 세계에서의 고급 추론을 위해 설계되어, 자연어 명령으로 동작을 계획할 수 있게 도와줘요.

출처: 원문

본문

Gemini Robotics ER 1.5는 Gemini의 에이전트 능력을 로보틱스에 적용한 비전-언어 모델(VLM)이에요. 물리적 세계에서의 고급 추론을 위해 설계되어, 로봇이 복잡한 시각 데이터를 해석하고 공간 추론을 수행하며 자연어 명령으로 동작을 계획할 수 있게 해줘요.

참고: 이 버전은 곧 지원 종료될 예정이에요. 최신 모델 버전은 모델 페이지에서 확인하세요.

Google AI Studio에서 직접 사용해 볼 수 있어요.

문서

전체 기능과 사용법은 Robotics 페이지에서 확인할 수 있어요.

gemini-robotics-er-1.5-preview

속성 설명
모델 코드 gemini-robotics-er-1.5-preview
지원 데이터 타입 입력: 텍스트, 이미지, 비디오, 오디오 / 출력: 텍스트
토큰 한도 [*] 입력 토큰 한도 1,048,576 / 출력 토큰 한도 65,536
기능 오디오 생성 미지원 / 캐싱 미지원 / 코드 실행 지원 / 함수 호출 지원 / Google Maps 접지 미지원 / 이미지 생성 미지원 / Live API 미지원 / 검색 접지 지원 / 구조화 출력 지원 / Thinking 지원 / URL 컨텍스트 지원
소비 옵션 Batch API 미지원 / Flex 추론 미지원 / Priority 추론 미지원
버전 모델 버전 패턴 참고. Preview: gemini-robotics-er-1.5-preview
최근 업데이트 2025년 9월
지식 컷오프 2025년 1월

더 알아보기 (Learn more)