AI Trend Notifier
EN
← wiki

$ cat wiki/models/gemini-robotics-2.md

Gemini Robotics 2

스펙

AttributeValue
DeveloperGoogle DeepMind
Released2026-07-28
Announced2026-07-28
Context windowunknown
Pricingunknown
Licenseunknown
Availability얼리 액세스 파트너십 한정 (공개되지 않음)
Full nameGemini Robotics 2 (vision-language-action 모델)
ArchitectureVLA — 휴머노이드 전신을 하나의 학습된 정책으로 제어

출시일

2026-07-28 에 3종 모델 제품군의 vision-language-action 구성원으로 발표되었다. 체화 추론 형제 모델인 Gemini Robotics ER 22026-07-30 에 뒤따랐고, 셋 중 유일하게 공개적으로 제공된다 (source).

ModelTypeAvailability
Gemini Robotics 2VLA얼리 액세스 파트너십
Gemini Robotics ER 2체화 추론 VLM공개 (Gemini API, AI Studio)
Gemini Robotics On-Device 2온디바이스 VLA얼리 액세스 파트너십

벤치마크

DeepMind 는 이 모델을 휴머노이드 전신 — 다리, 몸통, 팔, 다지 손 — 을 하나의 학습된 정책 으로 제어하는 자사 최초의 AI 로 설명한다 (source).

전신 조작, Apollo 2 휴머노이드 기준:

TaskSuccess
선반에서 집기76.3%
바닥에서 집기45.7%
정밀 손동작, SharpaWave 손 (22 자유도) 기준:
TaskSuccess
전구 풀기92%
쓰레기봉투 묶기44%
지퍼백 밀봉하기40%
전구 끼우기36%
쓰레받기 작업32%
이 편차가 곧 결과다. 전구를 빼는 일은 92% 로 거의 해결되었지만 다시 끼우는 일은 36% 이고,
변형체 조작 과제(쓰레기봉투 44%, 지퍼백 40%)는 하위권에 몰려 있다. 삽입과 변형체 조작은 이번
출시 시점에도 미해결로 남아 있다.

Gemini Robotics On-Device 2 는 형태, 센서, 자유도가 모두 다른 완전히 새로운 로봇 체화에 200 개 미만의 시연 예시로 몇 시간 안에 적응한다고 보고되었다.

활용 사례

  • 이동과 조작을 하나의 정책으로 요구하는 휴머노이드 전신 과제: 걷기, 웅크리기, 그리고 과제를 추론하면서 물체를 조작하기
  • Gemini Robotics ER 2 를 통해 조율되는 다중 로봇 협업
  • On-Device 2 변형을 통한 체화 간 전이

비교

ModelScopeAvailabilityDeveloper
Gemini Robotics 2휴머노이드 전신, 단일 정책얼리 액세스Google DeepMind
Gemini Robotics ER 1.6체화 추론 전용Gemini APIGoogle DeepMind
Robostral Navigate8B 내비게이션, 단일 RGB 카메라Mistral AI
Cosmos-H-Dreams수술 로보틱스 월드 모델Apache 2.0NVIDIA
이번 출시와 Gemini Robotics ER 1.6 를 잇는 공통 벤치마크는 없다 — ER 1.6 의 대표
수치(계기판 판독 23% → 93%)에 대응하는 값이 여기에는 없으므로 둘을 서로 순위 매길 수 없다
(source).

안전성

에이전틱 로봇 안전을 위한 오픈 벤치마크 ASIMOV-Agentic 과 함께 공개되었다 — 평가 대상 행동이 놓인 Gemini Robotics ER 2 를 보라.

Referenced by

Sources