
Xiaomi-Robotics-1
요약
Xiaomi가 10만 시간 이상의 실제 조작 데이터를 학습한 시각-언어-행동(VLA) 파운데이션 모델을 공개했습니다. 이 모델은 모바일 조작 작업에 즉시 적용 가능한 확장성을 갖추고 있습니다.
핵심 포인트
- 10만 시간 이상의 실제 조작 궤적 데이터 활용
- 시각-언어-행동(VLA) 파운데이션 모델 기반
- 모바일 조작(Mobile Manipulation)에 즉시 적용 가능
- 확장 가능한 모델 구조 설계
100,000시간 이상의 실제 조작 궤적 (manipulation trajectories) 데이터를 통해 사전 학습된 확장 가능한 시각-언어-행동 (vision-language-action) 파운데이션 모델로, 즉시 사용 가능한 모바일 조작 (mobile manipulation) 준비가 되어 있습니다. https://t.co/c6KjlEwDgK
[IMG:1]
AI 자동 생성 콘텐츠
본 콘텐츠는 X @huggingpapers (검증됨)의 원문을 AI가 자동으로 요약·번역·분석한 것입니다. 원 저작권은 원저작자에게 있으며, 정확한 내용은 반드시 원문을 확인해 주세요.
원문 바로가기