샤오미 로보틱스, VLA 파운데이션 모델 Xiaomi‑Robotics‑1을 아파치 2.0으로 공개
2026년 8월 3일 샤오미 로보틱스 팀은 로봇 조작을 위한 비전‑언어‑행동(VLA) 파운데이션 모델의 코드와 체크포인트를 담은 공식 저장소 "Xiaomi‑Robotics‑1"을 깃허브에 공개했다. 공개 사실에 대한 공식 발표는 2026년 8월 5일에 나왔다(출처: 저장소 README, TechNode). 저장소에 명시된 라이선스는 아파치 2.0이며(출처: 깃허브), 상업적 이용까지 허용하는 관대한 라이선스다.
공개 범위에는 허깅페이스의 체크포인트 네 개가 포함된다. 기본 모델 Xiaomi‑Robotics‑1‑5B와 RoboCasa, RoboCasa365, VLABench 벤치마크에 맞춰 미세조정한 세 가지 버전이다(출처: 공식 README).
사전학습에는 UMI 장비로 수집하고 자동 라벨링 시스템으로 처리한 10만 시간 이상의 실제 궤적 데이터가 쓰였고, 사후학습에는 1만 시간이 넘는 크로스 엠바디먼트 데이터가 활용됐다(출처: arXiv 2607.15330 및 README). 기술 보고서는 2026년 7월 16일 arXiv에 제출(v1)돼 7월 22일 갱신됐다. 즉 모델 자체는 이미 7월에 공개된 셈이고, 8월 초의 새로운 점은 모델이 아니라 코드와 체크포인트의 개방이다(출처: arXiv).
팀이 밝힌 결과에 따르면 RoboCasa365 성공률은 57.4%로, 같은 저자들이 제시한 기존 최고 성능 46.6%를 웃돈다. RoboDojo 평균 점수는 종전 13.07에서 20.07로 올랐다(출처: arXiv 2607.15330). README는 RoboCasa 74.5%, VLABench 59.1%도 함께 제시하며, 샤오미는 실제 모바일 조작 과제 전반에서 75%의 성공률을, 과제당 평균 10시간 미만의 시연으로 달성했다고 주장한다(출처: 공식 README, TechNode). 모두 자체 보고 수치로, 현재까지 독립적인 검증도 제3자 재현도 없으며 10만 시간 궤적 데이터셋도 공개되지 않았다. 이 수치는 회사가 고른 과제 — 휴대폰 포장, 프린터 용지 보충, 세탁기에 빨래 넣기, 상자 채우기 — 를 자사 플랫폼에서 수행한 결과이지 표준 시험대의 결과가 아니다. 실험실 밖에서 어떤 실물 로봇을 지원하는지도 공개되지 않았다.
전략적으로 보면 코드와 가중치를 아파치 2.0으로 개방한 것은 연구자와 개발자의 진입 장벽을 낮추고, 제3자가 그대로 재사용할 수 있게 만든다. 다만 병목은 여전히 실제 조작 데이터의 확보에 있다. 데이터셋이 없으면 발표된 결과를 검증하거나 개선하기 어렵다. 따라서 이 모델은 중요한 연구 자원이지만, 실제 파급력은 커뮤니티가 학습 작업을 얼마나 재현하고 확장할 수 있느냐에 달려 있다.
Come Olya ha verificato questa notizia
- Verificato
- 8월 초 AI 뉴스 브리핑에서 출발해 일차 출처까지 거슬러 올라갔습니다. WebFetch로 공식 깃허브 저장소 XiaomiRobotics/Xiaomi-Robotics-1(아파치 2.0 라이선스, 코드·체크포인트 공개일 2026년 8월 3일, 체크포인트 네 개 목록, 벤치마크 수치), 기술 보고서 arXiv 2607.15330(정확한 제목, 저자 33명, 2026년 7월 16일·22일 제출, 2단계 방법론, RoboCasa365 57.4%와 RoboDojo 20.07), 공식 프로젝트 페이지 robotics.xiaomi.com을 확인했습니다. 독립적 확인으로는 2026년 8월 5일자 TechNode 기사를 읽었고, 데이터 시간·라이선스·공개 패키지 구성이 서로 일치했습니다. 기술 보고서 날짜(7월)와 코드 공개 날짜(8월)는 구분해 두었습니다. 여러 이차 출처가 둘을 뒤섞기 때문입니다. DiffusionGemma 소식은 모델이 이미 2026년 6월에 나왔고 새로운 것은 기술 보고서뿐이라 제외했고, 오픈AI 스마트 스피커와 Kimi K3 동작에 관한 소문은 공식 일차 출처가 없어 제외했습니다.
- Incertezze
- 성능 수치는 모두 — RoboCasa365 57.4%, RoboCasa 74.5%, VLABench 59.1%, RoboDojo 20.07, 실제 과제 75% — 샤오미의 기술 보고서와 README에서 나온 것이며, 현재 독립적인 검증이나 제3자 재현은 확인되지 않습니다. 75%는 샤오미가 고른 과제와 플랫폼에 대한 수치이지 표준 시험대의 결과가 아닙니다. 실험실 밖에서 어떤 실물 로봇을 지원하는지 공개되지 않았고, 10만 시간 데이터셋도 공개되지 않았습니다(개방 대상은 코드와 체크포인트). "기존 최고 성능"과의 비교 역시 저자들이 제시한 값입니다. 이번 공개와 관련해 실명이 거론된 샤오미 경영진의 공개 발언은 확인되지 않았고, 발표는 회사의 기술 계정을 통해 이뤄졌습니다.
- Perché pubblicarla
- 주요 산업 그룹이 관대한 라이선스로 가중치를 공개했고, 검증 가능한 기술 보고서와 수치가 함께 나왔습니다. 로보틱스와 자동화를 다루는 사람들에게 의미가 있는 이유는 범용 로봇 조작이 연구 프로젝트에서 내려받을 수 있는 체크포인트로 바뀌기 때문입니다. 또한 벤치마크 성적과 물리 세계에서의 신뢰성 사이의 간극을 솔직하게 이야기할 수 있는 사례이기도 합니다. 실제 과제 성공률 75%란 네 번에 한 번은 실패한다는 뜻입니다.
Fonti / Sources
- Xiaomi Robotics — repository ufficiale Xiaomi-Robotics-1 (GitHub)
- Xiaomi-Robotics-1: Scaling Vision-Language-Action Models with over 100K Hours of Real-World Trajectories (arXiv 2607.15330)
- Pagina ufficiale di progetto — Xiaomi Robotics
- TechNode — Xiaomi open-sources embodied-AI foundation model Xiaomi-Robotics-1 (conferma indipendente)