Open X-Embodiment: Robotic Learning Datasets and RT-X Models

저자: Open X-Embodiment Collaboration, Abby O'Neill, Abdul Rehman, Abhinav Gupta, Abhiram Maddukuri, Abhishek Gupta, Abhishek Padalkar, Abraham Lee, Acorn Pooley, Agrim Gupta, Ajay Mandlekar, Ajinkya Jain, Albert Tung, Alex Bewley, Alex Herzog, Alex Irpan, Alexander Khazatsky, Anant Rai, Anchit Gupta, Andrew Wang, Andrey Kolobov, Anikait Singh, Animesh Garg, Aniruddha Kembhavi, Annie Xie, Anthony Brohan, Antonin Raffin, Archit Sharma, Arefeh Yavary, Arhan Jain, Ashwin Balakrishna, Ayzaan Wahid, Ben Burgess-Limerick, Beomjoon Kim, Bernhard Schölkopf, Blake Wulfe, Brian Ichter, Cewu Lu, Charles Xu, Charlotte Le, Chelsea Finn, Chen Wang, Chenfeng Xu, Cheng Chi, Chenguang Huang, Christine Chan, Christopher Agia, Chuer Pan, Chuyuan Fu, Coline Devin, Danfei Xu, Daniel Morton, Danny Driess, Daphne Chen, Deepak Pathak, Dhruv Shah, Dieter Büchler, Dinesh Jayaraman, Dmitry Kalashnikov, Dorsa Sadigh, Edward Johns, Ethan Foster, Fangchen Liu, Federico Ceola, Fei Xia, Feiyu Zhao, Felipe Vieira Frujeri, Freek Stulp, Gaoyue Zhou, Gaurav S. Sukhatme, Gautam Salhotra, Ge Yan, Gilbert Feng, Giulio Schiavi, Glen Berseth, Gregory Kahn, Guangwen Yang, Guanzhi Wang, Hao Su, Hao-Shu Fang, Haochen Shi, Henghui Bao, Heni Ben Amor, Henrik I Christensen, Hiroki Furuta, Homanga Bharadhwaj, Homer Walke, Hongjie Fang, Huy Ha, Igor Mordatch, Ilija Radosavovic, Isabel Leal, Jacky Liang, Jad Abou-Chakra, Jaehyung Kim, Jaimyn Drake, Jan Peters, Jan Schneider, Jasmine Hsu, Jay Vakil, Jeannette Bohg, Jeffrey Bingham, Jeffrey Wu, Jensen Gao, Jiaheng Hu, Jiajun Wu, Jialin Wu, Jiankai Sun, Jianlan Luo, Jiayuan Gu, Jie Tan, Jihoon Oh, Jimmy Wu, Jingpei Lu, Jingyun Yang, Jitendra Malik, João Silvério, Joey Hejna, Jonathan Booher, Jonathan Tompson, Jonathan Yang, Jordi Salvador, Joseph J. Lim, Junhyek Han, Kaiyuan Wang, Kanishka Rao, Karl Pertsch, Karol Hausman, Keegan Go, Keerthana Gopalakrishnan, Ken Goldberg, Kendra Byrne, Kenneth Oslund, Kento Kawaharazuka, Kevin Black, Kevin Lin, Kevin Zhang, Kiana Ehsani, Kiran Lekkala, Kirsty Ellis, Krishan Rana, Krishnan Srinivasan, Kuan Fang, Kunal Pratap Singh, Kuo-Hao Zeng, Kyle Hatch, Kyle Hsu, Laurent Itti, Lawrence Yunliang Chen, Lerrel Pinto, Li Fei-Fei, Liam Tan, Linxi "Jim" Fan, Lionel Ott, Lisa Lee, Luca Weihs, Magnum Chen, Marion Lepert, Marius Memmel, Masayoshi Tomizuka, Masha Itkina, Mateo Guaman Castro, Max Spero, Maximilian Du, Michael Ahn, Michael C. Yip, Mingtong Zhang, Mingyu Ding, Minho Heo, Mohan Kumar Srirama, Mohit Sharma, Moo Jin Kim, Muhammad Zubair Irshad, Naoaki Kanazawa, Nicklas Hansen, Nicolas Heess, Nikhil J Joshi, Niko Suenderhauf, Ning Liu, Norman Di Palo, Nur Muhammad Mahi Shafiullah, Oier Mees, Oliver Kroemer, Osbert Bastani, Pannag R Sanketi, Patrick "Tree" Miller, Patrick Yin, Paul Wohlhart, Peng Xu, Peter David Fagan, Peter Mitrano, Pierre Sermanet, Pieter Abbeel, Priya Sundaresan, Qiuyu Chen, Quan Vuong, Rafael Rafailov, Ran Tian, Ria Doshi, Roberto Martín-Martín, Rohan Baijal, Rosario Scalise, Rose Hendrix, Roy Lin, Runjia Qian, Ruohan Zhang, Russell Mendonca, Rutav Shah, Ryan Hoque, Ryan Julian, Samuel Bustamante, Sean Kirmani, Sergey Levine, Shan Lin, Sherry Moore, Shikhar Bahl, Shivin Dass, Shubham Sonawani, Shubham Tulsiani, Shuran Song, Sichun Xu, Siddhant Haldar, Siddharth Karamcheti, Simeon Adebola, Simon Guist, Soroush Nasiriany, Stefan Schaal, Stefan Welker, Stephen Tian, Subramanian Ramamoorthy, Sudeep Dasari, Suneel Belkhale, Sungjae Park, Suraj Nair, Suvir Mirchandani, Takayuki Osa, Tanmay Gupta, Tatsuya Harada, Tatsuya Matsushima, Ted Xiao, Thomas Kollar, Tianhe Yu, Tianli Ding, Todor Davchev, Tony Z. Zhao, Travis Armstrong, Trevor Darrell, Trinity Chung, Vidhi Jain, Vikash Kumar, Vincent Vanhoucke, Vitor Guizilini, Wei Zhan, Wenxuan Zhou, Wolfram Burgard, Xi Chen, Xiangyu Chen, Xiaolong Wang, Xinghao Zhu, Xinyang Geng, Xiyuan Liu, Xu Liangwei, Xuanlin Li, Yansong Pang, Yao Lu, Yecheng Jason Ma, Yejin Kim, Yevgen Chebotar, Yifan Zhou, Yifeng Zhu, Yilin Wu, Ying Xu, Yixuan Wang, Yonatan Bisk, Yongqiang Dou, Yoonyoung Cho, Youngwoon Lee, Yuchen Cui, Yue Cao, Yueh-Hua Wu, Yujin Tang, Yuke Zhu, Yunchu Zhang, Yunfan Jiang, Yunshuang Li, Yunzhu Li, Yusuke Iwasawa, Yutaka Matsuo, Zehan Ma, Zhuo Xu, Zichen Jeff Cui, Zichen Zhang, Zipeng Fu, Zipeng Lin | 날짜: 2023-10-13 | URL: https://arxiv.org/abs/2310.08864 📄 PDF


⚠️ 이 페이지의 요약·평가·해설은 생성형 AI(Claude)가 자동 생성한 2차적 분석물입니다. 논문 원문의 저작권은 원저작자에게 있으며, 정확한 내용은 원문(위 DOI·arXiv 등 출처)을 확인하세요.

라이선스: CC BY

Essence

Figure 1

Fig. 1: We propose an open, large-scale dataset for robot learning curated from 21 institutions across the globe. The da

21개 기관에서 수집한 22종의 로봇 데이터를 통합한 대규모 Open X-Embodiment 데이터셋을 제시하고, 이를 활용하여 여러 로봇 플랫폼에 긍정적 전이를 보이는 RT-X 범용 로봇 정책을 개발했다.

Motivation

Achievement

Figure 4

Fig. 4: RT-1-X mean success rate is 50% higher than that of either the Original Method or RT-1. RT-1 and RT-1-X have the

How

Figure 2

Fig. 2: The Open X-Embodiment Dataset. (a): the dataset consists of 60 individual datasets across 22 embodiments. (b): t

Originality

Limitation & Further Study

Evaluation

Novelty: 4/5 Technical Soundness: 3/5 Significance: 4/5 Clarity: 4/5 Overall: 4/5

총평: 로봇 학습에 대규모 X-embodiment 데이터셋과 범용 정책이라는 새로운 패러다임을 제시한 중대한 기여로, 표준화된 인프라 제공으로 향후 로봇 AI 연구의 기초를 다졌다. 다만 절대 데이터 규모와 메커니즘 이해 측면에서는 추가 발전이 필요하다.

같이 보면 좋은 논문

기반 연구Open X-Embodiment은 RT-1에 기반한 범용 로봇 데이터 및 RT-X 모델로, RT-1 이후 데이터 확장 및 기술 진전을 보여준다.
기반 연구Open X-Embodiment은 대규모 RT-X 모델과 벤치마크를 통해 다양한 사용자 환경에서 파생된 정책 평가 환경을 제공하며, TidyBot의 개인화 로봇 어시스턴트 연구에 실험적 확장을 가능하게 한다.
다른 접근Open X-Embodiment는 대규모 로봇 데이터셋과 RT-X 모델을 활용하여 시각-언어-행동 모델의 훈련 및 전이 방법에서 다른 전략을 제시한다.
다른 접근Open X-Embodiment는 다양한 로봇 조작 데이터셋과 범용 컨트롤러 개발을 지향하므로, BridgeData V2의 데이터셋 수집 및 응용 범위와의 차이를 비교해서 볼 가치가 있습니다.
다른 접근ManipBench 논문은 VLM 기반 로우레벨 정책 평가와 전이를 제공하여 Open X-Embodiment의 범용 정책 성능 평가와 다른 측면을 강조합니다.
다른 접근여러 로봇 플랫폼 간 범용 정책을 다루지만, 로봇 학습 데이터 통합 방식이 다르므로 접근법을 비교해 볼 수 있다.
후속 연구Open-World Object Manipulation 논문은 X-Embodiment 데이터셋의 활용과 오픈월드 객체 조작에 대한 실질 적용 사례를 보인다.
후속 연구RT-2 논문은 RT-X 모델의 후속 연구로, 인터넷 기반 데이터 확장 및 실제 로봇 제어 적용을 심화한다.
후속 연구Open X-Embodiment 데이터셋은 MineDreamer의 학습/평가에 있어서 멀티로봇, 대규모 trajectory 데이터 활용의 기초가 된다.
후속 연구Octo는 Open X-Embodiment 데이터와 정책 구조를 직접적으로 활용하여 개발된 대표적 extension 사례이다.
후속 연구Open X-Embodiment는 로봇 시연 데이터셋과 다양한 행동표현 학습 방법을 제공하여 Manipulate-Anything의 데이터 생성 및 활용과 직접 연결됩니다.
후속 연구OpenVLA는 Open X-Embodiment 데이터와 범용 정책을 실제 VLA 모델로 구현하여 후속 활용 사례를 제공합니다.
후속 연구Open X-Embodiment 데이터셋의 통합화, 표준화된 멀티로봇 수집전략이 RoboMIND의 4종 embodiment 데이터 구축에 이론적 토대를 제공합니다.
후속 연구Exploring Embodied Multimodal Large Models 논문은 Open X-Embodiment를 활용한 다양한 대형 모델 사례분석을 통해 RT-X를 비롯한 모델들의 응용 및 한계를 조명한다.
후속 연구Open X-Embodiment(1504)는 대규모 로봇 데이터셋과 이를 통한 범용 정책 학습 프레임워크를 제공하며, RoboBrain(1536)의 데이터 측면 기반이 된다.
후속 연구Open X-Embodiment 프로젝트는 다수 embodiment에서 데이터 표준화 및 수집 방법을 공유하여 RoboFactory의 대규모 멀티에이전트 데이터셋 설계의 기반이 됩니다.
후속 연구Cross-Platform Scaling 논문은 다양한 플랫폼에서의 VLA 모델 확장성을 다루며, X-Embodiment의 데이터 범용성 결과를 심화한다.
후속 연구Open X-Embodiment는 이종 로봇 데이터셋 및 크로스임바디먼트 정책 학습의 대표적 벤치마크로, X-VLA의 데이터 다변성과 관련 깊습니다.
← 목록으로 돌아가기

🎧 Audio Overview

이 논문 리뷰를 팟캐스트형 오디오로 생성합니다. (Gemini · 키는 브라우저에만 저장 · 완성본은 이메일로도 전송)
▸ 고급: 구성 방향(대본 작성 지침) 직접 수정
속도 1.0x
⬇ MP3 다운로드