저자: Chia-Yu Hung, Navonil Majumder, Haoyuan Deng, Liu Renhang, Yankang Ang, Amir Zadeh, Chuan Li, Dorien Herremans, Ziwei Wang, Soujanya Poria | 날짜: 2025-11-18 | URL: https://arxiv.org/abs/2511.14659 📄 PDF
Essence
Figure 1. Training pipeline of NORA-1.5 where firstly a VLA model is pre-trained through imitation learning and subseque
NORA-1.5는 flow-matching 기반 action expert를 추가하여 VLA 모델의 성능을 향상시키고, world model 및 action-based reward를 이용한 DPO 기반 post-training으로 실제 로봇 환경에서의 신뢰성과 일반화 능력을 개선한다.
Evaluation
Novelty: 4/5 Technical Soundness: 3/5 Significance: 4/5 Clarity: 4/5 Overall: 4/5
총평: NORA-1.5는 flow-matching 기반 아키텍처 개선과 경량이면서도 효과적인 reward 기반 post-training을 결합하여 VLA 모델의 신뢰성과 실제 배포 가능성을 크게 향상시킨 의미 있는 연구이다. 광범위한 벤치마크에서의 성과와 확장 가능한 post-training 방법론은 embodied AI 분야에 실질적인 기여를 한다.
같이 보면 좋은 논문
기반 연구NORA-1.5는 대규모 시뮬레이션 환경에서 학습된 범용 VLA 모델로, iGibson 1.0과 같은 시뮬 환경 기반 모델 학습이 실제 어떻게 적용되는지를 보여줍니다.
기반 연구NORA-1.5는 다양한 세계 모델 기반 데이터를 활용한 범용 VLA 훈련을 다루어, RVT의 3D 변환 기반 조작 시스템 확장에 연결점을 제공한다.
기반 연구NORA-1.5는 웹-스케일 데이터 기반 VLA 사전학습 및 fine-tuning을 다루어, GR-2와 유사한 대규모 데이터 전이 사례를 보여줍니다.
기반 연구NORA 경량 VLA 모델은 NORA-1.5의 world model 기반 DPO post-training 실험 및 경량화 VLA의 출발점이 된다.
기반 연구로봇 내비게이션 및 조작에서의 policy training과 adaptation 이슈를 다루는 Survey 논문을 통해 NORA-1.5가 겨냥하는 실세계 환경 내 신뢰성 강화 방법론의 기반을 파악할 수 있다.
기반 연구Latent Action Diffusion for Cross-Embodiment Manipulation 논문은 flow-matching 기반 action generation의 핵심 이론을 제공하여, NORA-1.5의 메커니즘 이해에 도움을 줍니다.
기반 연구NORA-1.5는 world model을 활용해 사전학습된 VLA 모델로, EO-1과 마찬가지로 학습 구조와 사전학습 데이터를 통합하는 방향을 제안합니다.
기반 연구NORA-1.5는 world model 사전학습과 이를 통한 실제 로봇 응용을 보여주므로, D2E의 데스크톱 사전학습 전이 전략과 비교 실험 관점에서 참조할 만합니다.
다른 접근NORA-1.5는 멀티태스크 및 멀티로봇 정책을 학습하는 VLA 모델로, RoboCat과의 데이터 생성 및 자기개선 전략 비교가 유용합니다.
다른 접근NORA는 작은 오픈소스 VLA 모델을 자동 확장 task generation 없이 사전정의 데이터로 학습하는 점에서 GenSim의 LLM 시뮬 데이터 자동 생성과 대비됩니다.
다른 접근NORA-1.5는 다양한 embodiment에서 동작 가능한 비전-언어-행동 모델로, HPT와 유사하게 이종 환경에서의 정책 표현과 일반화를 다룬다.
다른 접근DexVLA는 flow-matching 기반 expert를 VLA에 연결하므로, NORA-1.5의 flow-matching expert와 실제 효용 및 generalization 차이점을 분석할 수 있다.
다른 접근From Seeing to Doing 논문은 reasoning-driven VLA 아키텍처로, NORA-1.5의 diffusion 기반 행동 예측과 다른 접근법을 탐구합니다.
후속 연구Diffusion-VLA 논문은 diffusion 방식의 VLA를 제안하여, NORA-1.5의 diffusion/flow matching 기반 향상을 기술적 맥락에서 이해하는 데 도움이 된다.
후속 연구NORA-1.5는 world models 활용과 cross-embodiment VLA 학습에 대한 이론적 토대를 제공하여 Being-H0.5의 연구 배경을 보완합니다.