SCDP: Learning Humanoid Locomotion from Partial Observations via Mixed-Observation Distillation

저자: Milo Carroll, Tianhu Peng, Lingfan Bao, Chengxu Zhou, Zhibin Li | 날짜: 2026-03-10 | URL: https://arxiv.org/abs/2603.09574 📄 PDF


⚠️ 이 페이지의 요약·평가·해설은 생성형 AI(Claude)가 자동 생성한 2차적 분석물입니다. 논문 원문의 저작권은 원저작자에게 있으며, 정확한 내용은 원문(위 DOI·arXiv 등 출처)을 확인하세요.

라이선스: CC BY

Essence

Figure 2

Fig. 2: Sensor-Conditioned Diffusion Policies (SCDP) architecture and training framework. The state-action diffusion

온보드 센서만으로 휴머노이드 보행을 학습하기 위해 mixed-observation distillation을 사용하는 SCDP(Sensor-Conditioned Diffusion Policies)를 제안하며, diffusion model이 센서 이력에 조건화되면서 privileged 미래 상태-행동 궤적을 예측하도록 학습한다.

Motivation

Achievement

Figure 1

Fig. 1: Deployment of Sensor-Conditioned Diffusion Policies

How

Figure 2

Fig. 2: Sensor-Conditioned Diffusion Policies (SCDP) architecture and training framework. The state-action diffusion

Originality

Limitation & Further Study

Evaluation

Novelty: 4/5 Technical Soundness: 3/5 Significance: 4/5 Clarity: 4/5 Overall: 4/5

총평: Mixed-observation distillation은 개념적으로 우수한 해결책이며, 실로봇 배포까지 달성한 점이 높게 평가된다. 다만 일반화 범위와 센서 robustness 측면의 추가 검증이 필요하며, IROS 채택으로 인정된 견고한 연구이다.

같이 보면 좋은 논문

다른 접근인간형 로봇의 거친 지형 보행을 위한 지각 기반 강화학습 방법으로 유사한 문제를 다룬다.
다른 접근부분 관측 환경에서의 휴머노이드 보행을 위한 유사한 센서 기반 접근법을 제시한다.
다른 접근휴머노이드 로봇의 전신 보행 제어를 위한 강화학습 기반의 유사한 연구이다.
다른 접근온보드 센서만을 활용한 휴머노이드 로봇의 보행 학습을 다루는 관련 연구이다.
다른 접근diffusion model을 활용한 휴머노이드 동작 제어를 위한 유사한 접근법을 제안한다.
다른 접근센서 조건화된 정책 학습을 통한 로봇 보행 제어의 관련 연구이다.
← 목록으로 돌아가기

🎧 Audio Overview

이 논문 리뷰를 팟캐스트형 오디오로 생성합니다. (Gemini · 키는 브라우저에만 저장 · 완성본은 이메일로도 전송)
▸ 고급: 구성 방향(대본 작성 지침) 직접 수정
속도 1.0x
⬇ MP3 다운로드