저자: Sheikh A. Tahmid, Gennaro Notomista | 날짜: 2025 | DOI: 정보 📄 PDF
Figure 3: Robot team forming triangle while avoiding region.
본 논문은 중복성을 갖춘 로봇 시스템이 여러 제어 작업을 동시에 실행할 수 있도록 Reinforcement Learning 기반의 새로운 방법을 제안한다. 학습된 value function들 사이의 task independence 개념을 정의하고, 이를 통해 우선순위가 있는 스택 형태로 여러 작업을 결합하여 실행할 수 있는 정책을 학습한다.
Figure 3: Robot team forming triangle while avoiding region.
Figure 1: (a): Heatmap of function, ˜𝐽1, trained for avoidance
총평: 본 논문은 중복 로봇 시스템의 동시 작업 실행을 위한 혁신적인 접근법을 제시하며, 시스템 역학을 고려한 task independence의 새로운 정의와 이를 학습하기 위한 실질적인 알고리즘을 제공한다. 수학적 엄밀성과 실험 검증을 통해 실무적 가치를 보여준다.