Physical AI — Paper Curation

⚠️ 이 사이트의 리뷰·요약·타임라인·Deep Research 답변은 생성형 AI가 자동 생성한 결과물입니다. 게재 논문은 arXiv·OpenReview 등 공개 프리프린트이며, 원문 저작권은 원저작자에게 있습니다.
347
리뷰 완료
6
MECE 카테고리
2026-07-20
큐레이션 일자
📡 RSS

Research Timeline

Research Timeline

Physical AI 분야는 2018년 Ha와 Schmidhuber의 World Models 논문이 생성적 신경 세계 모델(generative neural world model) 개념을 제시하면서 본격적인 학문적 토대를 마련했고, 2022년 Google의 RT-1과 SayCan, PaLM-E의 등장으로 대규모 언어 모델(LLM)을 로봇 행동에 접지(grounding)하는 패러다임이 확립되었다. 이 시기 VLMaps와 CLIP-Fields는 CLIP 특징을 3D 재구성과 융합한 개방형 어휘 의미 지도(open-vocabulary semantic map)를 선보였으며, 동시에 3D Gaussian Splatting(2023, Kerbl 등)의 등장은 실시간 사실적 렌더링을 통해 실-가상-실(real-to-sim-to-real) 파이프라인의 기반을 마련했다. 2023년에는 Voyager, DEPS, SayPlan이 LLM을 평생 학습(lifelong learning) 플래너로 활용하는 흐름을 열었고, Chi 등의 Diffusion Policy와 Open X-Embodiment(RT-X) 데이터셋이 확산 기반 행동 생성과 교차 형태(cross-embodiment) 전이 학습이라는 두 축을 형성했다. 2024년은 Vision-Language-Action(VLA) 모델이 통합 패러다임으로 자리잡은 해로, OpenVLA, π0, Octo가 오픈소스 일반화 백본을 확립했고 CogACT와 3D-VLA가 인지와 행동을 분리한 확산 행동 전문가(diffusion action expert) 구조를 제시했으며, HumanPlus와 H2O는 RGB 카메라만으로 휴머노이드 전신 원격조작을 가능케 했다. 2025년에는 π0.5, GR-3, Gemini Robotics 1.5, Being-H0.5 같은 대규모 일반화 '로봇 두뇌'와 VLA-Adapter, TinyVLA, BitVLA 같은 경량·1비트 양자화 모델로 분야가 양극화되었고, CoT-VLA·ThinkAct·OneTwoVLA가 명시적 System-2 추론을 도입했으며, RoboPAIR가 촉발한 적대적 공격(adversarial attack) 연구에 대응해 RationalVLA의 합리적 거부(rational refusal)와 Fast-in-Slow 같은 이중 시스템 안전 구조가 등장했다. 또한 SIMPLER, AutoEval, RoboArena가 자율 평가 병목을 해소하고, OneDP·Consistency Policy의 단일 단계 증류로 실시간 추론이 가능해졌다. 향후 분야는 3D Gaussian Splatting, GPU 병렬 시뮬레이션, 생성적 디지털 트윈을 결합한 통합 real-to-sim-to-real 학습 환경 위에서 강화학습 미세조정(RFT)과 세계 모델 기반 검증을 결합하고, PointWorld가 시사하듯 행동과 장면을 3D 포인트 흐름으로 통합하는 신경-기호적(neuro-symbolic) 체화 일반 지능을 향해 수렴할 것으로 전망된다.

🔗 Interactive Paper Network →

Research Insights 7 findings

3D Simulation and Robot Manipulation 109편
LLM-Augmented Embodied Agent Frameworks 196편
Robotic Safety and Efficiency Systems 54편
VLA Policy Training and Adaptation 235편
Vision-Language Grounded Robot Navigation 137편
Vision-Language-Action Model Architectures 310편
Generated by Claude Code · Physical AI Paper Curation · 2026-07-20

🎧 Audio Overview

이 Deep Research 답변을 팟캐스트형 오디오로 생성합니다. (Gemini · 키는 브라우저에만 저장 · 완성본은 이메일로도 전송)
▸ 고급: 구성 방향(대본 작성 지침) 직접 수정
속도 1.0x
⬇ MP3 다운로드