Running VLAs at Real-time Speed

저자: Yunchao Ma, Yizhuang Zhou, Yunhuan Yang, Tiancai Wang, Haoqiang Fan | 날짜: 2025-10-30 | URL: https://arxiv.org/abs/2510.26742 📄 PDF


⚠️ 이 페이지의 요약·평가·해설은 생성형 AI(Claude)가 자동 생성한 2차적 분석물입니다. 논문 원문의 저작권은 원저작자에게 있으며, 정확한 내용은 원문(위 DOI·arXiv 등 출처)을 확인하세요.

라이선스: arXiv 비독점 라이선스

Essence

Figure 2

Figure 2. Breakdown of the model running time. From a plain

π0 레벨의 multi-view VLA를 단일 소비자 GPU에서 30Hz 프레임 레이트로 실행하기 위해 모델 추론 오버헤드를 제거하는 최적화 기법들을 제시하고, 실시간 로봇 제어를 위한 Full Streaming Inference 프레임워크를 제안한다.

Motivation

Achievement

Figure 2

Figure 2. Breakdown of the model running time. From a plain

How

Originality

Limitation & Further Study

Evaluation

Novelty: 4/5 Technical Soundness: 4/5 Significance: 4/5 Clarity: 4/5 Overall: 4/5

총평: 본 논문은 VLA의 실시간 실행이 불가능하다는 기존 인식을 깨고, 체계적인 엔지니어링 기법들을 통해 30Hz 실시간 처리를 달성함으로써 로봇 제어의 새로운 가능성을 제시한다. 단순하지만 효과적인 최적화 기법들과 Full Streaming Inference 프레임워크는 실용적 가치가 높으며, 구체적인 코드 공개는 재현성을 보장한다.

같이 보면 좋은 논문

기반 연구Running VLAs at Real-time Speed 논문은 오픈소스 VLA 모델의 실시간 실행 최적화에 초점을 맞춰 OpenVLA를 실제 적용 측면에서 확장한다.
기반 연구Running VLAs at Real-time Speed는 embodied policy의 효율적 실행 및 벤치마크에 집중하여 object-centric manipulation 서베이의 응용적 확장을 제공한다.
기반 연구Running VLAs at Real-time Speed 논문은 고속 실시간 VLA 실행을 논의하여 Diffusion 기반 실시간 신경엔진에 대한 현실 적용 가능성을 확장합니다.
기반 연구One-Step Diffusion Policy는 diffusion 기반 정책의 단일 스텝 추론 구조를 통해 추론 지연을 낮추는 방법을 제안하여, 실시간 VLA 모델 실행을 위한 기술적 토대를 마련한다.
기반 연구Running VLAs at Real-time Speed는 FlowPolicy의 실시간 구현을 실험적으로 확장하여, 초고속/즉각적 VLA 제어를 구체적으로 실현합니다.
기반 연구Phantom(1515)는 인간 비디오만을 활용한 효율적 로봇 제어 및 실시간 임베디드 실행 실험을 수행하여, 1557의 실시간 VLA 전개 연구에 기초가 된다.
기반 연구Running VLAs at Real-time Speed는 DynamicVLA와 같이 실시간 로봇 제어를 지향하며, 연산 속도와 대기시간 최소화에 집중한 연구입니다.
다른 접근Running VLAs at Real-time Speed는 모델 경량화와 속도 향상에 초점을 맞추며, SARA-RT의 linear attention과 효율화 목표가 유사하다.
다른 접근TinyVLA(1588)는 경량화 및 실시간 VLA 실행을 목표로 하여, 1557의 full streaming inference와 유사한 실시간 최적화 방식을 논의한다.
다른 접근Running VLAs at Real-time Speed 논문은 비슷하게 실시간 로봇 제어를 위한 효율적인 계산 구조를 제안하지만 접근 방식이 다릅니다.
다른 접근BitVLA는 모델 경량화로 실행 속도 향상을 추구하며, Running VLAs at Real-time Speed에서의 실시간 로봇 제어 최적화 방법과 비교해볼 수 있다.
응용 사례robosuite는 다양한 로봇 실험 환경과 벤치마킹 설비를 제시해, Running VLAs 프레임워크의 실제 적용 및 성능 평가에 활용될 수 있다.
반론/비판Running VLAs at Real-time Speed(1557)는 inference 속도와 효율성에 집중한 반면, 1618은 reasoning 정확성에 집중함으로써 트레이드오프 논의를 가능하게 한다.
← 목록으로 돌아가기

🎧 Audio Overview

이 논문 리뷰를 팟캐스트형 오디오로 생성합니다. (Gemini · 키는 브라우저에만 저장 · 완성본은 이메일로도 전송)
▸ 고급: 구성 방향(대본 작성 지침) 직접 수정
속도 1.0x
⬇ MP3 다운로드