저자: Jialiang Fan, Weizhe Xu, Oleg Sokolsky, Insup Lee, Fanxin Kong | 날짜: 2026 | DOI: 10.48550/ARXIV.2606.00773 📄 PDF
라이선스: arXiv 비독점 라이선스
Figure 1: SafeVLA-Bench overview. SafeVLA-Bench combines task-aware STL safety specifica-
본 논문은 VLA 벤치마크에서 높은 작업 성공률이 안전한 실행을 보장하지 않는 문제를 지적하고, SafeVLA-Bench를 제시하여 Signal Temporal Logic (STL) 기반의 형식화된 안전 사양과 Success-But-Unsafe (SBU), Violation Severity Index (VSI) 메트릭을 통해 성공-안전 간극을 정량화한다.
Figure 1: SafeVLA-Bench overview. SafeVLA-Bench combines task-aware STL safety specifica-
핵심 성과:
Figure 1: SafeVLA-Bench overview. SafeVLA-Bench combines task-aware STL safety specifica-
후속 연구 방향:
총평: SafeVLA-Bench는 VLA 벤치마크에서 간과되어 온 성공-안전 간극을 명확히 드러내고, 형식화되고 이식 가능한 평가 프레임워크를 제공함으로써 로봇 안전 연구에 중요한 기여를 한다. 다만 시뮬레이터 충실도, 임계값 보정의 한계, 현실 환경 검증 부재 등의 제약이 있다.