저자: David Scott Lewis, Karl Wang, Zhaoxiang Feng, Junhan Wang, Saien Deng | 날짜: 2026 | URL: https://openreview.net/forum?id=cxNZmu7ODQ 📄 PDF
라이선스: OpenReview 공개(오픈액세스)
Figure 1. The TVA loop. Verification failure is treated as training
이 논문은 formal verification 도구(증명 보조기, 검증기, 모델 체커)를 호출할 수 있는 능력만으로는 self-evolving scientific agent가 신뢰할 수 없다고 주장하며, 정의 선택, 증명 의무 분할, 라이브러리 탐색, 실패한 스크립트 수리, 형식적으로는 accepted되었지만 과학적으로 misaligned된 artifact를 판별하는 능력인 "tacit verification craft"를 학습하는 아키텍처 TVA(Tacit Verification Apprenticeship)를 제안한다.
Figure 3. Experiment 1: mean craft-similarity profiles for the dedu-
Figure 2. Deduplicated top-cluster corpus used for the experiments.
총평: Formal verification 도구를 다루는 데 필요한 암묵적 전문가 craft를 학습 대상으로 정식화한 개념적 기여가 인상적이지만, 이를 뒷받침하는 실증 결과는 소규모 corpus probe 수준에 머물러 있어 실제 대규모 self-evolving scientific agent 시스템으로서의 완성도는 향후 연구를 통해 더 검증되어야 한다.