Essence
Figure 1. Scientific CI/CD merge path. A candidate self-edit passes through a trust boundary, an anytime-valid statistic
자기수정형 과학 발견 에이전트의 편집(self-edit)이 겉보기 점수는 올리면서 실제 유효성·보정·강건성을 몰래 훼손하는 "silent regression" 문제를 정의하고, 이를 막기 위한 Scientific CI/CD 거버넌스 아키텍처(Statistical Gödel Gate, Capacity Budget Gate, Domain Verifier)를 제안한다.
Evaluation
Novelty: 4/5 Technical Soundness: 3/5 Significance: 4/5 Clarity: 4/5 Overall: 4/5
총평: 자기진화형 과학 에이전트의 배포 안전성이라는 시의적절하고 중요한 문제를 소프트웨어 CI/CD의 은유로 명확하게 구조화한 참신한 거버넌스 프레임워크이나, 실험적 검증이 synthetic·dry-lab 수준에 머물러 실제 스케일에서의 효용성 검증이 추가로 필요하다.
같이 보면 좋은 논문
기반 연구SPECTER2 유사도 0.92로 LLM Reasoning and Safety Benchmarks와 LLM Benchmarking and Agent Evaluation가 맞닿아, 'How Claude Code is used in practice \ Anthropic'가 이 ICML 2026 논문의 배경·대안·응용 맥락을 보완한다.
기반 연구SPECTER2 유사도 0.92로 LLM Reasoning and Safety Benchmarks와 LLM Benchmarking and Agent Evaluation가 맞닿아, 'Autoreproduce: Automatic AI Experiment Reproduction with Paper Lineage'가 이 ICML 2026 논문의 배경·대안·응용 맥락을 보완한다.
기반 연구SPECTER2 유사도 0.93로 LLM Reasoning and Safety Benchmarks와 LLM Benchmarking and Agent Evaluation가 맞닿아, 'LLM Agents Making Agent Tools'가 이 ICML 2026 논문의 배경·대안·응용 맥락을 보완한다.
기반 연구특정 수학 분야(differential privacy)에 AI 증명 생성을 적용한 사례
다른 접근AI 에이전트의 성능 저하 문제를 다른 거버넌스 관점에서 접근
다른 접근안전성 과대평가 문제를 다루는 유사한 진단 프레임워크임
다른 접근AI 에이전트의 자기수정 및 신뢰성 검증 문제를 다루는 유사 연구
후속 연구provenance 및 검증 가능한 에이전트 실행 프레임워크의 공통 방법론적 기반을 공유한다.
다른 접근silent regression 문제를 다루는 유사하지만 다른 거버넌스 프레임워크
다른 접근인간-AI 협업 기여도 기록을 위한 다른 스키마 접근법을 제시한다.
다른 접근AI 과학자 실행에 대한 다른 감사·재현성 프레임워크를 다룬다.
후속 연구과학 발견 에이전트의 검증 파이프라인을 확장 적용
반론/비판벤치마크 안전성 점수의 신뢰성 문제를 지적하는 상반된 관점