Recursive Epistemic Engines for Verifiable Open-Ended Scientific Agents

저자: David Scott Lewis, Enrique Zueco, Haley Yi | 날짜: 2026 | URL: https://openreview.net/forum?id=6pcrtBtYIi 📄 PDF


⚠️ 이 페이지의 요약·평가·해설은 생성형 AI(Claude)가 자동 생성한 2차적 분석물입니다. 논문 원문의 저작권은 원저작자에게 있으며, 정확한 내용은 원문(위 DOI·arXiv 등 출처)을 확인하세요.

라이선스: OpenReview 공개(오픈액세스)

Essence

Figure 3

Figure 3. The Novelty Horizon as overlap between generation

현재 LLM 기반 연구 에이전트가 그럴듯한 서사(narrative)는 생성하지만 검증 가능한 과학적 객체(verified scientific object)를 만들지 못하는 한계를 Novelty Horizon이라는 개념으로 정식화하고, 이를 넘어서기 위한 Recursive Epistemic Engines (REEs) 아키텍처를 제안한다.

Motivation

Achievement

Figure 4

Figure 4. Experiment 1. Verification-gated QD preserves diverse

  1. Novelty Horizon 정식화: 생성-검증 결합 경계로서의 Novelty Horizon을 수식(식 2-4)으로 정의하여, 텍스트 참신성과 인식론적(epistemic) 참신성을 분리하였다.
  2. claim package 및 intrinsic-value functional 제안: proof-carrying, experiment-carrying claim package (식 1)와 verified MDL compression, expected information gain, transfer, archive expansion을 결합한 가치 함수(식 6)를 수학적으로 정의하였다.
  3. REE 아키텍처 설계: proposal prior, typed artifact DSL, verifier stack, experiment runner, QD archive, metacognitive controller의 6개 결합 모듈로 구성된 아키텍처를 제시하였다.
  4. 세 가지 재현 가능한 synthetic 실험: verification-gated QD가 off-spec artifact를 배제하며 다양한 admissible archive를 확장함을 보였고, semantic-alignment gate 없는 proof checking이 다수의 vacuous/misformalized statement를 허용함을 보였으며, guarded self-modification이 Goodhart pressure 하에서 visible-score adoption보다 heldout utility와 verifier strength를 더 잘 보존함을 입증하였다.

How

Figure 1

Figure 1. A Recursive Epistemic Engine treats proofs, programs, experiments, and provenance as first-class artifacts. LL

Originality

Limitation & Further Study

Evaluation

Novelty: 4/5 Technical Soundness: 3/5 Significance: 4/5 Clarity: 4/5 Overall: 4/5

총평: 자율 과학 에이전트가 그럴듯한 서사 생성을 넘어 검증 가능한 지식을 재귀적으로 확장해야 한다는 문제의식을 명확히 정식화하고 이를 위한 포괄적 아키텍처와 수학적 틀을 제시한 의미 있는 포지션 페이퍼이나, synthetic 실험에 국한된 검증으로 인해 실제 적용 가능성에 대한 확신은 아직 부족하다.

같이 보면 좋은 논문

기반 연구SPECTER2 유사도 0.92로 Formal Proof Verification Automation와 Scientific Information Extraction and QA가 맞닿아, 'KGValidator: A framework for automatic validation of knowledge graph construction'가 이 ICML 2026 논문의 배경·대안·응용 맥락을 보완한다.
기반 연구SPECTER2 유사도 0.93로 Formal Proof Verification Automation와 Formal Methods and Computational Reasoning가 맞닿아, 'Grammars of formal uncertainty: When to trust llms in automated reasoning tasks'가 이 ICML 2026 논문의 배경·대안·응용 맥락을 보완한다.
기반 연구formal proof 자동화 방법을 실제 수학 라이브러리에 적용한 사례
반론/비판검증 가능한 과학적 객체 생성의 한계에 대해 비판적 관점을 제공하는 연구
기반 연구verifiable scientific object 개념의 기초를 제공한다.
기반 연구SPECTER2 유사도 0.93로 Formal Proof Verification Automation와 LLM Benchmarking and Agent Evaluation가 맞닿아, 'SEVerA: Verified Synthesis of Self-Evolving Agents'가 이 ICML 2026 논문의 배경·대안·응용 맥락을 보완한다.
다른 접근검증 루프를 통한 과학적 발견 신뢰성 확보라는 유사한 목표를 공유한다.
다른 접근Lean을 이용한 다른 수학적 정리의 기계 검증 접근법을 다룬다.
후속 연구typed predicate 기반 world model 구성에 필요한 이론적 토대를 제공한다.
후속 연구LLM 기반 연구 에이전트의 한계를 확장하여 다룬다.
후속 연구AI 시스템의 검증 가능성에 대한 형식적 계약 기반을 제공한다.
반론/비판정확한 verifier가 항상 분포 붕괴를 막을 수 있다는 기존 가정에 반박하는 관점을 공유한다.
반론/비판narrative 생성 중심 접근에 대한 비판적 관점을 제공한다.
← 목록으로 돌아가기

🎧 Audio Overview

이 논문 리뷰를 팟캐스트형 오디오로 생성합니다. (Gemini · 키는 브라우저에만 저장 · 완성본은 이메일로도 전송)
▸ 고급: 구성 방향(대본 작성 지침) 직접 수정
속도 1.0x
⬇ MP3 다운로드