Lego-prover: Neural theorem proving with growing libraries

저자: Huajian Xin, Haiming Wang, Chuanyang Zheng, Lin Li, Zhengying Liu, Qingxing Cao, Yinya Huang, Jing Xiong, Han Shi, Enze Xie, Jian Yin, Zhenguo Li, Xiaodan Liang, Heng Liao | 날짜: 2023 | DOI: N/A 📄 PDF


⚠️ 이 페이지의 요약·평가·해설은 생성형 AI(Claude)가 자동 생성한 2차적 분석물입니다. 논문 원문의 저작권은 원저작자에게 있으며, 정확한 내용은 원문(위 DOI·arXiv 등 출처)을 확인하세요.

Essence

Figure 1(a) and (b)

LEGO-Prover의 구조: (a) Plain prover와의 비교 - LEGO-Prover는 모듈식 증명 구성, (b) 프로버(Prover)와 에볼버(Evolver)로 이루어진 전체 프레임워크

대규모 언어모델(LLM)을 이용한 신경 정리 증명(Neural Theorem Proving)에서 검증된 보조정리(lemma)를 재사용 가능한 기술(skill)로 활용하는 성장 가능한 라이브러리를 도입함으로써, 모듈식 증명 구성을 통해 증명 능력을 대폭 향상시킨다. 이를 통해 miniF2F 벤치마크에서 최첨단 성능을 달성하고 22,532개의 검증된 기술을 자동 생성한다.

Motivation

Achievement

Figure 3

성장하는 기술 라이브러리의 효과: LEGO-Prover의 증명 성공률 변화

  1. 벤치마크 성능 향상: miniF2F-valid에서 48.0% → 57.0%, miniF2F-test에서 45.5% → 50.0%로 기존 최첨단 대비 평균 6.75% 절대 개선
  2. 대규모 기술 라이브러리 자동 구성: 증명 과정 중 20,532개 이상의 검증된 보조정리/정리(skill) 자동 생성 및 라이브러리 구축
  3. 기술 라이브러리의 검증된 효과: 기술 라이브러리 활용에 따른 성공률 47.1% → 50.4% 개선을 통해 새로 추가된 기술들의 실질적 유용성 입증
  4. 증명 간극 감소: 생성된 기술 라이브러리가 인간 증명과 형식 증명(formal proof) 간 격차를 완화하여 누락된 단계 추론 용이성 향상

How

Figure 2

LEGO-Prover의 작동 흐름: (a) 프로버의 3단계 증명 과정 (b) 스킬 라이브러리와의 상호작용

1. 프로버(Prover) 모듈:

2. 에볼버(Evolver) 모듈:

3. 기술 라이브러리(Skill Library):

4. 기술 활용 방식:

Originality

Limitation & Further Study

Evaluation

Novelty: 4.5/5 Technical Soundness: 4/5 Significance: 4.5/5 Clarity: 4/5 Overall: 4.2/5

총평: LEGO-Prover는 신경 정리 증명에 성장 가능한 검증된 보조정리 라이브러리를 도입하는 창의적 접근으로 명확한 성능 향상을 달성하였으며, 생성된 대규모 기술 라이브러리의 실용적 가치를 입증했다. 다만 더 복잡한 수학 문제로의 확장성과 계산 비용 효율성에 대한 추가 검증이 필요하다.

같이 보면 좋은 논문

기반 연구형식 논리와 증명 라이브러리 구축의 이론적 기초 제공
기반 연구신경 정리 증명 능력 향상이라는 공통 목표를 공유하며 라이브러리 기반으로 확장
기반 연구고차 논리 시스템은 정리 증명의 형식적 기반을 제공한다.
후속 연구LF 논리 체계는 신경 정리 증명 시스템의 이론적 토대가 된다.
다른 접근자연어 추론을 활용한 정리 증명의 다른 접근법
다른 접근동일한 신경 정리 증명 문제를 다른 라이브러리 구성 방식으로 접근한다.
후속 연구SPECTER2 유사도 0.95로 Formal Proof Verification Automation와 Formal Methods and Computational Reasoning가 맞닿아, 'Lego-prover: Neural theorem proving with growing libraries'가 이 ICML 2026 논문의 배경·대안·응용 맥락을 보완한다.
후속 연구보조정리 재사용 개념을 확장한 증명 시스템
후속 연구SPECTER2 유사도 0.93로 Formal Proof Verification Automation와 Formal Methods and Computational Reasoning가 맞닿아, 'Lego-prover: Neural theorem proving with growing libraries'가 이 ICML 2026 논문의 배경·대안·응용 맥락을 보완한다.
후속 연구증명 보조정리 라이브러리 구축 방법을 확장하여 적용한다.
후속 연구SPECTER2 유사도 0.91로 LLM Reasoning and Safety Benchmarks와 Formal Methods and Computational Reasoning가 맞닿아, 'Lego-prover: Neural theorem proving with growing libraries'가 이 ICML 2026 논문의 배경·대안·응용 맥락을 보완한다.
후속 연구SPECTER2 유사도 0.92로 LLM Reasoning and Safety Benchmarks와 Formal Methods and Computational Reasoning가 맞닿아, 'Lego-prover: Neural theorem proving with growing libraries'가 이 ICML 2026 논문의 배경·대안·응용 맥락을 보완한다.
← 목록으로 돌아가기

🎧 Audio Overview

이 논문 리뷰를 팟캐스트형 오디오로 생성합니다. (Gemini · 키는 브라우저에만 저장 · 완성본은 이메일로도 전송)
▸ 고급: 구성 방향(대본 작성 지침) 직접 수정
속도 1.0x
⬇ MP3 다운로드