Large language models penetration in scholarly writing and peer review

저자: Li Zhou, Ruijie Zhang, Xiao Dai, Daniel Hershcovich, Haizhou Li | 날짜: 2025 | DOI: arXiv:2502.11193 📄 PDF


⚠️ 이 페이지의 요약·평가·해설은 생성형 AI(Claude)가 자동 생성한 2차적 분석물입니다. 논문 원문의 저작권은 원저작자에게 있으며, 정확한 내용은 원문(위 DOI·arXiv 등 출처)을 확인하세요.

Essence

본 논문은 학술 저술 및 피어 리뷰 과정에서 대규모 언어모델(LLM)의 침투 정도를 측정하기 위한 포괄적 평가 프레임워크를 제시한다. ScholarLens 데이터셋과 LLMetrica 도구를 통해 규칙 기반 지표와 모델 기반 탐지기를 결합하여 학술 워크플로우에서의 LLM 사용 추세를 다각도로 분석한다.

Motivation

Achievement

Figure 1

파이프라인 개요: (1) ScholarLens 큐레이션, (2) LLMetrica 프레임워크, (3) 학술 저술 및 피어 프로세스의 LLM 침투율 평가

  1. ScholarLens 데이터셋 구축: ICLR 2019년 이전 2,831개 논문의 초록, 리뷰, 메타-리뷰로 구성된 큐레이션 데이터셋 개발. GPT-4o, Gemini-1.5, Claude-3 Opus 등 3개의 최신 LLM으로 생성된 대응 텍스트 포함.
  2. LLMetrica 프레임워크 개발: 10개의 일반 언어학적 특성 지표(어휘 길이, 문장 복잡도, 가독성 등)와 4개의 전문 의미론적 특성 지표(의미적 유사성, 문장 수준 특수성)를 통합한 종합 평가 도구 개발.
  3. ScholarDetect 탐지기: ScholarLens를 기반으로 학술 영역 특화 LLM 탐지 모델 개발로 높은 정확도의 LLM 생성 콘텐츠 식별 달성.

How

Figure 2

ScholarLens의 일반 특성에 기반한 인간 저술과 LLM 생성 텍스트 비교

규칙 기반 지표(Rule-Based Metrics):

모델 기반 탐지기(Model-Based Detectors):

다차원 평가 방식:

Originality

Limitation & Further Study

후속 연구 방향:

Evaluation

Novelty: 4/5 Technical Soundness: 4/5 Significance: 4/5 Clarity: 4/5 Overall: 4/5

총평: 본 논문은 학술 커뮤니티에서 시급한 LLM 투명성 문제를 다루는 실질적 도구와 데이터셋을 제공하며, 다각도 평가 프레임워크와 학술 영역 특화 지표 개발이 돋보인다. 다만 시간성과 도메인 일반화 측면의 한계를 보완한다면 학술 출판 거버넌스 개선에 더욱 기여할 수 있을 것이다.

같이 보면 좋은 논문

기반 연구LLM의 학술 활동 침투 및 가설 생성이라는 연계된 주제를 다룬다.
후속 연구학술 저술에서의 LLM 활용 및 가설 생성이라는 상호 연계된 주제를 다룬다.
기반 연구478은 LLM의 학술 저술 침투를 실증적으로 측정하므로, 444의 AI 논문 작성 윤리에 관한 연구자 인식 조사 결과와 함께 읽으면 LLM의 실제 사용과 윤리 인식 간의 간극을 파악할 수 있다.
다른 접근LLM의 학술 프로세스 침투를 측정하는 다른 접근법을 제시한다.
다른 접근1057은 ChatGPT의 연구 평가를 속이는 문체적 특징을 분석하므로, 478의 LLM 침투 탐지 방법론과 상호 보완적인 접근법을 제공한다.
후속 연구093은 AI 생성 연구에서 표절 문제를 다루므로, 478의 학술 저술 및 피어 리뷰에서 LLM 침투 측정 프레임워크와 함께 읽으면 LLM 사용의 무결성 문제를 종합적으로 파악할 수 있다.
후속 연구SPECTER2 유사도 0.92로 LLM Reasoning and Safety Benchmarks와 AI-Assisted Academic Scholarly Communication가 맞닿아, 'Large language models penetration in scholarly writing and peer review'가 이 ICML 2026 논문의 배경·대안·응용 맥락을 보완한다.
응용 사례LLM 탐지 도구를 학술 워크플로우에 적용한 사례를 공유한다.
← 목록으로 돌아가기

🎧 Audio Overview

이 논문 리뷰를 팟캐스트형 오디오로 생성합니다. (Gemini · 키는 브라우저에만 저장 · 완성본은 이메일로도 전송)
▸ 고급: 구성 방향(대본 작성 지침) 직접 수정
속도 1.0x
⬇ MP3 다운로드