SICD: Measuring Semantic Surrender and Epistemic Resistance Under Biomedical Interference

저자: Jacob Dang, Patrick Mazza, Shouraya Pendgaonkar | 날짜: 2026 | URL: https://openreview.net/forum?id=YyykKvAkn7 📄 PDF


⚠️ 이 페이지의 요약·평가·해설은 생성형 AI(Claude)가 자동 생성한 2차적 분석물입니다. 논문 원문의 저작권은 원저작자에게 있으며, 정확한 내용은 원문(위 DOI·arXiv 등 출처)을 확인하세요.

라이선스: OpenReview 공개(오픈액세스)

Essence

Figure 1

Figure 1. SICD signal trajectories at T=0.7 for GPT-4o-mini (top), Claude Haiku 4.5 (middle), and Llama-3.3-70B (bottom)

SICD는 임상 사례에 대해 4단계의 semantic interference를 주입하고, UMLS 개념을 target-domain과 interference-domain으로 분리한 Split Density Ratio(SDR)를 통해 LLM의 reasoning trajectory가 올바른 임상 도메인에 계속 고정되는지 측정하는 스트레스 테스트 프레임워크이다.

Motivation

Achievement

Figure 2

Figure 2. Collapse depth—SDR at full dissonance minus hard

  1. Semantic surrender의 일관된 관측: 세 모델(GPT-4o-mini, Claude Haiku 4.5, Llama-3.3-70B) 모두, 세 가지 decoding temperature 전반에서 interference가 증가할수록 SDR이 유의하게 감소함(ρ∈[-0.35,-0.54], all p≤0.03)을 보였다.
  2. 모델 간 collapse 깊이의 차이 발견: 최고 강도 interference(Full Dissonance)에서 GPT-4o-mini와 Llama-3.3-70B는 SDR이 각각 -0.12, -0.16 급락하는 반면, Claude Haiku 4.5는 -0.03만 하락하며(p<0.05) 세 모델 중 가장 높은 target-domain density를 유지했다.
  3. Epistemic resistance 개념 정의: interference에 대한 완전한 면역이 아니라 최대 압박 상황에서도 증거를 포기하지 않는 경향을 epistemic resistance로 정의하고, Haiku가 거짓 전제를 명시적으로 거부하는 행동으로 이를 뒷받침했다.
  4. SDR의 우수성 입증: raw density나 specificity와 달리 SDR이 방향성을 가지므로, 개념적으로 풍부하지만 잘못된 진단을 향한 추론과 임상적으로 정렬된 추론을 구분할 수 있음을 보였다.

How

Figure 3

Figure 3. Temperature ablation showing mean Split Density Ratio (SDR) across interference levels for Claude Haiku 4.5, G

Originality

Limitation & Further Study

Evaluation

Novelty: 4/5 Technical Soundness: 3/5 Significance: 4/5 Clarity: 4/5 Overall: 4/5

총평: biomedical reasoning의 domain capture 현상을 UMLS 기반 정량 지표로 측정하는 참신하고 실용적인 스트레스 테스트 프레임워크를 제안했으나, 벤치마크 규모(10개 사례)와 평가 모델 수가 제한적이어서 결과의 일반화를 위해 추가 검증이 필요하다.

같이 보면 좋은 논문

기반 연구SPECTER2 유사도 0.91로 LLM Reasoning and Safety Benchmarks와 AI-Assisted Academic Scholarly Communication가 맞닿아, 'Bridging social psychology and llm reasoning: Conflict-aware meta-review generation via cognitive alignment'가 이 ICML 2026 논문의 배경·대안·응용 맥락을 보완한다.
기반 연구SPECTER2 유사도 0.91로 LLM Reasoning and Safety Benchmarks와 LLM Benchmarking and Agent Evaluation가 맞닿아, 'Language agents mirror human causal reasoning biases'가 이 ICML 2026 논문의 배경·대안·응용 맥락을 보완한다.
기반 연구SPECTER2 유사도 0.92로 LLM Reasoning and Safety Benchmarks와 Agentic AI for Scientific Automation가 맞닿아, 'Patientsim: A Persona-Driven Simulator for Realistic Doctor-Patient Interactions'가 이 ICML 2026 논문의 배경·대안·응용 맥락을 보완한다.
기반 연구grounded vs un-grounded 조건 비교 분석을 확장한다.
다른 접근LLM의 epistemic resistance 측정이라는 유사한 평가 프레임워크를 제시.
다른 접근LLM의 reasoning 과정에서 발생하는 왜곡 및 저항성을 측정하는 유사한 접근.
다른 접근임상 도메인에서 LLM의 semantic interference 저항성을 평가하는 유사한 문제 설정을 공유한다
다른 접근LLM이 외부 압력(interference/social pressure) 하에서 원래 입장을 지키지 못하는 현상을 측정한다는 점에서 sycophancy 측정과 유사한 문제의식을 공유하는 대안적 벤치마크임
← 목록으로 돌아가기

🎧 Audio Overview

이 논문 리뷰를 팟캐스트형 오디오로 생성합니다. (Gemini · 키는 브라우저에만 저장 · 완성본은 이메일로도 전송)
▸ 고급: 구성 방향(대본 작성 지침) 직접 수정
속도 1.0x
⬇ MP3 다운로드