Trust, but Don't Verify: Epistemic Blind Spots in LLM Source Evaluation
언어모델이 여러 출처의 근거를 종합할 때 수치의 타당성을 실제로 평가하는지 살펴본 실험 연구다.
저자·제작자: Rohan N. Pradhan, Steve Goley
확인일: 2026-08-01
출처 메모: 2026년 7월에 개정된 최근 프리프린트다. 통제된 과제에서 특정 실패 양상을 보였지만 반복 연구와 더 넓은 외부 검증이 필요하다.
이 출처와 연결된 주장
- 모델은 조작된 통계를 따로 보면 탐지했지만 여러 출처를 종합할 때 그 능력을 안정적으로 적용하지 못했다.