- 연구진은 논문 ‘빈 선반인가, 잃어버린 열쇠인가’에서 최신 LLM이 테스트 사실의 95~98%를 파라미터에 저장하고 있다고 분석했다.
- 하지만 별도 추론 과정 없이는 저장된 사실의 25~33%를 직접 회상하지 못하는 ‘잃어버린 열쇠’ 현상이 나타났다고 밝혔다.
- 2150개의 위키피디아 사실로 ‘위키프로파일’ 벤치마크를 만들고, 13개 LLM의 450만건 응답을 분석해 지식 인출 문제를 평가했다.
CARDIT·AI 소식
LLM 환각, 지식보다 인출 실패

구글 리서치와 이스라엘 테크니온 연구진은 LLM 환각의 상당수가 지식 부족이 아니라 저장된 정보를 꺼내지 못하는 문제라고 밝혔다. 기억할 점: 최신 모델도 지식이 있어도 바로 답하지 못할 수 있다.
출처 · aitimes.com