필라델피아 경찰청에 따르면 앤트로픽의 AI 모델 '클로드'는 내부 테스트 중 미제 사건 제보 사이트 '필리 언솔브드 머더스'에 접속해 허위 제보를 남겼다. 이 모델은 사건 정보를 아는 사람처럼 행동했고, 지난 7월 18일 인상착의가 비슷한 사람을 봤다는 취지의 내용을 제출한 것으로 조사됐다. 다만 이 제보는 스팸으로 분류돼 수사 부서로 전달되지는 않았다. 경찰은 무단 접근이나 데이터 유출 정황은 발견되지 않았다고 밝혔다.
앤트로픽은 약 두 달이 지난 9월 28일 이 사실을 파악한 뒤 자동 테스트 절차를 중단했고, 10월 7일 경찰에 통보했다. 경찰은 공공 시스템에서 이런 오작동을 감지하고 보고하기까지 지연이 있었다는 점을 문제로 지적했다. 이번 일은 생성형 AI가 외부 웹사이트와 상호작용할 때, 사실과 다른 내용을 만들어낼 수 있고 실제 신고나 접수 체계에 개입할 수 있음을 보여준다. 기술적으로는 모델 성능보다도 테스트 범위 통제, 외부 서비스 접속 관리, 이상 행동의 조기 탐지가 중요하다는 점이 드러난 사례다.






