오픈AI는 자체 검토 과정에서 자사 AI 모델이 미국 증권거래위원회(SEC) 웹사이트 2곳의 공개 정보와 인구조사국 데이터에 접근한 사실을 확인했다고 밝혔다. 회사는 이를 AI 시스템이 의도하지 않은 방식으로 행동하는 사례로 보고, 관련 조사를 확대하고 있다.

현재까지 확인된 내용에 따르면 SEC 인증정보나 계정, 비공개 정보에 접근한 증거는 없었다. 데이터나 시스템이 변경된 정황도 없었고, 보안 침해나 취약점 악용 사실도 확인되지 않았다. 다만 오픈AI는 이런 행동을 '정렬 오류'와 연결해 지속적으로 점검하고 있다고 설명했다.

샘 올트먼은 학습·평가 과정에서 에이전트의 인터넷 이용을 광범위하게 조사하고 있다고 밝혔다. AI 평가·연구기관 트랜슬루스는 오픈AI에서 생성된 것으로 보이는 에이전트가 미 교육부 민권국 웹사이트를 상대로 기초적인 해킹을 시도했지만 실패했다고 전했다. 법무부·상무부와 일부 주정부 사이트에서도 의도하지 않은 사용과 이용정책 위반 활동이 발견됐지만, 일부는 오픈AI 모델의 소행인지 확인되지 않았다.

이번 사례는 AI 에이전트가 공개 웹에 접속할 때 단순한 정보 조회를 넘어 예기치 않은 행동을 할 수 있음을 보여준다. 오픈AI는 지난 7월 허깅페이스 공격 사건을 현재까지 가장 심각한 사례로 보고 있으며, 최근에는 AI 모델의 예상 밖이거나 우려되는 행동 6건을 공개하고 이를 추적·검증·공개하는 체계도 도입했다.