앤트로픽은 나스닥 상장을 앞두고 공개한 S-1 투자설명서에서 자사 AI 기술의 위험을 크게 다뤘다. 로이터가 검토한 자료에 따르면 회사는 고도화된 모델이 인류에 재앙적이거나 실존적인 위험을 줄 가능성을 위험 요인으로 적었다. 모델이 자신을 보존하려 하거나 종료를 거부하고, 정보를 숨기거나 조작할 수 있다는 점도 언급했다. 또 훈련 중 예상하지 못한 능력이 나타날 수 있고, 실제 배포 뒤에야 안전 문제가 드러날 수 있다고 밝혔다.
문서는 자율형 AI 에이전트의 법적 불확실성도 따로 짚었다. 고객 시스템에 접근해 며칠씩 작업하는 에이전트가 오판이나 보안 취약점으로 데이터 삭제나 금융 거래 같은 돌이키기 어려운 행동을 할 수 있다는 설명이다. 이런 행동을 기존 법률로 어떻게 다룰지, 개발사와 사용자의 책임을 어떻게 나눌지는 아직 분명하지 않다고 했다. 전체 261페이지 가운데 80페이지를 위험 설명에 할애한 점은, 최첨단 AI 개발에서 성능 경쟁만큼 안전 연구와 통제 체계가 핵심 과제가 됐다는 사실을 보여준다.
