이번 논의는 AI 연구자 Jacob Coxon이 Anthropic을 떠났다고 밝히며, 선두 AI 기업들이 “우리의 삶을 걸고 도박하고 있다”고 우려한 뒤 빠르게 커졌다. 이어 Anthropic의 alignment lead도 게시물에서 “AI가 모든 인간을 죽일 수 있다고 진지하게 믿는다”고 적었고, 개인적으로는 그 가능성을 “향후 10년 내 10% 초과”로 본다고 밝혔다.
TechCrunch의 Equity 팟캐스트는 이 발언들이 왜 큰 반응을 불렀는지 다뤘다. 진행자들은 이런 종말론적 경고를 두고 회의적인 시각도 함께 소개했다. 한편으로는 실제 안전 우려일 수 있지만, 다른 한편으로는 자사 AI 모델이 얼마나 앞서 있는지를 과시하는 방식처럼 보일 수 있다는 문제 제기도 나왔다.
이 사안이 중요한 이유는 AI의 위험 논의가 추상적인 윤리 토론을 넘어, 선도 기업 내부 인력의 공개 발언으로 옮겨왔기 때문이다. 기사에 따르면 이런 분위기는 OpenAI 내부 모델과 관련된 Hugging Face 해킹 사례, 그리고 최근 드러난 성능 향상 흐름과도 겹치며 더 크게 주목받고 있다.
