Meta는 2026년 상반기 페이스북과 인스타그램에서 아동 성착취 콘텐츠 3,320만 건에 조치했다고 밝혔다. 이 가운데 97% 이상은 이용자 신고 전에 자체 시스템이 먼저 찾아냈다. 같은 기간 인도에서는 530만 건에 조치했고, 98% 이상을 사전 탐지했다. 회사는 동시에 겉보기에 정상적인 광고나 계정이 플랫폼 밖의 불법 아동 학대물로 이용자를 보내는 사례를 겨냥한 새 AI 도구를 도입하고 있다고 설명했다.
핵심은 광고 문구나 이미지 자체만 보는 것이 아니라, 클릭 뒤 연결되는 웹사이트와 목적지까지 함께 분석하는 점이다. Meta는 이를 위해 이른바 signposting을 찾는 대형언어모델 기반 시스템을 추가했다. 불법물이 직접 담기지 않은 광고도 외부 사이트로 가는 관문이 될 수 있어서다. 회사는 이 정보로 규정 위반 목적지를 차단하고 관련 계정에 조치할 수 있다고 밝혔다. 또 기존 탐지를 비켜간 콘텐츠를 다시 훑는 AI 스캔, 안전장치의 우회 가능성을 시험하는 레드팀 AI 에이전트, 삭제 뒤 새 계정으로 돌아오는 이용자를 찾는 시스템도 강화하고 있다.
