메타는 2026년 상반기 페이스북과 인스타그램에서 아동 성착취 관련 콘텐츠 3,320만 건에 조치했다고 밝혔다. 이 가운데 97% 이상은 이용자 신고 전에 자체 시스템이 먼저 찾아냈다. 인도에서는 같은 기간 530만 건에 조치했고, 98% 이상을 사전 탐지했다. 이번에 메타는 겉으로는 일반 광고처럼 보이지만 외부의 불법 콘텐츠로 이용자를 유도할 수 있는 광고와 계정을 찾는 새 AI 도구를 도입했다.

핵심은 광고 문구나 이미지 자체만 보지 않고, 광고가 사용자를 어디로 보내는지까지 함께 살피는 방식이다. 메타는 이를 위해 이른바 signposting을 탐지하는 대규모 언어모델 시스템을 적용했다고 설명했다. 또 기존 시스템이 놓친 착취 콘텐츠를 찾는 추가 AI 스캔과, 자사 안전장치의 빈틈을 시험하는 red-teaming AI agent도 운영한다. 계정 삭제 뒤 새 계정으로 다시 들어오는 이용자를 찾는 시스템도 강화하고 있다.