메타(Meta)가 자사 플랫폼에서 아동 성 착취물(CSAM: Child Sexual Abuse Material)로 연결되는 은밀한 광고를 탐지하기 위해 새로운 인공지능(AI) 도구를 도입했습니다. 이는 겉으로는 정상적인 광고처럼 보이지만 실제로는 불법 콘텐츠로 사용자를 유도하는 신종 수법에 대응하기 위한 조치입니다. 메타는 2026년 상반기에 페이스북과 인스타그램에서 3,320만 건의 아동 성 착취 관련 콘텐츠에 조치를 취했으며, 이 중 97% 이상을 사용자 신고 전에 자체 시스템으로 탐지했다고 밝혔습니다.
새로운 AI 도구 중 하나는 대규모 언어모델(LLM) 기반 시스템으로, '표지판(signposting)'이라 불리는 전술을 탐지합니다. 이는 광고 자체에는 불법적인 내용이 없지만, 플랫폼 외부의 불법 콘텐츠나 유해 활동으로 사용자를 유도하는 광고를 의미합니다. 메타는 이제 광고 내용뿐만 아니라 광고가 사용자를 어디로 보내는지까지 분석하여 규칙을 위반하는 웹사이트나 목적지를 차단하고 관련 계정에 조치를 취할 수 있게 되었습니다. 또한, 기존 시스템이 놓쳤을 수 있는 아동 착취 콘텐츠를 찾아내기 위한 추가 AI 기반 스캔 기능과, 악용자들이 회피할 수 있는 약점을 선제적으로 찾아내는 '레드팀 AI 에이전트(red-teaming AI agent)'도 도입했습니다. 이와 함께, 계정이 삭제된 후 새로운 계정으로 다시 플랫폼에 진입하는 사용자들을 찾아내는 시스템도 개선하고 있습니다.
이러한 노력은 메타가 자사 플랫폼의 아동 안전 문제로 지속적인 압력에 직면하고 있기 때문입니다. 메타는 아동 안전 관련 소송과 규제 당국의 비판에 직면해 왔으며, 지난 8월에는 29개 미국 주와 아동 안전 소송 합의를 위해 최대 180억 달러를 지불하기로 합의하기도 했습니다. 이번 AI 도구 도입은 단순한 콘텐츠 차단을 넘어, 진화하는 불법 행위 수법에 대한 기술적 대응력을 높여 플랫폼의 책임감을 강화하려는 메타의 의지를 보여줍니다. 이는 온라인 환경에서 아동 보호의 중요성이 더욱 커지고 있음을 시사하며, 기술 기업들이 사회적 책임을 다하기 위한 노력이 계속될 것임을 의미합니다.
