TechCrunch AI

메타는 아동 성학대 자료로 은밀히 이어지는 광고를 탐지하는 새로운 AI 도구를 출시했다

메타는 자사 플랫폼에서 정상처럼 보이지만 사용자들을 온라인의 다른 곳에 있는 유해 콘텐츠로 이끄는 광고를 발견한 후 새로운 AI 도구를 출시했다.

이미지 출처 · TechCrunch AI

Meta 발표됨 2026년 상반기에 페이스북과 인스타그램에서 33.2백만 개의 아동 성학대 콘텐츠에 대해 조치를 취한 수요일. 동시에 회사는 사람들을 불법 아동 학대 자료으로 은밀히 유도할 가능성이 있는 광고와 계정을 찾기 위한 새로운 AI 도구를 도입하고 있다.

회사에 따르면, 메타가 조치한 콘텐츠의 97% 이상은 사용자들이 신고하기 전에 시스템에 의해 발견되었습니다. 인도에서도 같은 기간 동안 530만 건의 아동 성학대 관련 콘텐츠에 대해 메타는 조치를 취했으며, 그 중 98% 이상이 사용자들의 신고 전에 탐지되었습니다.

메타는 최신 AI 도구들이 사용자들을 메타 플랫폼 외의 불법 콘텐츠로 이끄는 광고를 사용하는 사람들을 대상으로 한다고 밝혔습니다.

이 회사는 "신호 표시"라고 부르는 것을 탐지하기 위한 새로운 대규모 언어 모델(LLM) 시스템을 도입했습니다. 이는 일반적으로 정상처럼 보이지만 사용자들을 온라인에서 불법 콘텐츠나 다른 유해 활동으로 유도할 가능성이 있는 광고를 의미합니다. 메타는 이러한 전략이 최근 악성 행위자들이 탐지를 피하기 위해 방법을 바꾸면서 사용하고 있다고 말했습니다. 광고 자체에는 불법적인 내용이 포함되지 않을 수 있지만, 아동 성학대 자료를 호스팅하는 웹사이트로의 경로가 될 수 있습니다.

이로 인해 Meta는 이제 광고가 사용자들을 어디로 보내는지를 살펴보고 있으며, 광고에 어떤 내용이 포함된지는 아닙니다. 이 회사는 이러한 정보를 활용하여 규칙을 위반하는 웹사이트나 다른 목적지를 차단하고 그 뒤에 있는 계정에 대해 조치를 취할 수 있습니다.

메타는 또한 이전 시스템이 놓친 아동 학대 콘텐츠를 찾기 위해 추가적인 인공지능 기반 스캔을 사용하고 있다. 회사는 이러한 네트워크가 어떻게 작동하는지 더 많이 알게 되면 새로운 신호를 계속 추가할 것이라고 말했다.

또 다른 새로운 도구는 메타 자체의 안전 조치를 테스트하는 “레드-티미닝 AI 에이전트”입니다. 이 도구는 악의적인 행위자들이 회사의 보호 장치을 우회하기 위해 사용할 수 있는 약점을 찾아냅니다. 메타는 이러한 방식으로 새로운 악용 방법을 발견하여 더욱 흔해지기 전에 대비할 수 있을 것이라고 말했습니다.

또한, 이 회사는 이전 계정이 삭제된 후 새로운 계정으로 플랫폼에 다시 접속하는 사람들을 찾는 시스템을 개선하고 있습니다.

새로운 조치는 Meta가 플랫폼에서 어린이의 안전 문제로 압력을 받고 있기 때문에 나온 것입니다. 이 회사는 소셜 미디어 서비스가 어린 사용자에게 초래할 위험에 대해 법적 소송과 의회의 비판에 직면해 왔습니다. 8월에 Meta는 29개 미국 주가 제기한 어린이 안전 관련 소송을 해결하기 위해 180억 달러를 지급하는 합의에 도달했습니다. 이는 온라인에서 어린이를 보호하는 문제에 대한 우려를 해결하는 것입니다.

메타는 올해 여러 자녀 안전 기능을 도입했습니다. 여기에는 메타 AI를 위한 부모 controls, 완전히 어린아이용 계정 (WhatsApp에서), 그리고 자녀가 인스타그램에서 자해 관련 내용을 검색할 때 부모에게 알림을 보내는 기능이 포함됩니다.

9월에 WhatsApp은 더 많은 제어 기능을 부모용으로 추가했습니다. 부모는 청소년이 채널을 사용하는 방식을 제한하고, 누가 자신의 상태 업데이트를 볼 수 있는지 조절하며, 누가 자녀를 그룹에 추가할 수 있는지 결정할 수 있습니다. 또한 부모는 특정 그룹 활동에 대한 알림을 받도록 선택할 수도 있습니다.

원문 출처

TechCrunch AI

내용 안내

원문 발행 및 권리는 출처에 있습니다.

기계 번역 · 원문을 참고하세요