Meta上线AI工具 追踪暗导儿童剥削内容的广告

Meta 10月7日宣布,2026年上半年在Facebook和Instagram上处置了3320万条儿童性剥削内容,其中超过97%是由其系统在用户举报之前主动发现的;在印度,同期处置了530万条,主动发现比例超过98%。与此同时,公司开始上线一批新的AI工具,专门对付那些「看起来人畜无害」的广告。
这批工具瞄准的是一种被Meta称为「暗指式」(signposting)的手法:广告画面和文案完全合规,真正的作用却是把用户引向站外的非法内容或其他有害活动。由于广告本身不含违法素材,以往基于广告内容的审查很难拦住它们。Meta因此改变思路——不只看广告里有什么,还要看广告把人送到哪里去。
为此Meta引入了一套新的大语言模型系统来检测这类广告,一旦发现广告指向违反规则的网站或其他目的地,就可以直接封禁该目标,并处置背后的账号。公司表示,这是应对违规者不断更换手法、规避检测的最新一步,后续还会随对这些网络运作方式的了解持续加入新的识别信号。
另外两项新能力也都指向「堵漏」:一个是红队AI代理,专门攻击性测试Meta自己的安全防护,找出不法分子可能利用的绕过路径,争取在新滥用手法蔓延之前先发现它;另一个是改进的小号识别系统,针对账号被删后换个身份重新注册回流的用户。
Meta此时密集加码,背景是儿童安全方面的持续高压。今年8月,Meta同意支付最高180亿美元,与29个州就儿童安全诉讼达成和解。过去一年该公司接连推出未成年人保护功能:Meta AI的家长控制、WhatsApp的青少年账户,以及孩子搜索自残内容时提醒家长等。对Meta来说,AI既是审查的负担,现在也成了它对外展示的解决方案。
编译自 TechCrunch,原标题:"Meta rolls out new AI tools to detect ads that secretly lead to child sexual abuse material"