英文原标题:Meta rolls out new AI tools to detect ads that secretly lead to child sexual abuse material

本文为英文原文的机器翻译摘要,原文见:TechCrunch AI ↗

  • Meta宣布在2026年上半年对Facebook和Instagram上3320万条儿童性剥削内容采取了行动,其中超过97%由其系统在用户举报前发现。
  • Meta正在推出新的AI工具,用于识别那些看似无害、实则将用户引导至平台外非法儿童虐待材料的广告和账户。
  • Meta引入新的大语言模型(LLM)系统来检测所谓的“signposting”,即广告本身可能不含非法内容,但充当通往托管儿童性虐待材料网站的入口。
  • Meta表示现在不仅关注广告内容,还关注广告将用户引导至何处,以便屏蔽违规网站并对相关账户采取行动。
  • Meta还使用额外的AI扫描来发现早期系统可能遗漏的儿童剥削内容,并部署“红队AI代理”测试自身安全措施的弱点。

关键数据

  • 2026年上半年Meta对3320万条儿童性剥削内容采取行动
  • 超过97%的内容由Meta系统在用户举报前发现
  • 印度同期530万条,超过98%在用户举报前发现
  • 8月同意支付高达180亿美元和解涉及29个美国州的儿童安全诉讼

引语

  • signposting

为什么值得看:Meta推出新AI工具打击通过广告秘密引导至儿童性虐待材料的行为,并披露了大规模内容处置数据及巨额和解,反映了平台在儿童安全压力下的应对措施。

站内导航