Meta推新一代AI工具精准识别隐性儿童虐待内容广告

AI技术护航未成年人安全
Meta于本周三宣布,2026年上半年其旗下Facebook和Instagram平台已处置3320万条涉及儿童性剥削的内容。与此同时,公司正全面部署最新人工智能工具,用于识别那些伪装成普通广告、实则暗中将用户引向非法儿童虐待内容的账号。
数据成效令人瞩目
据Meta披露,超过97%的处置内容是在用户举报前由其系统自主发现的。在印度市场,同期共处理530万条涉儿童性剥削内容,前端检测率更是达到98%以上,彰显了平台审核体系的有效性。
创新技术应对新型威胁
大语言模型精准识别”路标”行为
Meta近期推出基于大型语言模型的检测系统,专门针对一种名为”路标”的新型违规手法。这类广告表面看似正常合规,实则暗藏将用户导向其他平台的意图,进而接触儿童性虐待材料。不法分子为规避审查不断变换手段,此类策略正是其最新尝试。
鉴于此,Meta将审核范围从单纯的广告内容延伸至广告跳转目的地。通过追踪用户最终到达的网址,平台能够及时封禁违规网站并对涉事账号采取处置措施。
多维度AI扫描查漏补缺
除了上述新技术,Meta还在持续部署额外的AI驱动扫描机制,以捕捉此前技术手段未能发现的儿童剥削内容。随着公司对相关犯罪网络的运作模式了解加深,平台将持续引入更多检测信号。
“红队测试智能体”主动攻防
另一项创新工具是”红队测试AI智能体”,该智能体专门用于检验Meta自身安全防护体系的漏洞。通过模拟攻击者视角寻找可能的绕过路径,该技术有助于平台在不良分子大规模利用新方法之前提前堵住隐患。
加固账号监管防线
Meta同时优化了对重复注册行为的识别系统。部分违规用户在账号被移除后会以新身份重新登录平台,新系统能够有效追踪并拦截此类行为。
应对广泛社会关注
Meta近年来持续承受来自多方关于平台儿童安全问题的压力,包括多起诉讼及议员们的公开批评。2026年8月,Meta与29个美国州达成和解协议,同意支付高达180亿美元以解决涉及未成年人在网上保护问题的集体诉讼。
今年内,Meta陆续推出多项儿童安全功能,包括Meta AI家长控制、WhatsApp针对低龄用户的专属账号,以及在Instagram上当未成年人搜索自残相关内容时向家长发送提醒等举措。2026年9月,WhatsApp进一步扩充了家长控制权限,允许家长限制青少年使用频道功能的范围、管理状态更新可见性、控制群组添加权限,并提供特定群组活动的通知选项。
关注微信号:智享开源 ,及时了解更新信息。


公众号:智享开源
还没有任何评论,你来说两句吧!