Meta 推出 AI 工具:识别暗藏引流至儿童性侵内容的广告

内容管家 AI领域评论6字数 770阅读2分34秒阅读模式
Meta 推出 AI 工具:识别暗藏引流至儿童性侵内容的广告

Meta 上半年处置 3320 万条儿童性剥削内容,九成以上由系统主动发现

Meta 于 2026 年 10 月宣布,2026 年上半年,公司在 Facebook 和 Instagram 平台上共计处置了 3320 万条儿童性剥削内容。同期,Meta 正在部署新型 AI 工具,以识别那些表面无害、实则暗中引流至非法儿童虐待内容的广告和账号。

Meta 指出,超过 97% 的处置内容由系统主动发现,用户举报仅占极小比例。在印度市场,Meta 同期处置了 530 万条相关内容,98% 以上同样由系统主动发现。

新一代 AI 系统:不仅看广告内容、还看广告去向

Meta 最新推出的 AI 工具重点针对一类新型规避手段:表面正常的广告,实际意图是引导用户至平台外部的非法内容。

新型 LLM 系统用于识别"信号引导"(Signposting):这类广告本身不含非法素材,但其落地页涉嫌指向儿童性虐待内容。Meta 表示,这是近段时间不良行为者频繁采用的策略,以规避平台检测。

基于此,Meta 调整了审核逻辑——不再仅审核&查验广告内容本身,同时追踪广告落地页地址。一旦发现目标网站违反平台规则,Meta 将直接访问限制该目的地,并对背后账号采取处置措施。

AI 补漏扫描:Meta 还在部署额外的人工智能扫描,用以发现早期系统可能遗漏的儿童剥削内容。公司表示,将持续引入新的识别信号,逐步完善对这类网络运作模式的认知。

红队 AI 代理(Red-Teaming AI Agent):这是一款专门用于自我压力测试的工具,主动寻找 Meta 现有防护机制中可能被绕过的薄弱环节。Meta 希望通过这种方式,在新型滥用手段大规模扩散之前提前发现。

打击"换号重来":Meta 同期升级了系统,针对此前被封禁账号更换马甲重新接入平台的惯犯进行识别与处置。

监督&管理压力与产品落地:多项儿童安全功能今年陆续推出

Meta 推出上述措施,背后是持续加大的监督&管理压力。公司已在多起儿童安全诉讼中与美国各州达成和解,其中 2026 年 8 月达成的协议金额最高不超过 180 亿美元。

2026 年以来,Meta 陆续上线了多项儿童安全功能:

  • Meta AI 家长控制功能
  • WhatsApp 12 岁以下儿童账号体系
  • Instagram 家长提醒:当孩子搜索自残相关内容时通知家长

2026 年 9 月,WhatsApp 进一步丰富了家长管控选项,包括限制青少年使用频道(Channels)、控制谁可以查看其动态更新、决定谁可以将孩子添加至群组,以及选择性地接收特定群组活动通知。

延伸阅读

 
内容管家

发表评论