
Meta 上半年处置 3320 万条儿童性剥削内容,九成以上由系统主动发现
Meta 于 2026 年 10 月宣布,2026 年上半年,公司在 Facebook 和 Instagram 平台上共计处置了 3320 万条儿童性剥削内容。同期,Meta 正在部署新型 AI 工具,以识别那些表面无害、实则暗中引流至非法儿童虐待内容的广告和账号。
Meta 指出,超过 97% 的处置内容由系统主动发现,用户举报仅占极小比例。在印度市场,Meta 同期处置了 530 万条相关内容,98% 以上同样由系统主动发现。
新一代 AI 系统:不仅看广告内容、还看广告去向
Meta 最新推出的 AI 工具重点针对一类新型规避手段:表面正常的广告,实际意图是引导用户至平台外部的非法内容。
新型 LLM 系统用于识别"信号引导"(Signposting):这类广告本身不含非法素材,但其落地页涉嫌指向儿童性虐待内容。Meta 表示,这是近段时间不良行为者频繁采用的策略,以规避平台检测。
基于此,Meta 调整了审核逻辑——不再仅审核&查验广告内容本身,同时追踪广告落地页地址。一旦发现目标网站违反平台规则,Meta 将直接访问限制该目的地,并对背后账号采取处置措施。
AI 补漏扫描:Meta 还在部署额外的人工智能扫描,用以发现早期系统可能遗漏的儿童剥削内容。公司表示,将持续引入新的识别信号,逐步完善对这类网络运作模式的认知。
红队 AI 代理(Red-Teaming AI Agent):这是一款专门用于自我压力测试的工具,主动寻找 Meta 现有防护机制中可能被绕过的薄弱环节。Meta 希望通过这种方式,在新型滥用手段大规模扩散之前提前发现。
打击"换号重来":Meta 同期升级了系统,针对此前被封禁账号更换马甲重新接入平台的惯犯进行识别与处置。
监督&管理压力与产品落地:多项儿童安全功能今年陆续推出
Meta 推出上述措施,背后是持续加大的监督&管理压力。公司已在多起儿童安全诉讼中与美国各州达成和解,其中 2026 年 8 月达成的协议金额最高不超过 180 亿美元。
2026 年以来,Meta 陆续上线了多项儿童安全功能:
- Meta AI 家长控制功能
- WhatsApp 12 岁以下儿童账号体系
- Instagram 家长提醒:当孩子搜索自残相关内容时通知家长
2026 年 9 月,WhatsApp 进一步丰富了家长管控选项,包括限制青少年使用频道(Channels)、控制谁可以查看其动态更新、决定谁可以将孩子添加至群组,以及选择性地接收特定群组活动通知。


评论