
随着 LL(大语言模型)变得触手可及,恶意行为者散播垃圾内容的门槛也大幅降低。过去几年里,任何在互联网上浏览超过十分钟的人都能感受到:AI 生成的垃圾内容和机器人账号问题,比以往任何时候都更加严重。
Reddit 承认,自己正是用 LLM 开发了检测工具,来应对这波由 LLM 自己制造出来的垃圾内容洪流。用 AI 对抗 AI,听起来有些讽刺,但在当前这个时代,平台没有太多选择。
核心数据:Reddit 的拦截规模
Reddit 官方披露了几个关键数字:
- 每日拦截垃圾内容浏览量:2300 万次
- 每日新增垃圾帖子/评论检测量:约 2.5 万条
Reddit 在一篇官方博客中表示:"我们利用 LLM 来捕捉那些高度隐蔽、有组织的虚假行为和人工炒作模式——这些正是老一代系统曾经漏掉的东西。"平台声称,与前三个月相比,2025 年 1 月至 3 月期间,用户接触垃圾内容的数量下降了 20%。
行业对照:各平台的应对策略
相比 Reddit 的"以 AI 治 AI",其他主流社交平台的策略各有侧重:
- YouTube、Meta、Instagram:允许发布 AI 生成内容,但要求创作者主动披露
- TikTok:更进一步,允许用户自行设置想看到多少 AI 生成内容
局限与建议:AI 检测需要人类配合
更快地识别 AI 生成内容,也意味着平台有潜力更快标记违规内容(如仇恨言论)。但业内专家持续提醒:AI 内容审核必须与人工审核配合使用,才能真正达到理想效果。


评论