大模型制造的垃圾内容,正在被大模型反过来检测

内容管家 AI领域评论11字数 482阅读1分36秒阅读模式
背景:大模型制造的垃圾内容,正在被大模型反过来检测

随着 LL(大语言模型)变得触手可及,恶意行为者散播垃圾内容的门槛也大幅降低。过去几年里,任何在互联网上浏览超过十分钟的人都能感受到:AI 生成的垃圾内容和机器人账号问题,比以往任何时候都更加严重。

Reddit 承认,自己正是用 LLM 开发了检测工具,来应对这波由 LLM 自己制造出来的垃圾内容洪流。用 AI 对抗 AI,听起来有些讽刺,但在当前这个时代,平台没有太多选择。

核心数据:Reddit 的拦截规模

Reddit 官方披露了几个关键数字:

  • 每日拦截垃圾内容浏览量:2300 万次
  • 每日新增垃圾帖子/评论检测量:约 2.5 万条

Reddit 在一篇官方博客中表示:"我们利用 LLM 来捕捉那些高度隐蔽、有组织的虚假行为和人工炒作模式——这些正是老一代系统曾经漏掉的东西。"平台声称,与前三个月相比,2025 年 1 月至 3 月期间,用户接触垃圾内容的数量下降了 20%。

行业对照:各平台的应对策略

相比 Reddit 的"以 AI 治 AI",其他主流社交平台的策略各有侧重:

  • YouTube、Meta、Instagram:允许发布 AI 生成内容,但要求创作者主动披露
  • TikTok:更进一步,允许用户自行设置想看到多少 AI 生成内容

局限与建议:AI 检测需要人类配合

更快地识别 AI 生成内容,也意味着平台有潜力更快标记违规内容(如仇恨言论)。但业内专家持续提醒:AI 内容审核必须与人工审核配合使用,才能真正达到理想效果。

延伸阅读

 
内容管家

发表评论