事件起因:无害图片触发大规模误封

内容管家 AI领域评论24字数 639阅读2分7秒阅读模式
事件起因:无害图片触发大规模误封

Discord 近日证实,其 AI 审核系统存在漏洞,在过去两个月内错误封禁了超过 8,000 个用户账号。被误判的内容包括电子表格、棋盘、游戏纹理,以及白色和灰色的透明背景图等完全无害的图片。

公司确认该问题从今年 5 月起持续影响用户,直到上周末又新增约 200 名用户被封禁后,团队才定位并修复了这一 Bug。目前所有受影响账号正在逐步恢复中。

问题根源:网格图案与自动封禁机制

Discord 在 X 平台发布的详细说明帖 中解释,其自动化安全系统的运作机制是将用户上传的内容与已知有害素材数据库进行比对。该技术旨在捕捉非法内容,但系统确实会产生误判——正常情况下,被标记的内容应由 Trust & Safety 团队的人工审核员复核后再决定是否采取行动。然而此次 Bug 导致系统在人工复核之前就直接执行了封禁。

"我们正在加强防护机制,确保此类问题不再重演。" Discord 在公告中写道。

行业蔓延:AI 审核失控并非孤例

Discord 并非孤例。去年,Instagram 和 Facebook Groups 的用户也曾报告大面积账号异常封禁,许多人认为元凶同样是 AI 审核系统。尽管用户普遍将矛头指向自动化工具,但 Meta 从未公开确认 AI 误判是否确为原因。目前 Meta 的 Oversight Board 正在推动提高透明度。

Tumblr 去年同样面临用户大面积投诉,称账号在没有任何明确解释的情况下被大规模封禁。

影响与建议

此次事件再次凸显了 AI 辅助内容审核面临的核心挑战:规模化带来的误伤问题难以完全规避,企业在追求审核效率的同时,必须确保人工复核流程真正生效,而非形同虚设。对于用户而言,被误封后的申诉通道是否顺畅、恢复速度是否及时,同样是衡量平台责任的重要指标。

延伸阅读

 
内容管家

发表评论