载入中… | 今日精选 · 实时更新
每日精选全球 AI 与科技资讯
编辑部 · 北京时间 每日 08:00 更新
首页

AI审核乌龙:Discord错封200+用户只因无害图片

· · 阅读 5 分钟

当人工智能被委以内容审核的重任,任何微小的模型缺陷都可能演变成一场用户信任的危机。近日,知名社交平台Discord公开承认,其AI驱动的自动审核系统存在严重漏洞,导致大量用户因上传完全无害的图像而遭到错误封禁。据官方确认,这一错误从今年5月起就开始影响账户,仅在上周末就有约200名用户被误判封禁,直到团队最终定位并修复了问题。

误判的根源:AI模型对“无害图像”的过度敏感

据Discord官方说明,此次大规模误封事件源于AI审核模型中的一个特定bug。该模型在识别图像内容时,对某些视觉特征(如特定色调、构图或元素)产生了过度敏感的反应,将这些本属正常的图片错误地归类为违反社区准则的违规内容。虽然公司未具体披露被误判的图像类型,但多位受影响的用户反馈,他们的帖子中包含的是宠物照片、风景图甚至表情包,完全没有暴力、色情或骚扰成分。

持续数月的问题与突然的爆发

更令人关注的是,这个漏洞并非短期故障。Discord承认,自2026年5月起就已经有用户因同一原因被悄然封禁,但影响范围相对有限。直到最近一个周末,系统突然集中触发误判,导致约200个账号在短时间内被封禁,大量用户在社交媒体上投诉,才促使公司迅速展开调查。团队在数小时内识别了根因并部署了修复补丁,但此前被误封的用户仍需等待人工复核才能恢复访问。

修复行动与用户沟通不足

事件曝光后,Discord发布了简短声明,确认bug已被修复,并对受影响用户致歉。然而,许多用户批评平台的沟通不够透明:误封发生时,被处罚者收到的通知显示“因违反社区准则而被封禁”,并未提示与AI审核相关,导致许多用户不知原因,申诉流程也较为繁琐。只有通过外部舆论发酵,才促使公司主动承认是AI失误。这暴露了平台在自动化处罚与人工申诉之间的衔接短板。

行业影响:AI审核的“置信度陷阱”亟待解决

Discord的这次AI审核乌龙并非孤例。近年来,各大社交媒体和内容平台纷纷部署AI模型取代人工审核,以提高效率并降低成本,但模型在处理边缘案例时的“假阳性率”始终是一个技术难题。此次事件再次警示:当AI模型被赋予封禁用户这样的严肃权限时,其决策必须经过合理的置信度校准与人工复审兜底。

从行业角度看,Discord的误封事件可能促使更多平台审视自身的AI审核流程:是否设置了足够的容错机制?是否在模型判断低置信度时自动降级为人工审核?用户遭受误判后,是否有快速且公平的申诉渠道?如果平台只追求“零容忍”的审核速度,而忽视准确性,最终将伤害用户对社区治理的信任。

对用户而言,这也是一次警醒:在AI审核成为常态的今天,哪怕是再普通的自拍或截图,也可能被毫无逻辑的算法错判为违规内容。如何在提升效率与保障公平之间找到平衡,将是所有依赖AI审核的科技公司必须持续追问的课题。

Discord已承诺会改进内部检测流程,并优化对误封用户的恢复机制。但对于那些已经经历了数十天封禁、失去社群联系的用户来说,一句“bug已修复”或许远不足以弥补信任的损失。