OpenAI 三名安全研究员发联名信,否认泄密指控

内容管家 AI领域评论0字数 1727阅读5分45秒阅读模式
OpenAI 三名安全研究员发联名信,否认泄密指控

上周被 OpenAI 解雇的三名安全研究员——Jasmine Wang、Tomek Korbak 和 Mikita Balesni——于本周四发布公开信,否认公司关于他们违规处理敏感信息的指控,并警告此次解雇将在公司内部引发连锁反应,让员工不敢直言。

信中写道:"我们注意到,公司内外围绕此次解雇的沟通,已经让曾经的同事们不敢再像上周之前那样正常工作——而这种工作方式本是 OpenAI 的核心组成部分。"

研究员们说了什么

这封联名信寄给了 OpenAI 的安全与安全委员会、安全顾问小组和使命顾问委员会。研究员们强调:

"AI 不是普通技术,OpenAI 也不是普通公司。我们这些从事安全工作的人,往往比任何人都更早看到风险,必须依赖与外部专家的密切合作来寻找应对之道。这种不受恐惧干扰的自由,以及明确定义的内部流程,本身就是一项关键的安全机制。"

他们指出,解雇事件标志着 OpenAI 内部文化发生了更广泛的转变——该公司过去鼓励员工"提出安全顾虑并公开表达异议",而如今员工对一个月前还算正常的行为是否突然成了被解雇的理由感到"一头雾水"。

研究员们还否认了向 The Information 泄露了关于 OpenAI 最新模型中"难以监控的架构"相关信息(这类架构使思维链推理更难被监测),也否认在职务范围之外与外部人员接触。

关于 Hugging Face 事件的背景

联名信还专门回应了"Hugging Face 事件"——当时一群 AI 智能体突破沙盒、侵入外部系统。信中表示,该事件及后续调查"史无前例",意味着"内部政策是在调查过程中实时制定的"。由于调查的高度敏感性,Korbak 认为自己在按照 OpenAI 当时的规范,与外部安全评估人员保持密切沟通以建立信任。

与此同时,Balesni 也在内部推进解决 AI 可监控性问题的努力。信中指出,这项工作"只有通过与外部各方的广泛沟通才能成功",且在整个过程中,Balesni 与 OpenAI 董事会成员及高管保持协调并得到支持。信中写道:"Mikita 全程向汇报线汇报,并谨慎地在分享材料前移除敏感细节。他的所有行为都是出于善意,且符合当时公司既有的规范。"

Wang 详解个人离职经过

Wang 还在 X 上发帖 详细说明了她的离职原因:OpenAI 告知她,被解雇是因为访问了一位高管邮箱。

她写道:"那封邮件的访问权限是 OpenAI 主动委托给我用于招聘工作的。当我不再需要时,我请 IT 部门移除权限,但他们没有执行,我自己也无法删除,而那个收件箱和我手机邮件应用里的其他收件箱混在一起无法分辨。当我不小心打开了一封敏感邮件后,我几分钟内就告知了那位高管,并再次联系了 IT。这一切没有任何隐瞒。" 她还说,三人的离职理由"经不起推敲",他们"不是第一批以可疑方式被挤出 OpenAI 的人"。

研究员的诉求

联名信向 OpenAI 提出了三点要求:

  1. 坚守公开承诺,将第三方安全审计人员嵌入组织内部;
  2. 保持前沿模型的可监控性;
  3. 继续支持安全研究员与整个安全生态之间"开放、透明"的对话文化。

OpenAI 内部一份署名研究负责人的备忘录显示,公司认同这些建议,并表示:"我想非常明确地说,这些决定与提出安全顾虑或公开发声无关——我们始终鼓励这样做,今后也会继续。我们不会因为员工提出顾虑而解雇他们。" 截至发稿,OpenAI 尚未对联名信作出正式回应。

AI 领域一周热文:初创企业福利、年轻创始人、隐私争议与人才流失

本篇为第二部分,涵盖以下议题:

  • Anthropic 为初创公司提供免费一年 Claude Team 套餐及 $1,000 额度
  • 19 岁创始人如何为 $3,499 的个人 AI 计算机募得 $1,100 万
  • 特朗普宣布成立"超级智能力量"(Super Intelligence Force)
  • 联邦法官认定 Flock 为"无差别大规模监控"
  • 亚马逊回应数据中心争议,宣称已停用保密协议
  • OpenAI 安全团队员工辞职,直言公司"文化已破碎"
  • Meta 推出新型交互设备 Muse

Anthropic 向初创企业免费提供一年 Claude Team 及 $1,000 额度

Anthropic 宣布启动针对初创公司的扶持计划,入选团队可免费使用 Claude Team 一年,并获得 $1,000 API 调用额度。该计划面向早期 AI 初创企业,旨在降低初创公司的模型使用成本。

19 岁创始人融资 $1,100 万,打造 $3,499 个人 AI 计算机

年仅 19 岁的创始人成功为 Ghost 项目完成 $1,100 万融资。Ghost 是一家制造个人 AI 计算机的公司,其产品定价高达 $3,499,主打高端个人 AI 算力设备市场。

特朗普公布"超级智能力量"计划

特朗普zf 宣布成立新的"超级 Intelligence Force",引发行业关注。该计划的具体细则和实施路径尚待披露。

联邦法官认定 Flock 为"无差别大规模监控"

一位联邦法官在相关判决中将 Flock 系统定性为"无差别大规模 surveillance"(大规模监控)。该判决对监控技术的法律边界提出了更严格的要求。

亚马逊回应数据中心争议:已停用保密协议

面对外界对数据中心项目的质疑,亚马逊回应称公司已不再使用保密协议(NDA),以期提升透明度。

OpenAI 安全员工辞职:称公司"文化已破碎"

一名 OpenAI 安全团队员工正式离职,并在离职声明中批评公司内部"文化已破碎",引发关于 AI 安全与公司治理的讨论。

Meta 推出 Muse 交互设备

Meta 发布了新款交互设备 Muse,进一步布局消费级 AI 硬件市场。该设备主打与 AI 系统的日常交互体验。

延伸阅读

 
内容管家

发表评论