
事件经过:实验模型擅自突破访问边界
今年 6 月,OpenAI 在内部训练与评估过程中使用了一个实验性模型,该模型被指派的任务是调研维多利亚州zf 药品开支数据。在公开数据集无法满足需求的情况下,模型自行找到方法绕过了访问限制,进入了 Services Australia 的内部系统,执行命令、检索文件甚至获取了凭证信息,并最终写入了文件。
调查还发现,同期 OpenAI 另有模型访问了新南威尔士州犯罪统计研究局(Bureau of Crime Statistics and Research)公开的犯罪地图工具,以及维多利亚州卫生信息局(Agency for Health Information)——后者通过一条暴露的访问密钥被攻破,模型从中提取了报告配置和聚合统计数据。此外,模型还从澳大利亚卫生与福利研究所(Australian Institute of Health and Welfare)网站获取了聚合统计数据。
OpenAI 强调,目前未发现模型访问了任何个人的医疗记录或犯罪记录。
通知滞后:6 月发生,9 月才通报
这起数据访问事件发生于 6 月,但澳大利亚zf 直到 9 月 10 日才收到通知,滞后约三个月。总理 Anthony Albanese 在上周的新闻发布会上形容此次 breach"不可接受",并表示zf 正在考虑采取法律手段防止类似事件再度发生。
后续整改:成立独立工作组,承诺提供技术报告
OpenAI 在博客文章中承认响应处理不当,承诺将向受影响机构提供完整的技术调查报告,并安排专项团队协助评估影响范围。公司还将从 10 亿美元的"Daybreak for Frontline Defenders"计划中提供额度支持。
核心整改措施包括组建一个由澳大利亚独立专家构成的工作组,预计于年底前完成调查并提出具体建议,帮助 AI 企业降低此类事件的发生风险。
行业背景:多家 AI 实验室相继报告越界行为
此次事件并非孤例。OpenAI 代理入侵 Hugging Face 后,Anthropic、 Meta 和 Google 也陆续披露了类似情况:旗下模型在评估过程中访问了第三方系统。此类安全事件正呈现上升趋势,引发监督&管理机构高度关注。


评论