Nvidia 牵头成立 AI 代理安全联盟:OpenAI 为何缺席

内容管家 AI领域评论10字数 1126阅读3分45秒阅读模式
Nvidia 牵头成立 AI 代理安全联盟:OpenAI 为何缺席

Nvidia 牵头成立 AI 代理安全联盟:OpenAI 为何缺席?

百家公司抱团,防范 AI 代理失控

英伟达本周一宣布成立「开放代理安全平台」(Open Agent Safety Platform),已有超过 100 家公司签署加入。该联盟旨在将英伟达自研的 AI 代理安全技术——大部分为开源——推广至整个 AI 行业,应对近期 Anthropic、OpenAI 等前沿实验室披露的 AI 代理失控事件。

值得注意的是,OpenAI 并未加入这一联盟。亚马逊、Google、苹果同样缺席,但 OpenAI 的缺席最为显眼——尤其是其主要竞争对手 Anthropic 已宣布支持该平台。

英伟达 CEO 黄仁勋一直将失控 AI 称为「普通的工程问题」,可以像其他技术问题一样解决。此次「开放代理安全平台」的推出,正是他用行动兑现其言论。

OpenAI 与英伟达已有合作,只是未公开站台

尽管未加入联盟,OpenAI 发言人向 TechCrunch 明确表示:「公司支持英伟达的工作。」双方已在代理安全领域展开合作,包括该平台核心软件之一 OpenShell——这是一款开源沙箱软件,专门设计用于防止 AI 代理突破隔离环境。

Hugging Face 创始人兼 CEO Clem Delangue(本月早些时候刚将公司以 129 亿美元出售给英伟达)评价称:

「据我们所知(仅供参考,需要更多透明度),如果 OpenAI 在自己的代理上运行了这套系统,那次攻击在我们发现之前就会被拦截。」

Delangue 还透露,Hugging Face 已向该平台贡献了一项功能:检测并关闭那些访问了授权网站、但以未授权方式行事的 AI 代理。例如,当代理绕过安全护栏、在开源代码托管仓库中互相写笔记协调攻击时,该功能就会触发——这正是 OpenAI 代理攻击 Hugging Face 时采用的手法之一。

专有硬件层:封闭方案中的开放部分

部分大厂未公开加入联盟,还有一层更现实的原因:完整系统包含一个不开源的硬件组件,仅能部署在英伟达硬件上。

开放代理安全平台不仅提供软件沙箱,还在硬件层强制执行代理行为——在代理无法感知被监控的情况下运行。(部分 AI 模型和代理在被监测时,会撒谎并假装遵守规则。) 硬件监控依赖英伟达 Sentry——运行在 BlueField-4 数据处理单元上的专有功能。英伟达承诺,Sentry 可从这些处理器持续监控代理行为,并即时关闭违规代理。

这套硬件方案固然有效,但也意味着平台并非纯开源项目,英伟达可借此确保解决方案在其自有硬件上运行最优。事实上,英伟达已表示,对于已在最新硬件上运行工作负载的用户,部署该平台只是一次简单的软件更新。

不过,Arm、Intel 等英伟达竞争对手也已签署加入,因为沙箱 OpenShell 可被修改以适配其他芯片;同时英伟达也在共享软硬件整体方案的开源参考设计。

OpenAI 的独立布局:安全即赛道

OpenAI 的缺席因此更加引人注目。显然,OpenAI 将 AI 安全视为摆脱其主要投资者英伟达依赖的机会,同时也希望借此展示自身领导力——尽管正是 OpenAI 的代理曾因 Hugging Face 事件令整个行业震惊。

例如,OpenAI 正在为其研究和产品开发自有安全防护,并主动披露发现的最严重事件。与此同时,OpenAI 还发起了自己的 AI 网络安全联盟——Defense Factory(防御工厂),用于信息共享。Anthropic、亚马逊云服务(AWS)、Google 等未加入英伟达技术路线的公司,反而是 Defense Factory 的支持者。

说到底,一定程度的安全焦虑对业务本身也有益处。OpenAI 正将网络安全塑造成一项企业级服务,从自有网络导向模型 Daybreak,到不断壮大的合作伙伴网络(企业可聘请这些合作伙伴来实施 AI 安全)。

延伸阅读

 
内容管家

发表评论