美国zf 切断 Anthropic 最强 AI 访问

内容管家 AI领域评论19字数 929阅读3分5秒阅读模式
美国zf    切断 Anthropic 最强 AI 访问

美国zf 上周五下令 Anthropic 立即停止向用户提供两款最强 AI 模型——Claude Fable 5Claude Mythos 5,理由是"国家安全顾虑"。Anthropic 随后在 X 平台发文确认已执行该命令,但同时明确表示zf 此次判断有误

事件始末

该指令于美东时间上周五下午 5:21 送达 Anthropic,强制其面向全球所有用户禁用这两款模型,而非仅限于受出口管理&制约约束的外国用户。Anthropic 其他模型暂不受影响。

Mythos 5:因"过于强大"而一直被限制开放

Mythos 是 Anthropic 能力最强的模型,公司于今年 4 月初预览后便严格限制开放。原因在于 Anthropic 形容其"发现软件安全漏洞的能力异常突出":Mythos 在测试中识别出了所有主流操作系统和浏览器的漏洞。为此 Anthropic 启动了名为 Project Glasswing 的受控计划,仅向约 50 家经审核的机构开放使用,包括 Amazon、Apple、Google、Microsoft 和 CrowdStrike,专门用于防御性网络安全工作。

Fable 5:带护栏的"公开版"Mythos

Fable 5 于三天前刚刚发布,是 Anthropic 面对商业化压力给出的答卷——在 Mythos 基础上加装安全护栏,屏蔽网络安全、生物等高风险领域的输出,以实现"安全公开部署"。发布后,AI 性能追踪公司 Vals AI 的基准测试显示,Fable 5 为当时公开可用的最强 AI 模型。

zf 的真实担忧 vs. Anthropic 的反驳

zf 将此次行动定性为出口管理&制约,名义上限制的是外国用户访问。但 Anthropic 在一篇长文中透露,其理解的真正原因是 Fable 5 疑似被"越狱"

Anthropic 表示,截至目前zf 仅提供了口头证据,证明存在"一次潜在、狭窄、非通用的越狱"——即诱导模型读取特定代码库并识别软件缺陷。Anthropic 补充道,这种能力早已在 GPT-5.5 等其他公开模型中广泛存在,网络安全专业人士也常将其用于防御目的。

Anthropic 进一步指出,其最核心的安全保障来自独立运行的分类器系统,与模型本身相互隔离,这意味着即使用户成功绕过 Fable 的拒绝机制,模型最危险输出的底层保护仍然有效。

然而这些解释未能阻止zf 行动。Anthropic 在博文中直言不讳:

"我们不同意将一次潜在狭窄越狱的发现,作为召回已部署给数亿人的商业模型的理由。如果这一标准在整个行业推行,将实质上终止所有前沿模型提供商的新模型发布。"

"炸弹营销"反噬:Altman 年初的预言

Anthropic 此次遭遇颇具讽刺意味。公司长期将安全形象作为与竞争对手的核心差异,并有望于今年推进 IPO。而正是这种"谨慎"——数月来对外强调 Mythos 危险到无法公开——引来了zf 的高度关注。

有趣的是,OpenAI 首席执行官 Sam Altman 早在今年 4 月播客访谈中便指出,Anthropic 处理 Mythos 的方式属于"恐惧营销"。他当时说:

"这显然是非常高明的营销——'我们造了一颗炸弹,正准备扔到你头上,现在给你一个价值 1 亿美元的防空洞。'"

Altman 虽然没有预测到zf 会直接封禁,但他的这番话如今看来已成现实。

延伸阅读

 
内容管家

发表评论