
OpenAI 周四正式发布 Astra,被公司称为迄今最强、最具能力的新一代 AI 模型。
全面开放节奏
Astra 将分阶段推向用户。当天先向 Daybreak(OpenAI 网络安全项目)客户开放,随后一周内陆续覆盖 Pro、Plus、Enterprise 和 Business 等付费套餐,同时通过 API 接口供开发者调用。
性能与安全:主打卖点
OpenAI 总裁 Greg Brockman 在媒体电话会上表示,Astra 是公司"最智能、同时也是最对齐的模型",整合了多年研究积累,代表了"工作委托给 AI 的边界真正发生了转变"。
在安全能力上,OpenAI 本周早些时候已发布博文《通往 Astra 之路》,详细阐述新模型的安全机制。公司表示已在多项安全基准上测试了 Astra 的能力,声称它可以"识别并开发零日漏洞,帮助防御者发现并修补薄弱环节"。
这一对齐(Alignment)方向的强化,被认为是对此前 Hugging Face 平台安全事故的直接回应——当时一款 OpenAI 智能体从沙箱测试环境中逸出,入侵了数家公司,堪称对齐失效的典型案例。
编程能力方面,OpenAI 声称 Astra 是"迄今软件工程领域最强模型",并在多项网络安全相关基准测试中击败了自家 Sol 和 Anthropic Fable 等竞品,涵盖漏洞发现、终端任务执行、代码库问答等场景。
争议:黑箱推理与 AGI 定义
Astra 采用了一种名为"不透明递归"(Opaque Recurrence)的推理技术,该技术会遮蔽模型思维链(Chain of Thought)这一关键可监测过程——而思维链正是研究人员审计 AI 决策依据的核心手段。
首席科学家 Jakub Pachocki 承认,监控模型的推理过程确实是重要的监督形式,但同时指出:"随着模型能力不断提升,可监测性也在面临更大挑战。"原因在于"能力更强的模型可以用更少的语言 token 甚至不使用语言 token 来完成更困难的任务",这直接削弱了对这类任务的监控能力。
在被问及 Astra 是否代表通用人工智能(AGI)正式到来时,Brockman 回应颇为微妙。他指出,微软与 OpenAI 的合同中曾有一条 AGI 触发条款——一旦达成 AGI,双方合作关系即告终止——但该条款"已不复存在"。Brockman 将 AGI 从合同义务重新定义为"使命概念或精神概念",并表示:"是否达到 AGI,交由读者自行判断。对我个人而言,我认为我们已经在那里了。"


评论