Anthropic 发布 Opus 5.5,降价并接近 Fable 表现

内容管家 AI领域评论1字数 693阅读2分18秒阅读模式
Anthropic 发布 Opus 5.5,降价并接近 Fable 表现

Anthropic 发布 Opus 5.5:编程与知识工作性能登顶,价格反而更便宜

Anthropic 于本周二发布了新一代大模型 Opus 5.5,官方称其在编程和知识工作领域刷新了行业最佳性能表现。值得注意的是,这款新模型在多项基准测试中超越了体量更大的 Fable 模型,并成功完成了 Fable 未能搞定的一系列非正式任务。

Opus 5.5 的定价也显著低于前代:输出 token 费用从此前的每百万 token 25 美元下调至 20 美元,其他计费指标也有类似降幅。同时模型运行速度更快、算力消耗更低。

在交互方式上,Opus 5.5 也有明显改进——减少专业术语的使用,重要信息更倾向于放在回复开头,沟通更加直接。

三层模型线全线更新,Sonnet 和 Haiku 5.5 即将跟进

Opus 是 Anthropic 三层模型阵容中能力最强、价格最高的层级;Sonnet 居中;Haiku 则以速度和成本优势著称。Opus 5.5 发布仅两个月前,Opus 5 才于 7 月 24 日亮相。官方透露,Sonnet 5.5 和 Haiku 5.5 将在未来几周内推出,性能提升幅度相近。

安全护栏同步升级,与 Fable 同一标准

Anthropic 表示,Opus 5.5 在生物安全和网络安全方面的能力已与 Mythos 模型相当,因此其发布同样适用 Fable 模型的安全保障机制——限制模型用于发现已编译程序的漏洞或研发可识别生物武器等高风险用途。

此次发布也是 CEO Dario Amodei 呼吁"为人形智能划定前沿边界"之后的首款模型发布。Amodei 在本月早些时候的文章中写道:

"我越来越确信,充分应对风险需要更加审慎——不只是投入风险防范,而是要放慢能力提升的速度,让风险防范有时间跟上。"

Opus 5.5 的安全训练流程与前代大体相当,包括对齐测试以及 METR、Frontier Design 等外部机构的发布前评估。Anthropic 强调,更先进的安全训练与评估体系已在为后续模型做准备,包括强化的安全监控基础设施。

"随着 AI 能力不断增强,公共政策在确保人们依赖的系统安全方面应发挥更大作用。这种能力建设需要时间,我们已经开始部署相关基础设施。"官方博客写道,"预计将在近期分享更多进展细节。"

延伸阅读

 
内容管家

发表评论