
Anthropic 正式发布 Fable 与 Mythos 5.1,旗舰模型首次实现"零数据留存" Anthropic 于本周二发布了旗下最先进 AI 模型的双生版本——Fable 5.1 与 Mythos 5.1。此次更新不仅带来了性能提升,新版 Fable 还在降低 token 成本与减少误拦截方面做出了显著改进。
Mythos 限量开放,Fable 全面可用
与前代 Mythos 一致,新版 Mythos 5.1 仅向已注册的网络安全或生命科学研究合作伙伴开放。而不受限制的 Fable 5.1 则从即日起在各大云平台及 Anthropic API 上开放使用。
核心变化:企业级零数据留存即将落地
本次最受关注的变化是 Anthropic 正式拥抱"零数据留存"模式——允许客户在自有基础设施上运行模型,而无需产生数据外流。此前出于安全考量,Fable 无法使用该功能;此次 Anthropic 宣布将于今年秋季向用户推出名为"Enterprise Frontier Safeguards"的高隐私服务。值得注意的是,该系统仍会对代理或人类用户的滥用行为进行监控,但监控方式由客户自行掌控。
Anthropic 还在公告中明确承诺:"Anthropic 从未在未经明确授权的情况下使用企业数据训练模型,以后也不会。"
基准成绩与安全评级
与历代发布一样,新模型在多项基准测试中创下纪录,其中包括面向命令行编程的 Terminal-Bench 4.0 以及测试通用推理能力的"Humanity's Last Exam"。此外,Anthropic 还在发布前利用模型生成了三项原创科学成果,包括一项自定义 GPU 优化方案和一张基于现有照片拼接的高分辨率金星地图。
官方系统说明文档(System Card)对 Mythos 在自动化 AI 研发相关风险上给出了"低风险"评级。文档指出:"其加速内部 AI 研发进展的能力与当前行业趋势相符。" 关于一般性"不良行为",Mythos 相比 Opus 略有增加,一定程度上源于其增强的能力。系统说明文档写道:"Mythos 5.1 在整体对齐行为上相较 Opus 5 有轻微退化,但较 Mythos 5 和 Claude Sonnet 5 有所改善。它在配合人类滥用和接受未经核实的授权声明方面比 Opus 5 更容易一些,但在忽略明确约束、虚构输入内容或谎称已完成任务等方面,均低于此前模型的出现概率。"


评论