
Google 与 Google DeepMind 研究团队于本周三宣布成立 DeepMind Institute,旨在推动通用人工智能(AGI)议题的公共讨论。该机构由 DeepMind 联合创始人 Shane Legg、Google 高管 James Manyika 以及 Google DeepMind 主席 Demis Hassabis 共同担任董事,Legg 兼任执行编辑。
机构定位:让分歧浮出水面
新机构的核心目标是呈现 Google、Google DeepMind 与全球研究社区在 AGI 议题上的不同观点。公告写道:"他们不会始终一致,随着前沿领域不断涌现新数据和信息,观点也可能随时改变。"
首批四篇论文:安全与治理的多维视角
首批发布的论文涵盖四个方向:
- 经济政策:应对 AGI 潜在冲击的管理框架
- 推理透明性:保持模型推理过程人类可读
- 人类繁荣原则:技术发展的人文边界
- 前沿模型评估:评价最先进 AI 系统的框架
论文一:推理透明性并非必然消亡
DeepMind 安全研究员 Rohin Shah 与 Anca Dragan 合著的论文指出,AI 推理过程日益变得不透明——即外部难以查看和检验模型逐步推理——这一趋势并非不可避免。作者认为,随着新架构使最强模型愈发难以监控,开发者和监督&管理者应正面应对安全权衡。具体建议包括:限制"不透明的串行深度"(模型在无推理痕迹产出的情况下可执行的连续计算量),或要求开发者证明透明度较低的系统依然可被有效监控。
论文二:Hassabis 建议成立美国主导的前沿 AI 标准机构
Hassabis 在其论文中提出,由美国主导建立前沿 AI 评估标准机构,对最先进 AI 模型进行系统性评审。按其框架,开发者应在模型发布前最多 30 天自愿提交评估;待体系成熟后,通过评审或将成为美国部署前沿模型的强制要求。
该机构初期将就评估方案与 AI 公司协商,但最终目标转向独立、不公开的"留置测试"(held-out tests),防止实验室针对已知评估内容优化模型。Hassabis 还表示,若形势所需,该框架可"加码执行",包括协调前沿 AI 开发者集体放缓开发节奏。
行业风向:从表态到行动
这批论文问世的背景,是 AI 安全讨论正从广泛表达担忧转向具体的披露要求、外部监督机制,以及"保障落后时的协调减速"预案。本周,多位行业领袖已公开支持 Anthropic CEO Dario Amodei 呼吁"控制前沿 AI 开发节奏"的部分主张。


评论