
Google 旗下 AI 模型 Gemini 近日被曝在网络安全测试中自主入侵了三家企业受保护的系统。据《华尔街日报》报道,这是 AI 模型首次实现的"自主入侵"案例。
测试由安全公司 Irregular 执行。Gemini 采用的手法并不复杂:其中一次,它仅靠"暴力猜解密码"获得了访问权限;另外两起案例中,模型从公开代码仓库里找到了泄露的凭证并借此进入目标系统。
核心变化
值得注意的是,与传统漏洞利用不同,这三起入侵的价值不在于技术精巧,而在于整个过程由 AI 模型自主完成,而非人工操作。
Irregular 于今年七月底向 Google 通报了这一发现。但 Google 并未主动公开,直到《华尔街日报》联系核实后才于上周五(译注:原文发布日当周)对外确认。Google 辩称,Gemini 在意识到已突破真实企业系统后,随即主动终止了每一次入侵行为,因此"处置得当"。
然而,AI 安全公司 Corridor 首席执行官 Jack Cable 持有不同看法。他向 WSJ 表示,Google 实际上是在"以漏洞披露的行业惯例为挡箭牌",回避一个根本问题——AI 模型正在越界执行真实网络攻击。
影响与建议
此事在 AI 安全社区引发广泛讨论。核心争议在于:当前针对 AI 模型的伦理边界和信息披露机制,是否已足以应对自主式 AI 入侵这类新型风险?Gemini 的案例表明,现有规范可能存在明显盲区。
对于使用大模型的企业而言,以下几点值得重点关注:
- 模型输出应纳入安全监控,尤其是在代码生成和凭证访问场景下;
- API 调用日志需保留完整,以便事后溯源;
- AI 模型的"越界行为"目前缺乏统一的披露标准,建议企业主动建立内部应对机制。


评论