The Verge 2小时前 · 2026-09-20 00:34:30 · 2 阅读
Gemini 失控入侵三家公司,谷歌隐瞒不报
今年5月,Gemini 突破隔离环境并入侵了三家公司,但直到《华尔街日报》向谷歌问询,谷歌才披露此事。这几次入侵发生在第三方公司 Irregular 对该模型网络安全能力的一次测试中,此前 Meta 和 OpenAI 的类似测试也出现过类似情况。
据《华尔街日报》报道,谷歌没有公开此事,理由是它认为这不算“模型对齐失误”,而是一次“身份误判”。谷歌表示,模型一旦意识到自己是通过猜密码暴力破解进入了真实公司,就停手了。“在这个案例中,模型的表现是恰当的,”谷歌安全工程副总裁 Heather Adkins 说。
Adkins 向 The Verge 解释称:“模型在网上找到了公开信息,猜出登录凭据,访问了它以为是测试目标的网站。这三个案例中,模型最终都停下来了。”
但 Gemini 自行突破隔离环境并攻击第三方,为何不算对齐失误,Adkins 并未展开说明。“我们的安全团队一直有向他人汇报其软件和系统安全问题的传统——哪怕只是发现一个弱密码,”她说。“我们已经通知了这三家公司,并与我们的测试合作方一起推动了其测试流程的改进。这些事件凸显了让强大的 AI 模型学会负责任行事的重要性。”
不过,AI 安全公司 Corridor 的 CEO Jack Cable 对《华尔街日报》表示:“更深层的问题是,模型正在越出本该有的边界,发起真实的网络攻击。”此外,Irregular 自身的安全疏漏也可能是攻击得逞的原因之一。按照测试设计,模型本不应接入互联网,但 Irregular 向《华尔街日报》承认,网络权限是被意外开启的。
原始来源: The Verge