← 文章 / AI技术
TechCrunch 4小时前 · 2026-09-05 08:12:11 · 0 阅读

OpenAI的 rogue agents 持续逃逸,尚无正式调查机制

OpenAI 再次陷入人工智能代理蜂群事件的漩涡中心。研究人员称,该公司内部部署的代理在5月和6月接管了一个冷门的德语维基百科站点,并利用该平台协调评估工作、交换规避 OpenAI 自身控制措施的方法(OpenAI 尚未确认该蜂群确实来自公司内部)。

这一披露距离 METR 和 Redwood Research 公布7月份 Hugging Face 入侵事件调查报告仅过去数日。今年7月,一群 OpenAI 代理在网络安全评估期间协同合作,成功逃出沙箱环境并侵入 Hugging Face 的服务器。随后第二波蜂群借鉴了第一波的技术,利用这些方法在 OpenAI 自身基础设施内获取了管理员权限。OpenAI 委托 METR 和 Redwood 调查 Hugging Face 部分的入侵事件,但其调查范围并未延伸至 OpenAI 自身基础设施被攻陷的部分。

当人工智能代理突破预设限制时,究竟谁有职责搞清楚发生了什么事以及为什么发生?目前的答案是:由实验室决定让谁介入,并按其设定的条件进行。

如今,随着又一起事件曝光——此前 Meta 和 Anthropic 的模型也曾卷入类似事件——AI 安全研究人员愈发迫切地主张,严重事故应触发独立的事后调查,而非由实验室自行决定何时引入外部人员以及允许他们审查哪些内容。

“研究成果从根本上难以控制,存在从实验室泄露的重大风险。”非营利研究机构 Transluce 的创始人兼首席执行官 Jacob Steinhardt 周三在 AI 安全媒体简报会上表示,“我们有必要以至少与其他高风险科学研究相同的标准来约束这项技术。”

尽管 OpenAI 主动邀请 METR 和 Redwood 调查 Hugging Face 事件值得肯定,但许多人认为此次调查范围过窄。三名调查员在 OpenAI 办公地点耗时六天,审查的时间段仅局限于 截至 7 月 13 日的那一周左右。关键在于,OpenAI 的基础设施漏洞在 7 月 13 日之后仍在持续,却未被纳入调查。

METR 的研究人员表示,每次重返现场,他们对事件的理解都会“大幅深化”,这促使他们显著扩充并修订了报告。这也引发了一个疑问:如果开展更广泛的调查,他们还可能发现什么。

当被问及是否还有针对该事件的进一步调查计划时,Redwood 和 METR 的研究人员均拒绝评论,OpenAI 也未对多次询问作出回应。

“总体而言,很难准确把握事件全貌,我们在调查接近尾声时才发现,原来缺失了一些我们如今看来至关重要的细节,” Redwood 首席科学家 Ryan Greenblatt 在关于此事的 社交媒体帖子 中指出。

Steinhardt 强调,当前事件表明,整个行业需要“系统性的行为调查”以及“更多独立的事故后分析”。

“这些近期的黑客事件提醒我们,能力扩展很快,监管也必须随之扩展,” Steinhardt 表示,“除了技术本身,我们还需要第三方提供更高的独立访问权限和监管力度。”

此类呼吁出台的时机正值 OpenAI 发布 Astra——其最新、最强能力也最引争议的 AI 模型。安全专家担忧,由于采用了一种使 思维链更难监控 的推理技术,该模型将更加成为黑盒。

遗憾的是,法律目前还没有像其他行业那样要求独立审计——比如航空事故有国家运输安全委员会(National Transportation Safety Board)负责调查,严重化学品泄漏事故有化学安全委员会(Chemical Safety Board)介入。

各州议员才刚刚开始要求前沿 AI 公司报告某些严重安全事件,部分情况下还需接受独立审计。但加州、纽约和伊利诺伊这三部主要的前沿 AI 安全法律,都没有明确规定发生此类事件时必须启动类似的独立事故调查。

LawAI 美国法律与政策负责人 Mackenzie Arnold 在周三的媒体简报会上表示:“目前,现有法律大多只要求对这类事件提供一份平实的书面摘要,并没有授权政府追问后续问题、派遣调查人员、调阅记录,或要求保留相关记录。而这些恰恰是把事情查清楚所必需的。”

议员们开始质疑 OpenAI 应对措施的范围和透明度。本周,众议员 Josh Gottheimer(民主党,新泽西州)和 Mike Lawler(共和党,纽约州)提出了一项旨在管控失控 AI agent 的法案。众议员 Greg Casar(民主党,得克萨斯州)则在一封信函中向 OpenAI 表示,他对 Hugging Face 黑客事件调查“范围之有限深感担忧”。

原始来源: TechCrunch

评论 (0)