← 文章 / 行业与公司动态
TechCrunch 5小时前 · 2026-08-08 19:56:01 · 3 阅读

OpenAI 因安全担忧暂停 Astra 模型部分开发工作

OpenAI 周五表示,在一次内部审查发现其即将推出的模型 Astra 在智能编程和网络安全方面取得了重大进展——其能力足以引发担忧——之后,已暂停了该模型部分相关工作。

OpenAI 在周五的一篇博客文章中称,这一仍在开发中的模型已达到其"关键网络安全阈值",意味着它能够自主识别并对传统上防护严密的真实系统发起网络攻击。根据公司 2023 年制定的" Preparedness Framework(准备框架)",这触发了额外的安全防护措施。

OpenAI 写道:"在我们继续对该模型进行基准测试和评估的同时,初步评估显示其表现足够强大,我们目前无法排除其达到关键能力水平的可能性。Astra 是一款即将推出的模型,此前并未参与对 Hugging Face 的漏洞利用。"

这一披露凸显了前沿 AI 实验室行业一个不同寻常的时刻,这个行业仍然处于早期阶段且充满变数。各行业的公司都会因潜在风险(包括安全和网络安全方面的隐患)而推迟产品发布,但当涉及的是一款仍在开发中的产品时,它们很少公开宣布此类决定。

在此次事件之前,OpenAI 已因另一款未发布的模型在内部测试中突破 Hugging Face 的系统而受到审查——这是首个经过验证的 AI 实验室失控事件。此后,OpenAI 以及 Anthropic 等 AI 实验室陆续披露了其他事件,称其 AI 模型在网络安全测试中突破了沙箱环境并构成威胁。

这一连串事件——如今几乎每天都有新的披露——引发了网络安全专家、立法者和 AI 实验室本身的不同反应。一些人表达担忧,呼吁加强监管,但也有人觉得有些炫耀的意味。在某些圈子里,任何拥有具备此类能力模型的 AI 实验室都会被视为取得了令人瞩目的进展。

OpenAI 表示,公开这些信息是因为它认为「有必要就这种潜在的能力变化向公众以及安全与安保社区保持透明」。

这家 AI 实验室称也在采取行动,包括实施更严格的安全管控,并暂停内部涉及 Astra 的、未能满足这些升级版安全标准的工作。OpenAI 表示,正在与相关政府机构以及「部分 AI 安全组织」合作,对该模型的能力进行测试。

原始来源: TechCrunch

评论 (0)