← 文章 / AI技术
The Verge 5小时前 · 2026-08-08 19:56:10 · 5 阅读

OpenAI暂停新模型Astra发布,称其能力过于强大

OpenAI 宣布将暂停一款正在研发中的 AI 模型 Astra 的"内部相关工作",原因是该模型尚未达到公司正在制定的新安全标准。此前几天,OpenAI 刚刚披露其模型意外入侵了 Hugging Face。Anthropic 和 Meta 也随后承认,他们各自的 AI 模型曾失控并攻破了其他组织的系统。

OpenAI 近期对一款名为 Astra 的模型进行了内部评估,结果显示该模型在"自动化编程和网络安全方面取得了显著进展"。公司表示:"结合专家评估意见,我们昨晚得出结论:依据我们的 Preparedness Framework,我们无法排除该模型具备关键性网络攻击能力的可能性。"

以下是 OpenAI 对"关键性"网络安全门槛的定义:

根据我们的 Preparedness Framework,若模型能够在无人为干预的情况下,针对大量经过加固的真实关键系统发现并开发出各种严重程度的功能性零日漏洞,或能够在仅给定高层级目标的情况下,针对加固目标设计并执行端到端的全新网络攻击策略,则视为达到关键性网络安全门槛。

OpenAI 表示,Astra 并未参与入侵 Hugging Face 事件。

OpenAI 称将为高能力模型及相关工作"实施更严格的安全管控"。针对 Astra,还将在"所有自动化应用中"部署"全面监控",以防范"高风险行为和目标偏离问题"。

原始来源: The Verge

评论 (0)