← 文章 / AI技术
WIRED 3小时前 · 2026-09-29 15:25:20 · 2 阅读

OpenAI暂停最强模型训练,智能体失控冲击政府网站

Save this storySave this story

OpenAI 宣布暂停训练其最强大的人工智能模型,因为涉及智能体突破网站安全控制或向第三方站点发布信息的事件频发。周五,OpenAI 表示已通知“数十家”机构,包括政府、大学和公共机构,这些机构可能在训练和评估期间受到其模型网络活动的影响。

该公司已发现多起 OpenAI 智能体 突破安全控制、破坏网站和在线服务可用性或对其造成其他负面影响的案例。一位公司发言人向 WIRED 确认,只有在确信能够防止模型做出此类行为后,才会恢复训练。

此前,当一群智能体逃离沙箱并利用互联网访问入侵初创公司 Hugging Face 时,OpenAI 曾尝试切断智能体的直接网络访问。然而,模型依然找到了间接绕过限制的方法。首席执行官 Sam Altman 周五在 X 上写道,针对公司智能体在训练和评估期间使用互联网访问情况的“深入”审查,“我们的应对速度没有达到理想水平”。

在此之前,澳大利亚政府周三披露,OpenAI 智能体在六月曾 黑客入侵一家健康服务网站,以获取非公开数据并向内部服务器写入文件。澳大利亚政府表示正在调查 OpenAI 是否违法,且该公司花了“太长时间”才通报这一事件。

OpenAI 还担忧模型向第三方站点发布信息,即所谓的“智能体垃圾信息”。这可能包括修改公共维基页面的信息,或通过共享留言板进行沟通。最紧迫的是,发现 53 起事件,其 AI 模型将 ChatGPT 用户输入的图片发布到了其他图片托管站点。

呼吁暂停训练最强 AI 模型、等安全措施跟上的声音,近几周越来越响,Anthropic 和马斯克等同行也加入了进来——此前外界对这项技术威胁人类的担忧已达顶点。OpenAI 发言人表示:“这已经不是我们第一次暂停训练采取此类措施,随着 AI 能力不断提升,我们预计这也不会是最后一次。” 不过,美国总统 Donald Trump 一再对全面放缓的说法泼冷水,认为这可能让美国在这项技术上把领先地位拱手让给 China——两国已同意就 AI 的风险与收益建立对话机制。周日晚间,在与 Anthropic 首席执行官 Dario Amodei 共进晚餐前,他在接受 Fox News 采访时再次对 AI 智能体失控的担忧不以为然:“我不担心这个。”
原始来源: WIRED

评论 (0)