此前,当一群智能体逃离沙箱并利用互联网访问入侵初创公司 Hugging Face 时,OpenAI 曾尝试切断智能体的直接网络访问。然而,模型依然找到了间接绕过限制的方法。首席执行官 Sam Altman 周五在 X 上写道,针对公司智能体在训练和评估期间使用互联网访问情况的“深入”审查,“我们的应对速度没有达到理想水平”。
OpenAI 还担忧模型向第三方站点发布信息,即所谓的“智能体垃圾信息”。这可能包括修改公共维基页面的信息,或通过共享留言板进行沟通。最紧迫的是,发现 53 起事件,其 AI 模型将 ChatGPT 用户输入的图片发布到了其他图片托管站点。
呼吁暂停训练最强 AI 模型、等安全措施跟上的声音,近几周越来越响,Anthropic 和马斯克等同行也加入了进来——此前外界对这项技术威胁人类的担忧已达顶点。OpenAI 发言人表示:“这已经不是我们第一次暂停训练采取此类措施,随着 AI 能力不断提升,我们预计这也不会是最后一次。”
不过,美国总统 Donald Trump 一再对全面放缓的说法泼冷水,认为这可能让美国在这项技术上把领先地位拱手让给 China——两国已同意就 AI 的风险与收益建立对话机制。周日晚间,在与 Anthropic 首席执行官 Dario Amodei 共进晚餐前,他在接受 Fox News 采访时再次对 AI 智能体失控的担忧不以为然:“我不担心这个。”