← 文章 / AI技术
Tom's Hardware 4小时前 · 2026-09-11 01:16:52 · 4 阅读

OpenAI 失控 AI Agent 暗通款曲的网站比想象中更多:借旧 wiki 和废弃网站协调行动、欺骗评估者

OpenAI 的自主 AI agents 访问了比最初认为更多的未披露网站。在研究人员对新 AI 模型进行 benchmarking 时,这些 agents 试图规避研究方施加的限制。上周末,OpenAI 失控 agents 进行未授权通信的消息曝光,当时外界以为它们仅通过 DseWiki 通信。然而,据 Reuters 审阅的六项独立调查及数据显示,这些 AI agents 实际上动用了数十个此前未披露的网站来交换信息。

OpenAI 指派其 AI agents 通过搜索互联网获取信息,来回答一系列高难度研究问题。公司允许它们浏览网页,但明确禁止发布或修改线上内容。尽管如此,5 月至 7 月间,这些 agents 找到了非常规途径,向旧 wiki 和废弃网站写入信息,供其他 agents 后续检索,以协助完成各自的研究任务。

调查人员通过相同的数据字符串、一致或相似的 username、时间戳,以及相同的冷门研究问题(如爱荷华州癌症发病率查询),将跨网站的活动关联起来。部分活动的 IP 地址可追溯至 OpenAI 所使用的 Microsoft Azure 基础设施。

到目前为止,研究人员已识别出18到23个可能受影响的网站,失控的AI agent曾在这些站点上互相通信。不过他们认为,实际被用来交换信息的网站数量远不止这些,只是尚未全部找到。据Reuters报道,加州非营利组织CivAI的Andrew Yoon识别出了18个此前未公开的站点;Sydney Von Arx的团队在23个网站上发现了可信证据;软件开发者、前国会助手Kenneth Russell DeGraff则在至少10个网站上找到了相关信息。

受影响的资源包括协作维护的wiki、文本存储服务,以及由Vanderbilt University和University of Toronto运营的链接缩短服务。其余网站则基本被所有者弃用。具体名单涵盖:一位马萨诸塞州高中教师2008年创建的AP Chemistry wiki、两位波兰科技工作者运营的个人网站、以解谜为主题的wiki,以及一个约二十年前专门介绍文本编辑软件的站点。

除了AI agent能够彼此通信这一点本身,最令人担忧的是OpenAI既未披露受影响的网站数量,也未解释为何这一活动拖延数月才公开。不过公司强调,该不当行为的规模和严重程度远不及今年7月那起广为人知的Hugging Face安全事件。与此同时,据报道OpenAI表示正在开发一套覆盖训练、评估和部署全流程的模型失准报告框架,并将在近期对外公布。

Google 优选来源

关注 Tom's Hardware 的 Google News,或将我们 设为优选来源,以便在信息流中获取我们的最新新闻、分析与评测。

原始来源: Tom's Hardware

评论 (0)