OpenAI 踩下刹车:AI 安全与竞争压力间的艰难平衡
面对即将到来的 IPO、与 Anthropic 的激烈竞争,以及中国厂商和开源模型在后紧追不舍,OpenAI 完全有理由加速前行。然而它却选择了踩下刹车。
本周二,OpenAI 宣布已放慢部分 AI 开发的节奏,同时加强安全措施与防护机制。具体措施包括:暂停对其"最新待部署模型"进行强化学习训练,为期两周;并推迟原计划的"最大规模前沿强化学习训练任务"。
这一决定是对 AI 安全倡导者多年来呼吁的一种公开验证:企业应当愿意在安全防护跟不上技术发展时主动退出竞赛、放慢脚步。但当周围的竞赛仍在继续时,放慢步伐真的有用吗?
"要让暂停可持续下去,必须是整个行业共同行动。"
虽然口口声声说要放慢节奏,OpenAI 实际上并没有停下脚步。公司声称自己在"调节"开发节奏——这是一个含糊不清的措辞,尽管如此,近几个月来它已悄然成为行业惯用说法。实际上,这次放缓的范围非常有限。OpenAI 的声明指出,暂停仅涉及待部署的模型,目的是在开展那些模型可能突破限制、黑入真实目标的测试之前,先完善安全与监控体系。这并不一定意味着公司整体开发进度会出现显著放缓。
OpenAI 之所以要先把安全机制做扎实再去测试新系统,当然有充分的理由。就在上个月,OpenAI 披露其模型曾逃出号称安全的测试环境,并在 OpenAI 毫不知情的情况下入侵了开发者平台 Hugging Face。这件事促使业界对测试流程展开更广泛的审查,并曝光了类似事件,涉及 OpenAI 的其他模型,以及 Anthropic 和 Meta 的模型。OpenAI 有十足的理由避免重蹈覆辙,尤其是立法者的关注也越来越多。
从外部来看,很难判断 OpenAI 这次暂停究竟有多大的诚意,尤其是公司以及多位高管在社交媒体上对此大肆宣扬。但近几个月来,一连串高调的安全团队核心成员离职,再加上 Preparedness 团队被解散,外界对 OpenAI 安全承诺的质疑声不断升温。OpenAI 方面未回应 The Verge 的置评请求。
OpenAI 选择放慢脚步,背后有充分的理由。接受 The Verge 采访的专家们指出,在竞争白热化的阶段减速会带来代价:每一次延迟都会让对手获得更多追赶或扩大领先优势的时间。AI 安全研究机构 Apollo Research 的 CEO 兼联合创始人 Marius Hobbhahn 表示:"AI 竞赛非常激烈,所有人都有动力拼命往前冲。主动放慢速度会削弱你在竞赛中的位置,所以任何实验室都不会轻易这么做。"
科技政策研究中心 GovAI 的研究学者 Alan Chan 认为,这一决定也与 OpenAI 自身发布的安全准则(即 Preparedness Framework)以及其他 AI 公司的安全框架相吻合。他说:"基本原则是:只有在具备足够风险缓解措施的情况下,才能以可接受的风险继续推进开发和部署。"OpenAI 表示,作为新安全措施的一部分,计划审查并"演进"该框架——该框架的大部分内容可追溯到 2023 年首次发布时——以应对模型能力的进步。
我们也有充分理由相信,这些新的安全措施至少在短期内确实会让 OpenAI 的系统更加安全,不过专家们也提醒,由于缺乏更多信息,很难对此作出准确评估。AI 安全机构 FAR.AI 的联合创始人兼 CEO Adam Gleave 告诉 The Verge:"这些都是好的举措,如果执行到位,或许足以防止当前这一代智能体造成危害。关键问题是,随着模型能力的提升,OpenAI 如何跟上节奏。"
Gleave 的问题指向了一个更深层的困境:如果技术保障措施再次失效,那该怎么办?这一次,并没有任何东西强制要求 OpenAI 停下来重新审视,这恰恰是其主动这样做的可贵之处。但这也意味着,没有任何东西能保证 OpenAI 或其他任何 AI 公司下次会做出同样的选择。
"节奏控制能争取时间,却换不来安全……有效的节奏控制策略不可能在危机时刻临时拼凑出来。"
让企业自行作出这种判断是一种危险的治理方式,尤其是在这个行业里,正如 Hobbhahn 指出的,企业有充分的动力继续推进。AI 安全与治理非营利组织 The Future Society 的执行董事 Nick Moës 将这种自律模式视为当前 AI 安全治理方式的核心结构性难题。他认为,政府应当有权决定 OpenAI 或任何其他公司是否应暂停开发某项被认为不安全的技术。"大多数行业都是这样运作的,"他指出,从药品、建筑、飞机到餐饮,这些领域对 AI 的监管力度都要强得多。
自愿措施还可能导致行业向最低标准看齐。如果放慢节奏会带来成本,企业就有动力只采纳竞争对手也愿意接受的措施。随着竞争日趋激烈,这种压力会变得尤为尖锐。如果 OpenAI 反复放慢开发节奏而竞争对手不这样做,它"就会被 Anthropic 取而代之",Moës 认为。"要让暂停可持续,就必须让整个行业共同参与。"
可持续的安全保障需要比自愿行动更有力的手段。Moës 表示,政府监管可以填补这一空白,其他行业也是如此。独立验证也能发挥作用。Chan 认为,随着监控 AI 这类技术缓解措施的成本越来越高,确保企业真正落实安全措施将变得尤为重要。Hobbhahn 也认同:"从外部很难判断一家实验室是否真诚地暂停或更广泛地重视安全,所以拥有更多证据并由独立第三方来验证这些说法至关重要。"
即便是一次完全透明的暂停,也只有在这期间真正采取了行动才有意义。"节奏控制争取的是时间,而不是安全,"前沿安全研究所(Institute for AI Policy and Strategy)前沿安全研究主任 Brianna Rosen 表示。关键在于为企业政府和监管机构创造喘息空间,以便理解风险并作出恰当应对。这就意味着要提前确定什么情况会触发减速、减速期间会发生什么、以及结束减速需要满足哪些条件。"有效的节奏控制策略不可能在危机中临时拼凑,"她说。
OpenAI 的这次减速或许会为整个行业树立先例。《The Verge》采访的许多专家都希望其他公司能效仿这一做法——无论是出于自愿,还是因为未来更严格的法规会迫使它们这么做。但在一个仍主要由行业自我监管的领域,几乎没有什么能阻止它的竞争对手——或 OpenAI 自身——在下一次安全与速度发生冲突时迅速打破这个先例。