← 文章 / 行业与公司动态
Interconnects 2小时前 · 2026-08-29 05:08:12 · 1 阅读

开源模型的六个月倒计时

一场对开源 AI 生存能力迄今最严峻的考验,此刻正在上演。自 ChatGPT 发布以来,我已目睹一波又一波反开源 AI 的论调来了又去,但没有哪一波在潜在执行手段上,能与针对当日同类闭源模型已经落地的真实行动明显对应。这一次更真实,因为新形式的监管正在缺乏监督的情况下被测试和实施。在这波风潮过去之前,我会比平常写多得多的政策向文章。

截至本文撰写时,许多消息源都在引用白宫围绕如何以一纸新行政令管理开源模型的讨论。这里没有任何官方信息,而且它大概率只会影响 a) 中国来源的模型和 b) 政府使用场景,但多米诺骨牌就是这样开始倒下的。

开源模型缺少一个核心的经济利益代言人,来为「针对它们采取行动」的潜在代价发声。从围绕 Fable(以及后来的 GPT-5.6)模型许可协议事件的近期报道来看,关于 6 月 9 日那天到底发生了什么,有了更多披露:

据一位了解会议情况的人士透露,会上有人提到了该计划将如何对待开源 AI 模型的话题。这位人士说,总部位于美国的开源模型提供商 Reflection AI 的一名代表主张,开源模型应基于其能力在该框架中获得豁免。当前,DeepSeek 等中国开源模型较其他可用的开源模型拥有显著领先优势,而 Reflection 尚未发布公开模型。

在这里搞任何形式的禁令,对 AI 的长期发展轨迹都将是一个巨大错误

最可能出台的行动,是禁止或无限期推迟任何能力显著超过 GPT 5.5、Claude Opus 4.8 或 GLM-5.2 这一量级的开放权重模型。考虑到稳定存在的能力差距,这应该就发生在未来 6 个月内。

就现状而言,这样的模型多半会来自中国公司,而这正是「前沿开源模型能力」的讨论不可避免地与蒸馏(distillation)等其他议题纠缠在一起的原因。政府「审查权」的能力门槛会随时间推移而上移,但一旦确立,开源模型的门槛推进速度大概率会远慢于闭源模型。部分原因是闭源模型更容易做好安全防护,但也因为闭源模型公司的游说有效性高得多。

于是,我们身处这样一个局面:两场关键的政策讨论同时展开,都在冲击开源模型——蒸馏与前沿能力。二者在性质、应对的必要性以及可能的应对空间上都截然不同。尽管如此,它们合在一起,构成了一个迅速高涨的支持平台的话术要点,指向未来 6 个月内对开源模型的潜在禁令。

如今推动监管的首要动因,是一个无法回避的事实:很快就会有开放权重模型达到 Claude 的 Mythos 模型的能力水平。这个公开发布的模型实际表现可能更加参差不齐,但只要它在新设立的白宫 AI 模型检查器中被标记一次,就够了。由恐惧催生的新习惯,是很难回退的。

分享

当下的蒸馏争论就是监管俘获,暂时按兵不动并无不妥

事到如今,蒸馏之争在很大程度上就是一场监管俘获(regulatory capture)行动,因为摆上台面的方案只会让推动它的机构大获其利。

具体展开说:这场反中国模型的政治行动由 Anthropic 领衔,他们一面发布博客文章,一面向议员递送联名信,详陈中国公司的所作所为。Anthropic 检测到外国公司在使用其服务——说白了,就是有人上门付钱调它的 API——最终干脆切断使用,然后写下措辞强硬的政策行动建议,而给出的技术证据却少得可怜。这场行动也许源于真实的商业顾虑,但它已演化为监管俘获的标准定义:倘若被它指控的中国模型厂商遭到封禁,Anthropic 的产品将获得可观的经济安全感。

如果 Anthropic 以更中立的「怎么办由你们判断」的姿态呈现信息,社区本会报以多得多的同情。但在一门快速演进的技术前沿上,这与其说是信息共享,不如说是一份政策建议。如果 Anthropic 的技术真如他们自称的那般强大——强大到类似的开源模型或许都该被封禁——那他们理应守得住自己的 API。我仍在等他们解释为何做不到。他们总有一句话要收回去。

Anthropic 还在以其他方式抽掉通往智能的梯子——因此,他们以对华竞争之名提出的政策建议,与一个广泛得多的模式一脉相承:以安全之名,限制他人获取相关技术与竞争对手。当许多员工即将迎来世代财富时,让他们认同「格外注重安全」这类公司文化是很容易的。我并不责怪员工,但理解 Anthropic 的公司战略,必须放进这些更宏大的语境里。Ben Thompson 的文章《Anthropic's Safety Superpower》是这个话题上最好的文字。

Anthropic 实际上在要求的,是在美国全面封禁几乎所有中国开放权重模型——因为任何围绕开源模型构建的产品,都以模型的持续改进为前提,随着模型变强,产品市场契合度与算力效率也会水涨船高。这将摧毁正在美国成形的开源模型经济:推理公司、微调公司、新产品,以及介于其间的一切。作为社区,我们迫切需要守住一条底线:在蒸馏议题上做出任何让步都是不可接受的。

Anthropic 应当设法保护自己的知识产权,但不该要求政府把自己的地位钉死,并在此过程中可能让美国与全球开源社区相互隔绝。以我们掌握的信息而论,除了让实验室自我约束之外,蒸馏问题并没有好的解决方案。

关于蒸馏,我专门写过很多。我直接写过它对模型能力的影响和它对监管环境的影响,更多论述散见于 Interconnects 的字里行间,欢迎检索。

Interconnects AI 是一份依靠读者支持的刊物,欢迎考虑订阅。

订阅

API 并非天然安全

蒸馏的讨论有一处特别的混乱:人们确实有切实的担忧,担心中国实验室会把 Mythos 狭义的网络安全能力蒸馏进开源模型。但这更多折射的是当前模型 API 的不安全,而非蒸馏风险本身。早在 Claude Mythos 还处于限制最严的私测阶段时,就出现了《Discord 侦探未经授权访问了 Anthropic 的 Mythos》一事。时至今日,模型 API 仍在不断被越狱、被以非预期的方式访问。

比起任何涉及对 1T+ 参数模型做复杂微调的路径,这种途径会让能力落入坏人之手的速度和广度大得多。我不是网络安全专家,但「只有开放权重模型不安全、API 才安全」这种二元对立,近年来被夸大得太厉害了。API 在概念上理应可以更安全,但这一点至今尚未被证明。

如果 Anthropic 的模型里真的存在某种危险能力,那么在讨论它是否会被蒸馏之前,唯一自洽的做法就是不要把它挂在一个可直接查询的 API 上。

不管准备好了没有,开源模型都来了

真正的难处在于:就在这些蒸馏问题发酵的同时,我们又迎面撞上另一个问题——「当前沿开放权重模型的通用能力达到 Mythos 水平时,我们该怎么办?」这是个难题,而人的天性就是想把针对另一个问题(蒸馏)提出的解决方案,套用到这个新出现的、真实得多的问题(前沿能力)上。

我们需要为开源的前沿能力找到正确的政策,但一刀切的全面禁令很可能不是答案。如果这些模型在中国没有被同样封禁,坏人依旧能轻而易举地用上被禁的开放权重模型,安全上的意义也就化为乌有。

与此同时,如果只有我们单方面禁止某些模型的进口,全球开源社区仍将继续前行。若美国抢在中国、或其他对风险更敏感的文化之前禁掉这些模型,那多半意味着某种形式的 AI 恐慌贩卖(或其他社会、政治动能)推动了美国政府过早出手。这感觉像是在给美国的反乌托邦进程按下快进键:我们的科技产业——经济的皇冠明珠——在管制与政府投资层面上,看起来越来越像一个中国式体系。这些是非常糟糕的结局!

给开源进展加上天花板的唯一途径,是一份关于 AI 模型风险管理的全球协议,而我们离它还很遥远。其他任何拖延,只会让 AI 在美国的铺开更难预测、愈发混乱。那感觉会很像 GPT-5.6 的发布,只不过这一次,不只是把开放、廉价智能的红利限制在少数几家公司手里,所有坏人也将立刻获得访问权。开源模型靠广泛的获取与理解来增进安全,而不是只捆住正面行动者的手脚。

现实中,开源生态的脚步无可阻挡。打造最好模型的人同样在评估风险——中国对风险相当敏感,例如 Z ai 已经是上市公司,暴露在全方位的压力之下,仅举一例:还得撑住一路飙涨的股价。会有越来越多的模型越过令人不安的能力线。训练 AI 模型不是魔法,而且尽管所需投入不断攀升,我们(至少目前)还没有看到造模型的可及性因此收窄。

这场开源政策死亡螺旋——一连串相互关联、互为补充的可怕议题拧成的双螺旋——的短期出路之一,是由一家美国公司发布能力相当的开放模型。这将把焦点从「只有中国在借蒸馏造开源模型」转向「我们都在同一条船上,应当聚焦我们自己生态内复杂而流动的前沿问题」。这是开源的生死存亡要务;那些有商业理由发布开放权重模型的公司——例如 Microsoft 和 Meta(将其互补品商品化)——应当立刻行动。对新领导层治下的 Meta,我信心有限,但他们受益于 AI 的大规模普及,不该自己挡自己的路。如果 Reflection 手里握着一个还行但够不上前沿的模型,他们或许得把它发出来,才救得回自己拟议的业务方向。

比训练一个新模型更快的解法,是组建联盟。开源是一项弥散化的技术,没有清晰的归属,但收益将由非常多人共享。前沿实验室之外的「所有其他人」需要从今天就开始行动,谋划如何继续安全地推进开放权重模型的落地(并为其原则与价值观展开游说),去打动当权者。

AI 舆论的温度正在升高

本文为付费订阅者专属

订阅已是付费订阅者?请登录上一篇下一篇
原始来源: Interconnects

评论 (0)