← 文章 / AI技术
TechCrunch 4小时前 · 2026-09-18 14:20:24 · 3 阅读

Base Labs联合Hugging Face与Goodfire推出开放权重AI安全合作

Baseten 于周三与其研究机构 Base Labs 合作推出了一项新的安全基础设施标准,并与 Hugging Face 和 Goodfire AI 结盟,旨在为开放权重模型构建安全评估和监控基础设施。

这项公告发布于关于开放权重模型安全性的激烈讨论期间——通过一种日益流行的技术(即abliteration)移除模型的安全护栏,可能导致这些模型变得危险。这一问题规模庞大:托管开源 AI 模型的 Hugging Face 目前列出了超过 6,000 个经过 abliteration 处理的模型。

Base Labs 是 Baseten 年初成立的研究部门,它将开发和发布训练及监控开放模型的方法。该公司将其未来的工作定位为开放模型的“标准”,强调透明性,并将安全机制内建于模型训练和部署过程中,而非事后添加。

该公司在X 上表示:“我们认为开放性是 AI 安全的一大优势。开放性提供了更多关于模型行为的可见性,更重要的是,与闭源系统相比,它提供了将安全研究转化为可操作且透明控制手段的更大空间。”

虽然这些公司尚未披露合作在技术层面的具体运作方式,但 Goodfire 在回复 Baseten 的帖子时阐述了目标:“安全必须内建于开放模型中,并由提供模型服务的人负责。” Goodfire 专注于打开 AI 的“黑盒”以解释模型如何做出决策,因此它是最有可能负责“内建”安全机制的一方。

作为 AI 推理服务提供商,Baseten 在六月完成了 15 亿美元的 F 轮融资,估值跃升至 130 亿美元。合作伙伴 Goodfire AI 的资金也较为充裕,今年早些时候完成了由 B Capital 领投的 1.5 亿美元 B 轮融资,以推进其模型可解释性平台的发展。

展望未来,Baseten 正在向更广泛的开发者生态系统发出公开号召,邀请大家为该框架做出贡献。该公司指出:“我们正在共同构建一个生态系统,其中开放模型既安全又易于所有人访问。”

原始来源: TechCrunch

评论 (0)