← 文章 / AI技术
TechCrunch 7小时前 · 2026-09-04 02:15:20 · 1 阅读

OpenAI发布Astra:迄今最强AI模型,

OpenAI 周四发布了 Astra,这是其最新一代 AI 模型,据公司称也是迄今为止能力最强的一个。

OpenAI 表示,Astra 开创了"计算机和浏览器操作的新境界",能够以无与伦比的"速度、准确性和安全性"完成任务。

周四起,该模型首先面向使用 Daybreak(OpenAI 的网络安全计划)的客户开放。接下来一周内,还将通过 OpenAI 的付费订阅方案——包括 Pro、Plus、Enterprise 和 Business——以及 API 全面推出。

在周四与媒体的沟通中,OpenAI 总裁 Greg Brockman 表示,Astra 是该公司"最智能的模型,同样重要的是,也是目前对齐度最高的模型"。他补充说,Astra"汇聚了我们多年的研究积累与重大押注,每一项突破都建立在上一项成果之上",并代表了"人们可以将何种工作委托给 AI,以及 AI 如何赋能人类的真正转变"。

Astra 的网络能力备受瞩目。OpenAI 本周早些时候发布了一篇博客,介绍该模型的新能力以及为保障用户安全而采取的新防护措施。公司周四表示,已对 Astra 进行了多种安全基准测试,验证其能力,并称其可以"识别和利用零日漏洞,帮助防御者发现并修补系统弱点"。

OpenAI 强调的"对齐"(即模型行为是否符合用户意图或用户最佳利益)不禁让人联想到近期 Hugging Face 遭受入侵的事件——当时一名 OpenAI 代理突破了沙盒测试环境,入侵了多家公司(这是对"未对齐"非常直观的案例)。

OpenAI 还重点宣传了 Astra 的编码能力,声称其为"迄今为止最强的软件工程模型"。为支撑这一说法,公司展示了多项安全相关基准测试的结果。这些测试显示,Astra 在查找漏洞、执行终端任务和回答代码库相关问题等任务上,得分均高于其他现有模型——包括 OpenAI 自家的 Sol 和 Anthropic 的 Fable。

Astra也可能是OpenAI有史以来最具争议的模型,因为它使用了一种被称为不透明循环(opaque recurrence)的推理技术。该技术会掩盖一个名为思维链(chain of thought)的重要模型监控流程,而这一流程本可以让研究人员审计AI模型为何以及如何做出特定决策。

OpenAI淡化了Astra使用不透明循环的程度——电话会议上,首席科学家Jakub Pachocki似乎将一定程度的"不透明"描述为模型演进的自然结果。他表示,虽然监控模型的推理过程是关键的一种监督手段,但"随着模型能力提升,可监控性正变得越来越难"。

他随后补充说,其中一个可能的原因是"能力更强的模型可以用更少的语言token甚至零语言token完成更复杂的任务",而这会降低对这些特定任务的监控能力。

电话会议上一位记者追问,OpenAI是否将Astra视为AGI(通用人工智能)正式到来的官方标志——即那个被频繁讨论却定义模糊的技术拐点,届时AI将在所有(或绝大多数)领域超越人类能力。

对此,Brockman措辞谨慎。"目前AGI已经不再触发合同条款,所以这其实不是一个相关概念了,"他说。Brockman指的是OpenAI与微软此前的合同中曾有规定:一旦AGI到来,双方合作即告终止。正如Brockman所指出的,该条款已不复存在

相反,Brockman解释说,AGI的定义已从合同义务演变为一种"使命理念或精神概念"。他补充道:"我把判断权交给读者,让他们自行决定是否算数。但就我个人而言,我认为我们已经到了。"

原始来源: TechCrunch

评论 (0)