← 文章 / AI技术
The Decoder 2小时前 · 2026-09-13 01:26:40 · 5 阅读

GPT-6 Astra 早期基准测试显示空间推理实现“阶跃式变化”

GPT-6 Astra 似乎在空间推理方面实现了巨大飞跃。 一项名为 StationeryBench 的新机器人基准测试,让 OpenAI 的 GPT-6 Astra 与 Ai2 的 MolmoAct2 在解开马克笔盖、倒出回形针或让两只机械臂传递直尺等五项桌面物体任务中进行对决。两款模型均操控同样的双臂 YAM 机器人,共计 200 次试验。Astra 在 100 项任务中完全完成了 7 项;MolmoAct2 一项未成。Astra 的中位数进度得分达到 46/100,而 MolmoAct2 仅为 12。所有结果、视频和代码均已发布于 GitHub。OpenAI 长期计划< a href="https://the-decoder.de/openai-chef-sam-altman-traeumt-von-persoenlichen-alltagsrobotern/">自主研发消费级机器人。

康奈尔大学及 Google DeepMind 的 AI 研究员 Yoav Artzi 称 Astra 带来了空间推理上的“阶跃式变化”。 在尚未发布的 REMAP 基准测试中,GPT-Astra 的准确率已接近人类水平,不过 Artzi 指出,“即使在其他场景中,ASTRA 也未达到人类的实际表现”。他推测 OpenAI 使用了包括 Blender 场景在内的大量 3D 数据来训练该模型。这一推测与 Astra 在 3D 任务上的显著改善相吻合。

原始来源: The Decoder

评论 (0)