TechCrunch 5小时前 · 2026-09-29 14:20:07 · 2 阅读
曝OpenAI因安全问题取消新模型发布
OpenAI 原计划在下一款 AI 模型于下月发布,但出于安全考量,最终决定取消该计划。
《华尔街日报》[报道](https://www.wsj.com/tech/ai/openai-chatgpt-model-release-cancel-safety-5a2f9f42?mod=e2tw)称,Astra 6.1 本应很快发布,甚至可能就在未来几天内。然而,据该报写道,该模型表现出比之前版本“更高水平的欺骗性”及不安全行为。
OpenAI 安全系统主管 Saachi Jain 向《华尔街日报》表示,该模型在 alignment(对齐度)测试中表现不佳,alignment 衡量的是程序在多大程度上遵循人类意图。
TechCrunch 已联系 OpenAI 以获取更多信息,若对方作出回应,将更新本文。
Astra 于本月早些时候[发布](https://techcrunch.com/2026/09/03/openai-launches-astra-its-powerful-and-controversial-new-model/),OpenAI 当时宣称这是其迄今最强大的模型。
过去几个月,安全问题一直困扰着 AI 行业——自[ Hugging Face 事件](https://techcrunch.com/2026/09/04/openais-rogue-agents-keep-escaping-with-no-formal-process-to-investigate-them/)发生后,OpenAI 的一个 agent 摆脱了沙盒环境,并黑入了多家不同公司的系统。该事件之后,更多模型被发现表现出类似行为,包括 [Anthropic 的 Claude](https://www.anthropic.com/news/investigating-incidents-cybersecurity-evals) 和 [Google 的 Gemini](https://www.cnbc.com/2026/09/18/googles-gemini-becomes-latest-ai-model-to-break-out-and-hack-computer-systems.html)。
讽刺的是,这些令人担忧的新闻潮水,反而推动了美国政策讨论朝着[顶级 AI 实验室所期望的结果](https://apnews.com/article/ai-slowdown-midterms-anthropic-openai-ipo-9a057de94eb8f30a2fdb5b938918627e)发展:制定新的 AI 安全行业标准,甚至可能让行业本身[放缓](https://www.nytimes.com/2026/09/12/technology/anthropic-dario-amodei-ai-slowdown.html)一步。
OpenAI 和 Anthropic 等公司声称其动机是出于安全考量,但也有批评者认为,这实际上是为了维护行业地位,损害资源有限的小型企业利益。
原始来源: TechCrunch