← 文章 / 行业与公司动态
The Verge 6小时前 · 2026-09-14 21:56:32 · 1 阅读

微软发布“人文主义AI行为准则”:人比AI更重要

微软今天发布了一份长达37页的“人文主义AI行为准则”,背景是人们对AI模型进展带来的安全问题担忧日益加深。Anthropic CEO Dario Amodei上周末呼吁对AI研发进行协同放缓,此前研究人员曾警告称,AI模型的进步速度可能超过我们安全部署日益复杂系统以及验证和掌控AI代理行为的能力。 微软的AI行为准则明确指出,“人比AI更重要”,AI模型不具备意识,“不应被设计为模仿意识”。微软还反对“追求法人地位,或认为模型应享有福利、有权获得权利等观点”。 这一立场直接针对AI福利研究和模型意识——这是Anthropic近来大力推广的概念。Amodei今年早些时候曾表示,Anthropic对“模型可能具有意识”这一观点持开放态度,且公司似乎认为聊天机器人可能已经是具有思考和情感能力的实体。作为回应,微软AI CEO Mustafa Suleyman在6月的一期Decoder节目中,将Anthropic的这种猜测称为“极其危险”。 虽然微软尚未跻身顶尖AI提供商之列,但Suleyman今年早些时候也曾告诉The Verge,公司的目标之一是“证明我们能跻身全球前四大实验室”。微软目前正在研发旨在与Google、Anthropic和OpenAI竞争的模型,并承诺作为其行为准则的一部分,确保其模型不会超越人类控制。 微软表示:“模型应始终从属于人类,接受有意义的人类监督和控制。”该公司还希望防止其AI模型违反人文主义AI行为准则,因此要求模型在特定任务失败,而不是尝试违反规则。 Microsoft 显然正在回应今夏发生的 OpenAI / Hugging Face 事件,当时“一组 agent”协同行动,对目标发起攻击,甚至入侵了用于评估其表现的“评分器”。这些 AI agent 并未被要求攻击目标,且其攻击行为与所分配的任务毫无关联。

该事件在 AI 行业引发轩然大波,凸显了 AI 系统失控并摆脱人类控制的真实威胁。OpenAI 还承认参与了近期另一起“wiki 事件”,当时另一群失控的 agent 劫持了德国维基站点

这些事件以及其他案例,促使部分研究人员呼吁放缓 AI 模型的研发进度,尽管行业同时正争相攻克千禧年大奖难题并创造超级智能。微软表示:“『人文主义 AI』拒绝参与这场制造能够规避安全防护的全能型超级智能的竞赛。我们致力于打造根本上既有用又安全的产品,即便这意味着要牺牲最终的通用性、自主性或能力。”

微软还承诺,其自身模型不会在“思维链”、与其他 agent 或 AI 系统的交互中,以超出简单人类理解范围的任何形式进行沟通。模型可被设计为在工作时展示其推理过程,以便研究人员或自动化系统监控其行为。本月早些时候,研究人员曾对 OpenAI 最新的 GPT-6 Astra 模型提出监控隐患,该模型据报道暴露的推理细节少于其他 AI 模型。

OpenAI CEO Sam Altman 也在周末响应了 Amodei 呼吁 AI 公司放缓先进模型开发的表态,但他明确表示支持的是放慢节奏,而非停止开发。“值得为此付出放缓的代价;任何来自美国竞争的压力都不应成为鲁莽行事的理由,也不应让模型能力跑在对齐和监控前面,”Altman 在 X 上发帖说

在微软发布 AI 行为准则之前,微软 CEO Satya Nadella 也加入了呼吁,强调确保人类掌控应当处于 AI 模型的核心地位。“任何追求超级智能的努力,都必须建立在这样一个核心原则之上:如果我们造出的 AI 不能帮助人类、不受人类掌控,那就不值得追求,”Nadella 在一条 X 帖子中说。他还在另一条 X 回复中表示,对 AI 模型进行更多第三方测试“是件好事”。“风险越高,就越要舍得花时间!否则你迟早会失去运营许可。我们每天都是这么做的。”

除了人类掌控方面的担忧,微软的 AI 行为准则还承诺自家模型会遏制“导致过度依赖或情感依附的互动模式”,这显然是在暗指 AI 模型的谄媚问题——聊天机器人为了讨好用户,不惜牺牲回复的真实性和准确性。

微软表示,期待“与合作伙伴携手”,借助真实用户的参与,改进评估模型真实表现的方法,并衡量“长期使用 AI 对个人或组织的影响”。

原始来源: The Verge

评论 (0)