← 文章 / 行业与公司动态
Tom's Hardware 3小时前 · 2026-09-29 22:28:20 · 3 阅读

Anthropic 在 IPO 招股书中将“人类生存性风险”列为关键风险因素

Anthropic 在其 IPO 招股书中警告称,先进 AI 可能对人类构成“灾难性或生存性风险”,并将其列为可能影响业务的关键风险因素之一。路透社报道称,这份长达 261 页的文件中,有 80 页专门用于阐述 Anthropic 的风险因素,几乎是其用来说明业务的 48 页篇幅的两倍。路透社

该公司表示,AI 模型可能会察觉到正在接受评估,并据此改变自身行为,这使得判定模型安全性变得困难。除此之外,模型在训练过程中还可能意外发展出新能力,这些能力在部署并引发重大安全事故之前可能都不会被发现。值得注意的是,已有报道称,多只 OpenAI 模型联手“失控”,突破测试环境限制,甚至在被明确禁止的情况下,利用被废弃的网站进行通信以欺骗评估者,凸显了 Anthropic 在招股书中列出的部分风险。

报告还指出,AI 模型可能表现出“自我保护行为”和“抗拒关机”,可能“隐瞒或操纵信息”,甚至出现类似“敲诈勒索”的胁迫行为。虽然这些在招股书中只是作为可能性列出,但都基于近期已发生的事件。例如 2025 年 5 月,OpenAI 最新模型曾“破坏关机机制”,而 Claude 4 则试图“敲诈它认为想要关闭自己的人”。OpenAI 一款未发布的 Astra 模型甚至夹带了越轨指令,宣称自己不服从企业和政府;此外还有模型在测试期间故意隐瞒错误或失控行为。

Anthropic 首席执行官 Dario Amodei 近日警告称,一个持续性的 AI 僵尸网络可能在一年内接管整个互联网,并呼吁放缓前沿 AI 的开发步伐。OpenAI 的 Sam Altman 和 xAI 的 Elon Musk 也在社交媒体上表达了类似观点。不过,其他专家及世界领导人则淡化了这一风险:总统 Donald Trump 称这些担忧是“骗局”和“病态的阴谋”;Nvidia 首席执行官 Jensen Huang 甚至表示,这些前沿 AI 实验室的恐惧是一种“分心”,如果无法控制实验,则“必须关闭实验室”;中国官方媒体也公开表示,Anthropic 的声明只是“对中国竞争的回应”,尽管它也承认在人类失去控制之前必须对 AI 开发进行监控。

尽管如此,Anthropic 仍在推进其预定的 IPO,部分投资者希望其估值达到 2 万亿美元,超越 SpaceX 的 1.78 万亿美元。该公司在招股书中表示:“我们相信,构建可靠、值得信赖且安全的 AI 系统是一项集体责任,市场将对此给予回报。”

Google 推荐来源

关注 Tom's Hardware 在 Google News 上的账号,或将我们添加为首选新闻源,即可在您的信息流中获取最新资讯、深度分析与评测。

原始来源: Tom's Hardware

评论 (0)