美国三大AI模型同时宕机,警示了哪些风险
美国人工智能行业发生了一起罕见事件。
美东时间3日上午,Anthropic的Claude、马斯克旗下xAI的Grok、OpenAI的ChatGPT在约一个半小时内先后出现大规模服务异常,网页端、应用和接口都无法正常访问。

故障监测平台Downdetector显示,仅OpenAI一家收到的用户报告就超过1.2万份,AI编程工具Cursor因依赖上述模型接口,正常运行受到影响。
美东时间3日中午,美国三大AI模型服务已全部恢复。宕机事件持续约3小时40分钟。
宕机事件的原因,目前尚无详细说明。
Anthropic技术部门员工在社交媒体透露,事件由“基础设施问题”引发。有业内人士认为,Claude、Grok和ChatGPT同步宕机的原因在于它们共享云计算与网络基础设施,但相关三家企业都没有证实它们遭遇的故障存在关联。
但无论如何,三家头部产品同时“趴窝”,仍然像一次事先没有通知的压力测试,暴露了两个值得人们重视的风险。
一是AI“停摆”风险。
近年来,业界和学界关于人工智能风险的讨论,往往聚焦于AI会不会“觉醒”,会不会失控。但宕机事件表明,在目前阶段,真正的风险可能不是AI“觉醒”,而是AI“停摆”。
现代社会面临的系统性风险,往往来自那些平时无人注意、却被所有人共同依赖的东西。AI已经深度嵌入人类社会的生产生活。如今,人们不再只是用AI聊天或生成图片、视频,而是用它写代码、改合同、分析财报和数据、生成各种报告……
越来越多企业把整条工作流搭建在某个模型的接口之上,AI一旦停止运作,随之停下的可能是一段没写完的代码、一次没有响应的客户服务、一件没有完成的报送任务。

AI已经成为人类社会生产生活中的关键性基础设施之一。基础设施一出事,往往就是大事。
资本市场的反应最直观:宕机当天,主打本地部署的AI公司Palantir股价大涨7.71%。投资者用真金白银给“过度依赖云端大模型”的风险投了票。
二是AI产业底层资源高度集中的风险。
美国AI产业看上去是OpenAI、Anthropic、xAI等头部企业的“大混战”,但底层资源却掌握在极少数供应商手里。
芯片端,英伟达占AI加速器市场约八成份额;云服务端,亚马逊、微软、谷歌三家合计占全球云基础设施市场六成以上。
美国的头部AI企业都在做多供应商布局,但大家的供应商名单高度重合。这种“微观分散、宏观集中”的格局意味着,单个节点的问题可能演变为全系统的问题。

今年5月,国际货币基金组织在金融稳定评估中明确警告:全球金融体系运行在少数共享数字基础设施之上——主要的云平台、支付网络、身份认证服务和软件供应商高度重合。
这种集中意味着,共享数字基础设施发生故障或者受到攻击所产生的影响,可能跨机构、跨行业、跨国界地扩散。
这次三大AI模型同时宕机,相当于为这一风险做了一次现场演示。
(图片来源:网络)