美国AI大宕机事件概况
故障发生时间与影响范围
北京时间9月3日深夜,美国主流AI集体遭遇宕机。美东时间当日早晨9点半起,Anthropic的Claude、xAI的Grok以及OpenAI的ChatGPT均宣布服务异常。DownDetector网站数据显示,谷歌Gemini、微软Copilot的服务中断报告数量也显著上升。AI编程工具Cursor部分服务因Claude、ChatGPT和Grok故障受影响。
各平台故障报告情况
据Downdetector数据,OpenAI收到超12,000份问题报告,Claude约1,200份,Grok约1,000份。这充分表明此次宕机对各平台造成了不同程度的影响,众多用户无法正常使用相关AI服务,给工作和生活带来不便。

故障原因推测
基础设施问题引发
Anthropic技术部门员工透露,此次事件由“基础设施问题”引发。究竟是怎样的基础设施问题导致如此大规模的AI服务中断,值得深入探究。
Cloudflare故障嫌疑
有分析指向关键互联网底层设施Cloudflare。用户访问网站时,请求先进入Cloudflare,由其判断后返回页面内容。而Cloudflare状态页面显示当日有两个技术故障,一是影响R2自定义域名的HTTP/3问题,部分使用自定义域名连CloudflareR2存储的网站或应用,通过HTTP/3发起请求时可能失败或性能下降;二是部分WARP用户地理位置识别错误。
微软Azure云服务猜测
微软Azure云服务在同一时段故障报告激增,而Anthropic、xAI与OpenAI均依赖Azure提供云计算服务,所以也有猜测认为底层原因可能与微软Azure有关。不过它们的算力架构中还包含谷歌等其他服务商,情况较为复杂。
事件恢复与行业警示
服务陆续恢复
截至北京时间9月4日凌晨1点10分,所有服务已陆续恢复,Claude于凌晨0:16全面恢复。这让依赖这些AI服务的用户松了一口气,各项工作和生活得以继续正常开展。
暴露行业风险
此次事件暴露了AI行业过度依赖少数底层基础设施的结构性风险。底层一旦出现问题,上层应用就会连锁反应,众多AI服务可能同时瘫痪,影响巨大。
对用户的启示
事件提醒使用者应建立“1+N”多模型备份机制,避免将关键工作流押注在单一AI服务上。这样在遇到类似故障时,能减少损失,保障工作的顺利进行。

相关问答
美国AI集体宕机事件发生在什么时间?
北京时间9月3日深夜,对应美东时间9月3日早晨9点半开始,持续约3小时40分。
受此次宕机事件影响的平台有哪些?
OpenAI的ChatGPT与Codex、Anthropic的Claude、xAI的Grok、AI编程工具Cursor均出现服务异常,谷歌Gemini、微软Copilot也收到大量中断报告。
故障原因目前有哪些推测?
官方初步定调是“基础设施问题”引发;主要怀疑对象是Cloudflare出现问题;另一猜测是微软Azure云服务故障,因相关公司依赖其提供云计算服务。
此次宕机事件造成了怎样的影响?
多家头部AI服务中断,给用户带来不便,同时暴露了AI行业依赖底层设施的风险,还导致AI本地化概念股Palantir美股暴涨。
用户从此次事件中应吸取什么教训?
应建立“1+N”多模型备份机制,避免将关键工作流押注在单一AI服务上,以防类似故障造成重大损失。
事件恢复情况如何?
截至北京时间16全面恢复。
简短标题:深夜突发!美国AI为何集体宕机?
转载声明:欢迎分享本文,转载请保留出处!发布者 财云量化
