时间:2026年9月3日(美国太平洋时间6:23-10:05;北京时间9月3日深夜至9月4日凌晨)
地点:美国加州旧金山,覆盖全球数千万开发者和终端用户
人物:OpenAI发言人Kathleen Chaykowski、Anthropic工程师CJ Avilla、SpaceX/xAI(xAI母公司)、AI编程工具Cursor
事件详情:北京时间9月3日深夜,美国头部AI服务出现罕见集体故障。Anthropic Claude系列于太平洋时间6:23出现”局部宕机”,涉及Mythos 5.1、Fable 5.1、Opus 5及Sonnet 5等多款模型,9:16率先恢复;xAI Grok于6:30全端下线(网页、移动端、API及X平台集成),10:05恢复;OpenAI ChatGPT与Codex于7:43因”路由错误”瘫痪,8:17修复,下午再度出现小幅错误率波动。事件峰值期间,Downdetector累计收到逾1.4万份故障报告(OpenAI 1.2万+、Claude 1200、Grok 1000)。
背景:xAI母公司SpaceX公开致歉,将Grok中断归因于”孟菲斯计算中心硬件故障”,并向”受影响的计算合作伙伴”致歉;Anthropic工程师CJ Avilla仅在社媒称”基础设施问题”,未公开根因;OpenAI发言人承认自家路由错误。三家均否认存在共享上游原因,但Cloudflare、AWS、Azure当日主状态页未报告重大故障(Cloudflare有R2 HTTP/3和WARP小问题)。值得注意的是,Anthropic和xAI 5月刚与SpaceX达成”计算合作伙伴”关系。
影响:AI编程工具Cursor公告部分服务因依赖的Claude、ChatGPT和Grok故障而中断,企业级自动化流水线承压数小时;事件正值OpenAI发布GPT-6 Astra前夜,被舆论戏称”LLM史上最黑暗一天”,凸显AI行业对共享云基础设施的深度依赖与单点风险。
总结:三大前沿模型在92分钟内相继失联,揭示了头部AI实验室虽在模型层激烈竞争、地基却高度共享的结构性脆弱。可用性监控平台StatusGPT显示主流大模型API平均正常运行率仍达99.99%,但本次事件已成2026年迄今最显著的AI可靠性警示案例,业内对Azure、AWS及边缘节点的依赖度或将面临更严格的审计。
参考来源:
1. https://www.wired.com/story/nobody-is-saying-why-openai-and-anthropic-had-outages-today/
2. https://arstechnica.com/ai/2026/09/four-major-ai-models-suffer-rare-overlapping-downtime/
3. https://news.qq.com/rain/a/20260904A04MAQ00
4. https://www.jwview.com/jingwei/html/09-04/686312.shtml
5. https://www.hkcd.com.hk/hkcdweb/content/2026/09/04/content_8773198.html
6. https://pivotnews.ai/five/chatgpt-claude-and-grok-suffer-near-simultaneous-outages
7. https://www.china.org.cn/world/Off_the_Wire/2026-09/04/content_118680521.shtml
8. https://news.geobrowser.io/story/a7409f2baf4a45509ea76df2683bc99c