黑色星期四!GPT、Claude、Grok出现历史级集体宕机

21世纪经济报道 21财经APP 赵云帆
2026-09-04 07:33

21世纪经济报道记者 赵云帆

9月3日,北美人工智能大模型公司OpenAI旗下ChatGPT与Codex、Anthropic旗下Claude、xAI旗下Grok出现大规模宕机事件。截至北京时间9月4日00:00仍未恢复。

该起事件为有报告以来最大规模的AI宕机事件。受此影响,AI本地化概念股Palantir美股暴涨7.81%。

海外实时服务故障监测网站Downdetector数据显示,美国用户针对OpenAI服务的故障报告超过1.2万份,Claude约1200份,Grok约1000份;谷歌Gemini、微软Copilot同期亦收到大量中断报告,AI编程工具Cursor部分服务受波及。

三家公司均在状态页确认故障并表示启动修复。Anthropic技术部门员工CJ Avilla在社交媒体透露,事件由“基础设施问题”引发。

“我们正在致力于解决问题,但目前还无法给出预计恢复时间。”CJ Avilla表示。

业内消息指出,微软Azure、Cloudflare等多家AI大模型公司共享的云算力基础设施可能是故障背后的原因。

从各家大模型公司的状态页来看,三家公司全部确认了错误。OpenAI状态页9月3日晚8点28分记录了一则题为“ChatGPT 和 Codex 出现高错误率”的事件,显示 ChatGPT共15个组件、Codex共4个组件受到影响。OpenAI公司表示“正在对所列服务进行调查”。

Anthropic公司状态页显示,Claude Mythos 5.1、Fable 5.1、Opus 5、Opus 4.8、Opus 4.6等多模型错误率升高,公司称已识别Claude Mythos 5.1、Fable 5.1和Opus 5请求错误率升高的原因并着手修复,后续更新称目前受影响的模型仅为Opus 4.8和Opus 5,其余模型已恢复到基线错误率。

SpaceX旗下xAI Grok状态页确认其安卓应用出现模型级中断,xAI表示正在恢复服务。

值得注意的是,谷歌Gemini与微软Copilot同期亦收到大量中断报告,但谷歌未确认Gemini发生全网宕机。AI编程工具Cursor状态页则显示,其部分服务因Claude、ChatGPT和Grok故障受到波及。

三家公司同期掉线,引发外界对共享底层基础设施的强烈质疑。

业内消息指出,微软Azure同期宕机报告飙升,而OpenAI、Anthropic和xAI三家均以不同形式依赖Azure提供云服务。

另一个对故障来源的推测则指向云服务公司Cloudflare。此前在2024年11月,Cloudflare一次故障曾同时让xAI和ChatGPT宕机。

值得注意的是,此次故障发生,正值海外对RSI(自我递归强化训练)和背后安全问题讨论热烈之际。RSI允许大模型依托评价体系自行归因分析并规划训练方案,但其安全性与不可控性被硅谷热议。

9月1日,OpenAI 宣布其下一代模型Astra已达到“关键网络安全能力门槛”,即具备在无逐步人工指导情况下发现并利用未知安全漏洞的能力。而这一能力也被认为是一把人工智能安全的“双刃剑”。

从历史上看,此次事故为持续时间最长、影响范围最广的AI大模型集体宕机事件。而针对该起事件,不论是产业界还是资本圈,都会审视其问题源头,对智能体接管社会运作的安全伦理和解决方案进行长期的讨论。

(作者:赵云帆 编辑:包芳鸣)