新闻资讯

史上首次!GPT、Claude、Grok三大AI巨头罕见集体瘫痪

作者: admin | 发布于: 2026-09-04 14:00 | 分类: 科技资讯

9月3日晚间,来自北美的三家头部AI企业——OpenAI(旗下产品包括ChatGPT及Codex)、Anthropic(Claude)以及xAI(Grok)——遭遇了前所未有的大面积服务中断。截至北京时间9月4日凌晨零时,相关服务尚未完全恢复正常。

据公开报道统计,这是有史以来波及面最广的一次AI大模型集中停服事故。资本市场迅速作出反应:作为AI本地部署概念的代表标的,Palantir当日的美股股价大幅拉升7.81%。

第三方实时故障追踪平台Downdetector的数据表明,仅美国地区就有逾1.2万名用户提交了OpenAI相关服务的异常反馈,Claude方面约有1200条报告,Grok则接近1000条。与此同时,Google的Gemini和Microsoft的Copilot在同一时段也接到了大量服务中断投诉,AI辅助编码工具Cursor的部分功能同样受到了连带冲击。

涉事三方均通过各自的官方状态页面承认了故障存在,并声明已启动应急响应流程。Anthropic技术团队成员CJ Avilla在社交平台上披露,本次事故的根源在于"底层基础设施层面出现了异常"。

"团队正全力排查和修复,但在当前阶段尚无法明确告知恢复的具体时间节点。"CJ Avilla如是说。

多方行业信源将目光投向了微软Azure与Cloudflare等被多家大模型厂商共同使用的云计算底座,认为这很可能是导致此次连锁故障的关键因素。

具体来看各家的状态公告:OpenAI于9月3日20时28分在其状态页发布了一条标题为"ChatGPT与Codex错误率显著偏高"的记录,涉及ChatGPT的15个子模块和Codex的4个子模块,公司回应称"正对相关受影响服务展开调查"。

Anthropic的状态页则列出Claude Mythos 5.1、Fable 5.1、Opus 5、Opus 4.8及Opus 4.6等多个版本出现错误率攀升的情况。该公司表示已定位到Mythos 5.1、Fable 5.1和Opus 5请求失败的原因并开始处置,后续补充说明中称受影响范围已缩小至Opus 4.8与Opus 5两个版本,其余模型的错误率已回落至正常水平。

SpaceX关联公司xAI的Grok状态页则确认其Android客户端发生了模型层面的服务中断,xAI声明正在推进服务恢复工作。

此外需要关注的是,尽管Google Gemini与Microsoft Copilot在同一窗口期收到了海量中断反馈,但Google并未正式确认Gemini经历了全面性的网络瘫痪。AI编程工具Cursor的状态页则明确指出,其部分功能的波动系由Claude、ChatGPT和Grok的故障所牵连所致。

三大厂商几乎同一时刻陷入瘫痪,令业界对其是否共用同一套底层计算资源的猜测急剧升温。

据业内人士透露,事发期间微软Azure的故障上报量出现陡增,而OpenAI、Anthropic和xAI三者在不同程度上都依赖Azure的云端服务能力来支撑业务运转。

另一种关于故障源的推测则将矛头指向云服务商Cloudflare。回溯2024年11月,Cloudflare曾经历过一次类似事故,当时xAI与ChatGPT也曾同步出现宕机。

颇具意味的是,这场大规模停服恰好发生在海外科技圈围绕RSI(自递归强化学习)及其潜在安全风险争论白热化的敏感节点。RSI赋予大模型依据评估体系自主完成归因分析与训练策略制定的能力,然而其可控性与安全性一直是硅谷持续关注的焦点议题。

就在两天前的9月1日,OpenAI刚刚对外宣布其新一代模型Astra已突破"关键网络安全能力阈值"——即能够在缺乏逐步骤人工干预的前提下,独立发现并利用未知的系统安全漏洞。这一能力被广泛视为AI安全领域的一把双刃剑。

纵观历史,本次事件堪称持续时间最长、辐射范围最广的一次AI大模型群体性停服事故。可以预见,无论是产业链上下游还是投资圈层,都将深入追溯此次事件的深层诱因,并就智能体逐步介入乃至主导社会运行所带来的安全伦理困境与技术应对路径展开更为持久和深入的探讨。