周四的几个小时里,人工智能行业的一个引人注目的部分同时陷入了黑暗。 ChatGPT、Anthropic 的 Claude、xAI 的 Grok 和 OpenAI 的 Codex 均于 2026 年 9 月 3 日遭遇中断或错误率升高,扰乱了数百万人和企业日常依赖的聊天机器人、编码代理和 API。

这些中断发生的时间巧合,在几个小时内袭击了四个使用最广泛的人工智能平台,生动地提醒人们该行业的基础设施已经变得多么集中。为了持续报道这种集中度和塑造市场的最新人工智能新闻,AI Buzz Wire 跟踪每一个主要提供商的举动。

OpenAI 发生了什么

OpenAI 的问题首先出现。据 BleepingComputer 称,服务中断于美国东部时间 9 月 3 日星期四上午 10:58 左右开始,用户报告了几乎所有主要 ChatGPT 功能的错误。

该公司的状态页面列出了至少 15 个受影响的 ChatGPT 组件,包括对话、登录、ChatGPT Work、ChatGPT Desktop 中的 Codex、合规性 API、搜索、文件上传、语音模式、GPT、图像生成、深度研究、代理、ChatGPT Atlas、站点和连接器/应用程序。开发人员用于自动编码的 OpenAI 的 Codex 服务也受到了影响,随着中断的持续,Codex GitHub 存储库上的错误线程充满了报告。

据 BleepingComputer 报道,OpenAI 在其状态页面上表示:“我们正在调查所列服务的问题。”到周四下午,该公司的状态仪表板显示所有系统再次全面运行,ChatGPT 在过去几个月的滚动正常运行时间为 99.62%。

值得注意的是,这次中断发生在 OpenAI 的下一个主要人工智能模型 Astra 预计推出之前,该公司已确认该模型即将推出。 OpenAI 尚未透露此次中断是否与此次发布的准备工作有关,BleepingComputer 报告称这些问题不太可能有关联。

Anthropic 的 Claude 在其模型阵容中降级

Anthropic 的麻烦始于世界标准时间下午早些时候。该公司的状态页面显示,工程师于 9 月 3 日 13:26 UTC 开始调查“请求错误增加”,影响了 Claude 系列的大部分产品:Claude Mythos 5.1、Claude Fable 5.1、Claude Mythos 5、Claude Fable 5、Claude Opus 5、Claude Opus 4.8 和 Claude Opus 4.6。

事件页面将受影响的表面列为 claude.ai、api.anthropic.com 上的 Claude API、Claude Code 和 Claude Cowork——换句话说,基本上是 Anthropic 客户接触到的所有内容,从消费者聊天机器人到开发人员 API,再到许多工程师整天保持开放的编码代理。

Anthropic 在 13:41 UTC 确定了原因,并在 16:06 UTC 之前部署了修复程序,并宣布该事件于太平洋时间上午 9:16(16:16 UTC)完全解决。从第一次报告到解决,这一事件持续了大约三个小时。

Grok、Gemini 和更广泛的涟漪

xAI也受到打击。 9 月 3 日,Grok 的故障出现在该公司的状态页面上,并成为 Hacker News 上获得最多支持的报道之一,用户在一条帖子中交换 OpenAI、Anthropic 和 xAI 服务失败请求的报告,询问为什么这些提供商同时全部宕机。

谷歌的 Gemini 也被卷入了这次事件,尽管它的问题似乎没那么严重。 PCMag 报道称,“ChatGPT、Claude、Gemini 等现在都瘫痪了”,《纽约邮报》和《LADbible》都描述了聊天机器人上的数千起用户投诉,并引用了中断跟踪器峰值的情况。 NewsNation 直言不讳地总结了这一场景:“随着用户报告中断,人工智能中断袭击了 Claude、OpenAI、Grok。”

没有证据表明同时发生的故障是由协同攻击造成的。每个供应商都描述了自己的事件——OpenAI 的错误和组件故障增多,Anthropic 的错误情况已识别并修补——而且几乎同时发生的时间似乎正是世界上几个最大的人工智能平台在同一下午在全球负载下承受压力时的情况。

当每个助手同时倒下时,工作就会停止

对于消费者来说,几个小时的聊天机器人错误是一件令人烦恼的事情。对于越来越多将这些系统连接到日常运营中的企业来说,这一事件更接近于压力测试。

基于 Claude Code 或 Codex 构建的开发人员在任务中失去了他们的人工智能配对程序员。调用 OpenAI 或 Anthropic API 的面向客户的产品向最终用户返回错误。依靠 Deep Research、Agent 功能或 ChatGPT Work 进行文档处理的团队只能等待。 Hacker News 讨论中充斥着开发人员,他们描述了停止的管道,并询问共同的依赖项(共享云区域、共享内容交付层)是否可能是罪魁祸首。没有一家提供商指出任何此类常见原因。

这一事件呼应了云计算中的一个熟悉的教训,现在正在人工智能时代重演:当少数提供商承担了大部分行业流量时,他们的糟糕下午就会成为每个人的糟糕下午。与那些存在单点故障的公司相比,跨多个模型提供商路由请求、尽可能缓存响应以及订阅提供商状态页面的公司的日子要轻松得多。

外卖

目前还没有提供商发布详细的根本原因分析。 Anthropic 的事件报告确认了已确定的原因并已部署修复; OpenAI 的仪表板简单地恢复为绿色。如果事件后的报道随之而来,那么它们将值得仔细阅读,特别是它们所揭示的有关容量规划的内容,因为像 Astra 这样的模型启动会将新需求叠加到已经紧张的系统上。

目前,9 月 3 日的中断是迄今为止最清楚的证明,人工智能的便利性依赖于一个薄弱的、相互依赖的物理和软件堆栈——这个堆栈可能同时在各个公司之间摇摆不定。

在每项重大人工智能开发中保持领先地位

重大停电、模型发布和政策斗争正在加速发生。在重要的事情发生之前获得对每项发展的独立报道。

---

保持人工智能领先地位

获取最新的人工智能新闻、分析和突破——尽在一个地方。

阅读更多人工智能新闻 →