Trong vài giờ vào thứ Năm, một phần đáng chú ý của ngành công nghiệp AI đã đồng thời trở nên đen tối. ChatGPT, Claude của Anthropic, Grok của xAI và Codex của OpenAI đều bị ngừng hoạt động hoặc tỷ lệ lỗi tăng cao vào ngày 3 tháng 9 năm 2026, làm gián đoạn các chatbot, tác nhân mã hóa và API mà hàng triệu người và doanh nghiệp sử dụng hàng ngày.
Thời điểm gián đoạn xảy ra ngẫu nhiên, xảy ra với bốn trong số các nền tảng AI được sử dụng rộng rãi nhất trong vòng vài giờ, đưa ra một lời nhắc nhở sống động về mức độ tập trung của cơ sở hạ tầng của ngành. Để tiếp tục đưa tin về sự tập trung đó và tin tức AI mới nhất đang định hình thị trường, AI Buzz Wire theo dõi mọi động thái của nhà cung cấp lớn khi nó diễn ra.
Chuyện gì đã xảy ra ở OpenAI
Các vấn đề của OpenAI bắt đầu trước tiên. Theo BleepingComputer, sự cố ngừng hoạt động bắt đầu vào khoảng 10:58 sáng ET vào Thứ Năm, ngày 3 tháng 9, với việc người dùng báo cáo lỗi trên hầu hết mọi tính năng ChatGPT chính.
Trang trạng thái của công ty liệt kê ít nhất 15 thành phần ChatGPT bị ảnh hưởng, bao gồm Hội thoại, Đăng nhập, ChatGPT Work, Codex trong ChatGPT Desktop, API tuân thủ, Tìm kiếm, Tải tệp lên, Chế độ giọng nói, GPT, Tạo hình ảnh, Nghiên cứu sâu, Tác nhân, ChatGPT Atlas, Trang web và Trình kết nối/Ứng dụng. Các dịch vụ Codex của OpenAI, được các nhà phát triển sử dụng để mã hóa tự động, cũng bị ảnh hưởng và một chuỗi lỗi trên kho lưu trữ Codex GitHub chứa đầy các báo cáo khi tình trạng gián đoạn kéo dài.
“Chúng tôi đang điều tra vấn đề đối với các dịch vụ được liệt kê”, OpenAI cho biết trên trang trạng thái của mình, theo BleepingComputer. Đến chiều thứ Năm, bảng điều khiển trạng thái của công ty cho thấy tất cả các hệ thống đã hoạt động bình thường trở lại, với thời gian hoạt động liên tục của ChatGPT trong nhiều tháng qua được liệt kê ở mức 99,62%.
Đáng chú ý, sự cố ngừng hoạt động xảy ra ngay trước thời điểm ra mắt dự kiến của Astra, mô hình AI lớn tiếp theo của OpenAI mà công ty đã xác nhận là sẽ sớm ra mắt. OpenAI chưa cho biết liệu sự cố ngừng hoạt động có liên quan đến việc chuẩn bị cho lần ra mắt đó hay không và BleepingComputer cho biết có vẻ như các vấn đề không liên quan đến nhau.
Claude của Anthropic bị xuống cấp trong dòng sản phẩm người mẫu của mình
Rắc rối của Anthropic bắt đầu vào đầu giờ chiều UTC. Trang trạng thái của công ty cho thấy các kỹ sư đã mở một cuộc điều tra vào lúc 13:26 UTC vào ngày 3 tháng 9 về "lỗi cao trong yêu cầu" ảnh hưởng đến nhiều dòng sản phẩm Claude: Claude Mythos 5.1, Claude Fable 5.1, Claude Mythos 5, Claude Fable 5, Claude Opus 5, Claude Opus 4.8 và Claude Opus 4.6.
Trang sự cố liệt kê bề mặt bị ảnh hưởng là claude.ai, API Claude tại api.anthropic.com, Claude Code và Claude Cowork - nói cách khác, về cơ bản là mọi thứ mà khách hàng của Anthropic chạm vào, từ chatbot tiêu dùng đến API nhà phát triển đến tác nhân mã hóa mà nhiều kỹ sư luôn mở cả ngày.
Anthropic đã xác định nguyên nhân lúc 13:41 UTC, triển khai bản sửa lỗi trước 16:06 UTC và tuyên bố sự cố đã được giải quyết hoàn toàn kể từ 9:16 sáng Thái Bình Dương (16:16 UTC). Tập phim kéo dài khoảng ba giờ từ báo cáo đầu tiên đến khi giải quyết.
Grok, Gemini và gợn sóng rộng hơn
xAI cũng bị tấn công. Sự cố ngừng hoạt động của Grok đã xuất hiện trên trang trạng thái của công ty vào ngày 3 tháng 9 và trở thành một trong những câu chuyện được bình chọn nhiều nhất trên Hacker News, nơi người dùng trao đổi các báo cáo về các yêu cầu không thành công trên các dịch vụ OpenAI, Anthropic và xAI trong một chuỗi hỏi tại sao tất cả các nhà cung cấp đều ngừng hoạt động cùng một lúc.
Gemini của Google cũng bị lôi kéo vào sự kiện này, mặc dù các vấn đề của nó dường như ít nghiêm trọng hơn. PCMag đã báo cáo rằng "ChatGPT, Claude, Gemini, v.v. Hiện tất cả đều ngừng hoạt động" và cả New York Post và LADbible đều mô tả hàng nghìn khiếu nại của người dùng trên các chatbot, trích dẫn mức tăng đột biến của trình theo dõi ngừng hoạt động. NewsNation đã tóm tắt tình hình một cách thẳng thắn: “Sự cố ngừng hoạt động của AI xảy ra với Claude, OpenAI, Grok khi người dùng báo cáo sự gián đoạn.”
Không có bằng chứng nào cho thấy những thất bại đồng thời là kết quả của một cuộc tấn công phối hợp. Mỗi nhà cung cấp mô tả sự cố của riêng mình – lỗi tăng cao và lỗi thành phần trong trường hợp của OpenAI, tình trạng lỗi được xác định và vá tại Anthropic – và thời gian gần như đồng thời dường như giống hệt như khi một số nền tảng AI lớn nhất thế giới hoạt động dưới tải toàn cầu vào cùng một buổi chiều.
Khi mọi trợ lý ngừng hoạt động cùng một lúc, công việc sẽ dừng lại
Đối với người tiêu dùng, một vài giờ chatbot xảy ra lỗi là một điều khó chịu. Đối với ngày càng nhiều doanh nghiệp đưa các hệ thống này vào hoạt động hàng ngày, giai đoạn này gần giống với một bài kiểm tra căng thẳng hơn.
Các nhà phát triển xây dựng trên Claude Code hoặc Codex đã mất cặp lập trình viên AI của họ khi đang thực hiện nhiệm vụ. Các sản phẩm hướng tới khách hàng gọi OpenAI hoặc API Anthropic đã trả về lỗi cho người dùng cuối. Các nhóm dựa vào Nghiên cứu sâu, tính năng Tác nhân hoặc ChatGPT Work để xử lý tài liệu chỉ cần chờ đợi. Cuộc thảo luận về Hacker News chứa đầy các nhà phát triển mô tả các đường dẫn bị tạm dừng và hỏi liệu một sự phụ thuộc chung - vùng đám mây dùng chung, lớp phân phối nội dung dùng chung - có thể là nguyên nhân hay không. Không ai trong số các nhà cung cấp đã chỉ ra bất kỳ nguyên nhân phổ biến nào như vậy.
Tình tiết này gợi lại một bài học quen thuộc từ điện toán đám mây, hiện đang tái hiện trong kỷ nguyên AI: khi một số ít nhà cung cấp chiếm phần lớn lưu lượng truy cập của ngành, những buổi chiều tồi tệ của họ trở thành những buổi chiều tồi tệ của mọi người. Các công ty định tuyến yêu cầu qua nhiều nhà cung cấp mô hình, phản hồi trong bộ nhớ đệm nếu có thể và đăng ký các trang trạng thái của nhà cung cấp đã có một ngày dễ dàng hơn nhiều so với những công ty có một điểm lỗi duy nhất.
##Món mang đi
Chưa có nhà cung cấp nào công bố phân tích nguyên nhân gốc rễ chi tiết. Báo cáo sự cố của Anthropic xác nhận nguyên nhân đã xác định và cách khắc phục đã triển khai; Bảng điều khiển của OpenAI đơn giản trở lại màu xanh lục. Nếu tiếp tục có các bài viết sau sự cố, chúng sẽ đáng để đọc kỹ, đặc biệt là những gì chúng tiết lộ về việc lập kế hoạch năng lực khi các mô hình ra mắt như Astra đáp ứng nhu cầu mới lên các hệ thống vốn đã căng thẳng.
Hiện tại, sự cố ngừng hoạt động vào ngày 3 tháng 9 được coi là minh chứng rõ ràng nhất cho thấy sự tiện lợi của AI dựa trên nền tảng phần mềm và vật lý mỏng, phụ thuộc lẫn nhau – một hệ thống có thể ảnh hưởng đến nhiều công ty cùng một lúc.
Luôn đi trước mọi sự phát triển AI lớn
Sự cố ngừng hoạt động lớn, ra mắt mô hình và đấu tranh chính sách đang gia tăng. Nhận tin tức độc lập về mọi sự phát triển trước khi nó quan trọng.
---
Đi trước AINhận tin tức, phân tích và đột phá mới nhất về AI — tất cả ở cùng một nơi.
Đọc thêm tin tức về AI →