Tối ngày 3 tháng 9 theo giờ Bắc Kinh, dịch vụ mô hình của Anthropic, xAI và OpenAI lần lượt rơi vào tình trạng sự cố trong vòng một tiếng rưỡi. Trang trạng thái của Anthropic đăng thông báo đầu tiên lúc 21 giờ 26 phút giờ Bắc Kinh (13:26 UTC), toàn bộ dòng Grok của xAI bị các nền tảng phía dưới gắn nhãn suy giảm dịch vụ lúc 21 giờ 41 phút, còn OpenAI bắt đầu báo tỷ lệ lỗi của ChatGPT và Codex tăng cao vào khoảng 22 giờ 56 phút. Đến 23 giờ 15 phút, sự cố của cả ba hãng vẫn ở trạng thái "đang điều tra" hoặc "đang khắc phục", chưa hãng nào tuyên bố đã khôi phục.
Cùng khung giờ đó, Gemini và Vertex AI của Google không có bản ghi sự cố nào, ô của Google trên bảng tổng hợp trạng thái bên thứ ba vẫn màu xanh với dòng chữ "All services operational".

Dòng thời gian: ba hãng lần lượt vào cuộc
Anthropic là hãng sớm nhất. Lúc 21 giờ 26 phút, trang trạng thái viết "đang điều tra tỷ lệ lỗi request tăng cao của Claude Mythos 5.1, Fable 5.1, Opus 5", 15 phút sau đổi thành "đã xác định nguyên nhân, đang khắc phục". Đến 21 giờ 50 phút, danh sách đầy đủ được bổ sung: cả hai thế hệ 5.1 và 5 của Mythos và Fable, Opus 5, Opus 4.8, Opus 4.6 đều bị ảnh hưởng, Haiku và Sonnet không có trong danh sách. Bản cập nhật lúc 22 giờ 49 phút chỉ có một câu "vẫn đang khắc phục".
xAI theo sát ngay sau đó. Khi thu thập dữ liệu, trang trạng thái riêng của xAI trả về lỗi 403 nên không thể xem trực tiếp. Điều có thể xác nhận là Cursor đăng thông báo "đang điều tra tình trạng suy giảm dịch vụ" lúc 21 giờ 41 phút, ghi rõ đối tượng bị ảnh hưởng là "toàn bộ các mô hình Grok, Automations, Cloud Agents, Grok Bot và Review Agents". Trên bảng tổng hợp, xAI là hãng duy nhất trong bốn hãng hiển thị màu đỏ "Down".
OpenAI vào cuộc muộn nhất nhưng người dùng cảm nhận rõ nhất. Vào khoảng 22 giờ 56 phút, trang trạng thái xuất hiện dòng "Elevated errors across ChatGPT and Codex", phần giải thích chỉ có một câu "đang điều tra". Lúc này một số người dùng mở chatgpt.com thì nhận được mã lỗi HTTP 404, mã lỗi này thường xuất phát từ việc node biên không tìm được tuyến định tuyến, khác về bản chất so với lỗi 5xx phía mô hình.


Bên hạ nguồn phát hiện trước
Trang trạng thái của Cursor treo cùng lúc hai sự cố trong đêm đó. Một là tình trạng suy giảm của Grok lúc 21 giờ 41 phút, hai là "tỷ lệ lỗi mô hình Anthropic tăng cao" lúc 22 giờ 17 phút, sự cố sau ghi rõ là do "vấn đề từ phía Anthropic ở tầng trên" khiến các request tới Fable 5.1, Fable 5, Opus 5, Opus 4.8, Opus 4.6 bị lỗi, "một số người dùng sẽ gặp lỗi hoặc lượt tương tác của Agent bị thất bại".

Danh sách này khớp với danh sách mà chính Anthropic đưa ra, chỉ thiếu Mythos vì Cursor vốn không tích hợp mô hình này. Đối với các công cụ lập trình AI, việc hai nhà cung cấp phía trên cùng gặp sự cố trong một đêm khiến khả năng dự phòng của điểm bán hàng "dự phòng đa mô hình" bị vô hiệu hóa mất một nửa ngay lập tức.
Các lập trình viên trong nước Trung Quốc còn bị động hơn. Phần lớn họ dùng API trung chuyển hoặc nền tảng tổng hợp, thông tin sự cố phải qua một lớp thuật lại mới đến tay, các bên trung chuyển thường chỉ hiển thị "phía trên bất thường" chứ không phân biệt rõ là hãng nào, phiên bản nào. Đêm đó Haiku và Sonnet của Claude không nằm trong danh sách bị ảnh hưởng, Gemini hoạt động bình thường suốt, ai biết được điều này có thể chuyển mô hình ngay, ai không biết chỉ còn cách bấm làm mới và chờ.
Google không sao, đây là manh mối hay chỉ là trùng hợp
Suy đoán xuất hiện sớm nhất trong cộng đồng công nghệ Trung Quốc là "đường truyền phía trên hoặc DNS gặp trục trặc". Suy đoán này hiện chưa thể kiểm chứng. Có hai bằng chứng ngược lại: danh sách sự cố của Google Cloud hôm đó không có mục mới nào, Gemini hoạt động bình thường cả ngày; còn cách diễn đạt của Anthropic là "đã xác định nguyên nhân", điều này hướng về phía nội bộ của chính họ, trong khi sự cố hạ tầng dùng chung thường được viết là "sự cố từ nhà cung cấp phía trên".
Cũng có bằng chứng thuận chiều. Những gì Anthropic bị ảnh hưởng đều là các mô hình lớn, mô hình nhỏ thoát nạn; xAI bị gắn nhãn là "toàn bộ các mô hình Grok"; OpenAI chỉ liệt kê ChatGPT và Codex, còn cột API vẫn xanh. Phạm vi thiệt hại của cả ba hãng đều tập trung ở các mô hình lớn phía suy luận, điều này giống với việc một khu vực nào đó của nhà cung cấp năng lực tính toán gặp sự cố hơn là kiểu "không truy cập được gì cả" như DNS.
Một trang giám sát khả dụng của bên thứ ba cho thêm một điểm đối chiếu. Tính đến 23:37 giờ Bắc Kinh (15:37 UTC), trang này đánh dấu chín dịch vụ gặp sự cố: ngoài Cursor, Claude và OpenAI còn có Cloudflare, Supabase, GitHub, Notion, SendGrid và Twilio bị suy giảm một phần. Danh sách trông như ủng hộ giả thuyết dùng chung hạ tầng thượng nguồn, nhưng trang trạng thái chính thức của Cloudflare không có sự cố mới trong tối đó; hai mục còn mở là lỗi R2 và WARP tồn đọng từ cuối tháng 8, và không có bằng chứng nào liên hệ các suy giảm khác với sự kiện tối nay. Cùng trang đó cho thấy Grok đã hoạt động bình thường trở lại lúc 23:37.

Từ những manh mối này chỉ có thể rút ra kết luận "khâu suy luận mô hình lớn của cả ba hãng đều gặp vấn đề trong cùng một khung giờ", đi xa hơn một bước nữa chỉ còn là suy đoán. Cả ba hãng đều chưa công bố báo cáo sự cố, các bản cập nhật công khai cũng không nhắc đến bất kỳ bên thứ ba nào. Cách giải thích nào đúng còn phải chờ báo cáo hậu kiểm của từng hãng, thường mất từ ba đến năm ngày làm việc.
Nguồn tham khảo: trang trạng thái Anthropic, trang trạng thái OpenAI, trang trạng thái Cursor, danh sách sự cố Google Cloud, CocoLoop và ảnh chụp màn hình từ cộng đồng người dùng; danh sách mô hình bị ảnh hưởng và giai đoạn sự cố của từng hãng được đối chiếu theo nguyên văn trang trạng thái, trang trạng thái của xAI trả về lỗi 403 khi thu thập dữ liệu nên phạm vi ảnh hưởng của hãng này lấy theo trang trạng thái Cursor và bảng tổng hợp bên thứ ba.