Ba Dịch Vụ AI Lớn Sập Trong Cùng Một Giờ — Nguyên Nhân Chung Vẫn Là Suy Đoán

Chiều 3/9/2026 giờ Mỹ, ChatGPT, Claude và Grok cùng lỗi trong khoảng một giờ đồng hồ; Downdetector ghi hơn 37.000 báo cáo riêng cho ChatGPT. Nhiều bản tin quy kết ngay cho một vùng máy chủ Azure. Locaith kiểm tra trang trạng thái của từng hãng và của chính Azure: không nơi nào công bố nguyên nhân, v

Ngày 3/9/2026, ba trong số những dịch vụ AI được dùng nhiều nhất thế giới cùng trục trặc trong khoảng một giờ. Trong vòng vài tiếng, một số bản tin đã có tiêu đề khẳng định thủ phạm. Locaith đi kiểm tra từng trang trạng thái gốc — và điều tìm thấy là: không hãng nào công bố nguyên nhân, kể cả hãng bị quy kết.

Phần đã được xác nhận

Sự việc diễn ra trong buổi sáng ngày 3/9/2026 theo giờ miền Đông nước Mỹ. Số báo cáo trên Downdetector bắt đầu tăng sau 9 giờ sáng và đạt đỉnh quanh 11 giờ sáng. Dưới đây là những gì các trang trạng thái chính thức và báo chí ghi nhận:

Dịch vụ Báo cáo đỉnh trên Downdetector Trang trạng thái của hãng ghi gì
ChatGPT (OpenAI)37.000–40.000
hai nguồn ghi khác nhau
Lỗi cao trên diện rộng ở ChatGPT và Codex; danh sách thành phần ảnh hưởng gồm hội thoại, đăng nhập, tìm kiếm, tải tệp, chế độ giọng nói, tạo ảnh, Deep Research, Atlas và Connectors
Claude (Anthropic)khoảng 1.300–1.500Gián đoạn một phần ở Claude.ai, API, Claude Code và Claude Cowork; sau đó thu hẹp còn Opus 4.8 và Opus 5
Grok (xAI)khoảng 1.300Không có công bố chi tiết được các bản tin trích lại
Gemini (Google)khoảng 500Google không xác nhận sự cố diện rộng; một nguồn ghi nhận lỗi ở API với khoá vừa tạo

Nguồn: Daily Voice và LADbible, đọc 4/9/2026; đối chiếu với trang lịch sử trạng thái của OpenAI. Hai nguồn đưa con số đỉnh khác nhau nên bảng ghi cả khoảng thay vì chọn một số.

Trang lịch sử trạng thái của OpenAI ghi hai sự cố riêng biệt trong ngày 3/9: một sự cố lỗi cao ở ChatGPT và Codex, và một sự cố lỗi cao ở ChatGPT Work Mode. Không sự cố nào nêu nguyên nhân. Theo tường thuật, sự cố lớn được xử lý trong khoảng nửa giờ.

Phần đang được suy đoán

Trong ngày, xuất hiện các bản tin đặt tiêu đề khẳng định nguyên nhân là vùng máy chủ Azure East US gặp sự cố, và rằng Gemini sống sót vì chạy trên Google Cloud. Cách giải thích này gọn gàng, dễ nhớ và đang được dẫn lại rộng rãi. Vấn đề là chưa có nguồn sơ cấp nào chống đỡ nó.

Locaith đã kiểm tra ba việc trong phiên làm việc ngày 4/9/2026:

Giả thuyết "ba đối thủ chung một vùng máy chủ" không khớp với hồ sơ hạ tầng công khai.

Anthropic chạy đa đám mây: AWS là đối tác chính với cam kết đầu tư trên 100 tỷ USD và tới 5 gigawatt công suất Trainium, cùng thoả thuận với Google và Broadcom về công suất TPU nhiều gigawatt. xAI vận hành cụm trung tâm dữ liệu Colossus của chính mình tại Memphis, quy mô hàng trăm nghìn GPU. Không tài liệu công khai nào đặt hai hệ thống này vào cùng một vùng Azure với ChatGPT.

Có một mối liên hệ thật với Azure, nhưng nó nằm ở chỗ khác: Claude được bán qua Azure Foundry, bên cạnh AWS Bedrock và Google Vertex AI. Một sự cố vùng Azure sẽ ảnh hưởng tới khách mua Claude qua Azure — chứ không làm sập claude.ai. Đây có thể là hạt nhân sự thật mà cách giải thích gọn gàng kia đã phóng đại lên.

Cần nói cho công bằng: điều này không chứng minh Azure vô can. Một điểm hỏng chung ở tầng khác — mạng truyền tải, DNS, một nhà cung cấp CDN, hay một thư viện phần mềm dùng chung — vẫn hoàn toàn có thể giải thích được hiện tượng. Cũng có khả năng đây là trùng hợp, điều nghe khó tin nhưng không phải bất khả. Điều Locaith khẳng định chỉ là: ở thời điểm 4/9/2026, chưa ai công bố nguyên nhân, nên mọi tiêu đề nói chắc chắn đều đang đi trước bằng chứng.

Vì sao chuyện này đáng để ý dù nguyên nhân là gì

Thời lượng gián đoạn không lớn — khoảng nửa giờ với sự cố chính, và mọi dịch vụ trở lại trong ngày. Nếu chỉ đo bằng phút, đây là tin nhỏ. Nhưng có hai điều đáng giữ lại.

Thứ nhất, không ai bên ngoài biết các hệ thống này phụ thuộc lẫn nhau ở đâu. Việc một giả thuyết chưa kiểm chứng lan nhanh đến vậy chính là bằng chứng cho khoảng trống thông tin: nếu bản đồ phụ thuộc là công khai, người ta đã không phải đoán. Với doanh nghiệp đang xây sản phẩm trên các API này, đó là rủi ro không định lượng được từ bên ngoài.

Thứ hai, chiến lược "dùng nhiều nhà cung cấp cho an toàn" chỉ đúng khi các nhà cung cấp thực sự độc lập. Dù nguyên nhân ngày 3/9 là gì, câu hỏi mà nó đặt ra vẫn đứng: nếu bạn đã cẩn thận cắm cả OpenAI lẫn Anthropic để phòng hờ, bạn có thật sự biết hai đường đó không gặp nhau ở một điểm nào phía dưới không? Phần lớn doanh nghiệp không biết, và cũng không có cách nào biết.

Ba việc doanh nghiệp Việt Nam nên làm

Nguồn:

Bài này cố ý không kết luận nguyên nhân. Ở thời điểm biên soạn ngày 4/9/2026, không hãng nào công bố nguyên nhân sự cố, và trang trạng thái chính thức của Azure không ghi nhận sự cố nào cho ngày 3/9/2026 — nhưng việc không có ghi nhận không đồng nghĩa với việc không có sự cố, và Locaith không loại trừ khả năng nguyên nhân chung sẽ được xác nhận sau. Số báo cáo Downdetector là số người dùng tự báo lỗi, không phải số người bị ảnh hưởng, và hai nguồn ghi con số đỉnh khác nhau nên bài ghi cả khoảng. Nội dung trang trạng thái của Anthropic và xAI được đọc qua tường thuật báo chí, không phải đọc trực tiếp; riêng trang của OpenAI và Azure Locaith đọc trực tiếp. Ba khuyến nghị cuối bài là quan điểm riêng của Locaith. Ảnh bìa là ảnh dùng lại từ kho ảnh sẵn có của Locaith, không phải ảnh của sự kiện này — phiên làm việc không tải được ảnh gốc. Biên soạn và phân tích bởi Ban Biên Tập Locaith, 4/9/2026.

Messenger