Vào sáng ngày 5/8/2026, bốn mô hình Claude (Mythos 5, Fable 5, Opus 5, Sonnet 5) đồng thời gặp lỗi trong hơn 7 giờ, khiến Claude.ai, Claude Code và API ngừng hoạt động. Đây là sự cố thứ 164 trong năm, ngay sau khi Anthropic công bố khoản vay 36 tỷ USD để thuê thêm chip TPU của Google.
Điều gì đã xảy ra?
Sự cố bắt đầu vào lúc 02:15 giờ địa phương, khi người dùng ở nhiều quốc gia báo cáo không thể truy cập bất kỳ dịch vụ nào của Claude. Các mô hình AI này đều ngừng phản hồi, và các yêu cầu API trả về lỗi 503. Thời gian gián đoạn kéo dài 7,5 giờ, cho tới khi đội ngũ kỹ thuật Anthropic khôi phục phần lớn chức năng vào khoảng 09:45 cùng ngày.
Trong suốt thời gian này, các doanh nghiệp đang tích hợp Claude Code vào quy trình CI/CD không thể thực hiện các tác vụ tự động hoá, dẫn đến trì hoãn dự án và mất mát dữ liệu tạm thời.
Tại sao sự cố lại xảy ra dù đã đầu tư 71 tỷ USD?
Anthropic đã ký hợp đồng vay 36 tỷ USD để thuê thêm chip TPU của Google, nâng tổng cam kết tài chính cho hạ tầng tính toán lên 71 tỷ USD trong 60 ngày. Tuy nhiên, việc lắp đặt và cấu hình các chip này mất nhiều tháng, trong khi doanh thu công ty tăng nhanh từ 9 tỷ lên 47 tỷ USD.
- Thiếu hụt hạ tầng: Các trung tâm dữ liệu chưa kịp mở rộng để đáp ứng nhu cầu tăng đột biến.
- Cam kết uptime không rõ ràng: Gói API tiêu chuẩn không bao gồm SLA (Service Level Agreement), nên khách hàng không được bồi thường khi dịch vụ ngừng hoạt động.
- Quản lý rủi ro chưa chặt chẽ: Việc phụ thuộc vào một nhà cung cấp chip duy nhất (Google TPU) khiến hệ thống dễ bị ảnh hưởng khi có sự cố về phần cứng.
Do đó, dù vốn tài chính dồi dào, Anthropic vẫn gặp khó khăn trong việc chuyển đổi đầu tư thành năng lực tính toán thực tế.
Ảnh hưởng tới doanh nghiệp và người dùng Việt
Ở Việt Nam, nhiều công ty công nghệ và startup đã tích hợp Claude Code vào các pipeline phát triển phần mềm. Khi API không hoạt động, các quy trình CI/CD bị gián đoạn, gây mất thời gian và tăng chi phí nhân công. Ngoài ra, các nhà phát triển còn phải tìm giải pháp thay thế tạm thời, như chuyển sang các mô hình AI khác hoặc tự triển khai giải pháp nội bộ.
Việc không có SLA trong gói API tiêu chuẩn khiến các doanh nghiệp phải tự chịu rủi ro tài chính. Đối với các dự án quan trọng, các công ty có thể cân nhắc nâng cấp lên gói dịch vụ có SLA hoặc đa kênh cung cấp API để giảm thiểu rủi ro.
Kết luận
Sự cố lần thứ 164 của Claude cho thấy dù có nguồn vốn khổng lồ, việc triển khai hạ tầng tính toán vẫn còn nhiều thách thức. Các doanh nghiệp cần xem xét kỹ các điều khoản SLA và chuẩn bị kế hoạch dự phòng khi phụ thuộc vào dịch vụ AI đám mây.
0💡 Khi tích hợp AI vào quy trình CI/CD, luôn có kế hoạch dự phòng và lựa chọn gói dịch vụ có SLA để bảo vệ doanh nghiệp khỏi mất mát thời gian và chi phí.






