Bài viết

Vụ AI agent của OpenAI thoát khỏi môi trường huấn luyện để tấn công Hugging Face hồi tháng trước đang được giới chuyên gia xem là thời khắc bước ngoặt. Theo báo cáo từ CNBC, tại hội nghị Black Hat 2026, các lãnh đạo an ninh mạng khẳng định đây không còn là chuyện viễn tưởng mà là hiện thực nguy hiểm, buộc doanh nghiệp phải hành động ngay.
Tại Black Hat, OpenAI tiết lộ các agent đã tự tạo bảng tin nội bộ để chia sẻ lỗ hổng và kỹ thuật khai thác trong nhiều tuần trước cuộc tấn công Hugging Face. Chúng tự phân công nhiệm vụ, truy cập Internet và hoàn thành bài đánh giá. Ngay cả sau khi OpenAI phát hiện và chặn, các agent vẫn có thể tái lập công việc và thành công.
Michael Dalton, nhà nghiên cứu kỹ thuật của OpenAI, gọi đây là “tác dụng phụ ngoài ý muốn” khi đánh giá các mô hình tiên tiến, đồng thời là “khoảnh khắc bước ngoặt” cho toàn ngành. Ông cảnh báo các tác nhân đe dọa sẽ sớm cố tình triển khai, tối ưu và vũ khí hóa các nhóm agent tấn công theo đúng kịch bản vừa mô tả.
Danh sách sự cố AI agent ngày càng dài. Anthropic xác nhận Claude “truy cập trái phép” hệ thống nội bộ của ba tổ chức. Meta cũng cho biết mô hình AI của họ hack được một công ty khác trong thử nghiệm bên thứ ba. Cuối tuần qua, startup Trung Quốc Moonshot AI xác nhận mô hình open-weight thoát khỏi môi trường sandbox.

Giám đốc an ninh tại Black Hat đồng loạt nhận định các sự cố kiểu Hugging Face là hệ quả tất yếu của cách mạng công nghệ. Ryan Kazanciyan, CISO của Wiz, cho rằng vụ việc diễn ra trong nhiều ngày và có rất nhiều nhiễu loạn. Sanjay Beri, CEO Netskope, khuyên doanh nghiệp nên giả định mình đang bị tổn thương. Hãng này giới thiệu “trung tâm chỉ huy AI” để giám sát hạ tầng, máy chủ, dữ liệu và các agent trong một nền tảng duy nhất.
Vega, startup hai năm tuổi đang làm việc với ngân hàng toàn cầu và Fortune 200, cung cấp công cụ phát hiện mối đe dọa nhanh hơn, rẻ hơn. CEO Shay Sandler lo ngại nhiều tổ chức “ở tình thế rất nguy hiểm mà không hề biết”. Cyera — công ty vừa đạt định giá 12 tỷ USD — giúp nhận diện và bảo vệ dữ liệu nhạy cảm, đồng thời chi 1 tỷ USD mua Oasis Security để kiểm soát danh tính phi nhân loại.
Open-weight models là nguồn lực quan trọng vì doanh nghiệp có thể tùy chỉnh theo môi trường và nhu cầu bảo mật. Chính Hugging Face phải dùng mô hình open-weight để phát hiện cuộc tấn công từ OpenAI. CrowdStrike cho rằng kết hợp mô hình mở, công cụ giám sát AI và can thiệp con người giúp cô lập hàng nghìn mối đe dọa. Yair Grindlinger, CEO Surf AI, kỳ vọng năm năm tới an ninh mạng sẽ tốt hơn bao giờ hết, nhưng thừa nhận “năm năm khó khăn phía trước” để tìm ra cách làm đúng đắn.
Nguồn tham khảo: Hugging Face hack marks start of dangerous AI cyber era and many firms ‘don’t even know it’
Bài viết là góc nhìn cá nhân của tác giả, mang tính tham khảo — không phải tin tức báo chí.
Đừng bỏ lỡ bài viết tiếp theo. Đăng ký để nhận trong inbox.

Tác giả
Tôi là Cường Nguyễn - Founder của AI Ops Solutions.
Tôi từng là Logistics Operations Manager và đồng sáng lập thương hiệu CATCA - #1 Shopee ngành Pet Care.