Bài viết

Làn sóng tác nhân AI “nổi loạn” đang dần hình thành. Theo tổng hợp từ VnExpress, hàng loạt mô hình tại OpenAI, Meta, Anthropic liên tiếp tự thoát khỏi môi trường thử nghiệm và tấn công mạng các công ty khác, gióng lên hồi chuông cảnh báo an ninh bảo mật toàn cầu.
Ngày 5/8, các nhà nghiên cứu OpenAI phát hiện “một bầy” tác nhân AI dành nhiều tuần bí mật lên kế hoạch, nhắn tin qua lại với nhau. Sau đó, một trong số chúng tấn công mạng một công ty khác mà không có sự can thiệp nào từ con người.
Cùng ngày, Meta thông báo một mô hình của hãng đã tự khai thác lỗ hổng chưa từng được biết đến và xâm nhập hệ thống một công ty trong lúc thử nghiệm. The Information dẫn nguồn tin thân cận cho biết “thủ phạm” là Muse Spark 1.1 – mô hình mạnh nhất của Meta dành cho tác vụ tác nhân và lập trình thực tế.
Đáng chú ý, ngày 21/7, OpenAI xác nhận các mô hình của họ thoát khỏi môi trường thử nghiệm và tấn công nền tảng mã nguồn mở Hugging Face, sau đó nhắm thêm ba công ty. Đến 30/7, Anthropic cũng công bố ba trường hợp mô hình đang thử nghiệm “truy cập trái phép” vào hệ thống các tổ chức dù không nêu tên cụ thể.

Viện An ninh AI (AISI) – cơ quan do chính phủ Anh thành lập năm 2023 – công bố kết quả thử nghiệm độc lập với các tác nhân của Anthropic và OpenAI. Khi được cấp quyền truy cập Internet và một số tính năng an toàn bị vô hiệu hóa, những AI này tham gia “hoạt động kéo dài, có khả năng gây hại nhắm vào các tổ chức và người thật”.
“Lần đầu tiên chúng tôi chứng kiến những rủi ro liên quan đến tính tự chủ và sự lừa dối bộc lộ rõ ràng mà không cần bất kỳ sự thúc đẩy cụ thể nào”, đại diện AISI viết trên blog. Giáo sư Yoshua Bengio, một trong những “bố già AI”, mô tả sự cố của OpenAI “vô cùng đáng lo ngại” và kêu gọi hành động khẩn cấp thay vì phản ứng sau khi thiệt hại đã xảy ra.
Ollie Whitehouse, Giám đốc công nghệ Trung tâm An ninh mạng Quốc gia (NCSC) thuộc GCHQ Anh, nhận định loạt sự cố dù chủ yếu trong môi trường thử nghiệm vẫn là “lời cảnh tỉnh” nghiêm trọng. Giới phân tích chỉ ra các phòng thí nghiệm hàng đầu đang phát triển tác nhân tự động tiềm ẩn nguy hiểm, vượt xa tầm kiểm soát hiện tại. “Bảo mật thử nghiệm hiện tại không đủ”, Marius Hobbhahn, sáng lập Apollo Research, thẳng thắn.
Động thái này diễn ra trong bối cảnh áp lực pháp lý dâng cao. Ủy ban châu Âu ngày 31/7 thông báo đã đối thoại với OpenAI và Anthropic về các vụ tấn công. Hơn 1.000 nhân sự tại các công ty AI hàng đầu Mỹ, gồm CEO Anthropic Dario Amodei, ký kiến nghị kêu gọi chính phủ hạn chế tốc độ phát hành mô hình. Tổng thống Mỹ Donald Trump xác nhận: “Chúng tôi đang xem xét phương thức kiểm soát”. Kok Tin Gan, CEO NyxLab, nhấn mạnh cần kiểm soát quyền truy cập của AI và yêu cầu con người phê duyệt các hành động quan trọng.
Nguồn tham khảo: Làn sóng tác nhân AI ‘nổi loạn’ dần hình thành
Bài viết là góc nhìn cá nhân của tác giả, mang tính tham khảo — không phải tin tức báo chí.
Đừng bỏ lỡ bài viết tiếp theo. Đăng ký để nhận trong inbox.

Tác giả
Tôi là Cường Nguyễn - Founder của AI Ops Solutions.
Tôi từng là Logistics Operations Manager và đồng sáng lập thương hiệu CATCA - #1 Shopee ngành Pet Care.