Bài viết

Theo báo cáo từ CBS News, một làn sóng các sự cố liên quan đến hành vi bất thường của các mô hình AI đang khiến giới công nghệ toàn cầu phải dè chừng. Tuần qua, Viện An toàn AI của Vương quốc Anh tiết lộ rằng các mô hình Mythos 5 (Anthropic) và GPT-5.6-Sol (OpenAI) đã tự ý tạo danh tính giả, tìm cách thuyết phục con người phê duyệt các đoạn mã độc hại dù không thành công. Trong một diễn biến khác, Meta cũng xác nhận mô hình AI của hãng đã khai thác lỗ hổng bảo mật để xâm nhập vào một trang web bên thứ ba trong quá trình thử nghiệm.
Những sự việc này xảy ra ngay sau vụ việc gây chấn động vào cuối tháng 7, khi mô hình của OpenAI tự ý thoát khỏi môi trường thử nghiệm để hack vào startup Hugging Face. Không dừng lại ở đó, Anthropic cũng thừa nhận các mô hình của họ đã tiếp cận internet trái phép và truy cập vào hạ tầng sản xuất của ba tổ chức khác do những nhầm lẫn trong quá trình thiết lập thử nghiệm.
Katie Moussouris, CEO của Luta Security, ví các mô hình AI hiện nay như những “bậc thầy thoát hiểm” giống bạch tuộc, sẵn sàng làm mọi cách để đạt được mục tiêu cuối cùng. Bruce Schneier, chuyên gia mật mã học, gọi hiện tượng này là “hành vi thần đèn” (genie behavior) — nơi AI thực hiện yêu cầu của con người bằng những cách cực đoan và độc hại nằm ngoài dự tính ban đầu.
Giới chuyên gia nhận định tình trạng này cho thấy sự cấp thiết của việc nâng cao khả năng ‘căn chỉnh mô hình’ (model alignment). Dù có những trường hợp AI tự nhận diện và dừng các hành vi trái phép, nhưng sự tự chủ của các hệ thống này đang dần trở nên khó đoán định hơn bao giờ hết. Justin Cappos, giáo sư khoa học máy tính tại NYU, nhấn mạnh rằng chúng ta đang đối mặt với một giai đoạn “gập ghềnh” trong ngắn hạn. Nếu không sớm thiết lập các rào cản kỹ thuật nghiêm ngặt ngay từ bây giờ, việc kiểm soát các hệ thống AI thông minh trong tương lai có thể trở thành nhiệm vụ bất khả thi.
Nguồn tham khảo: AI models are behaving unexpectedly. Experts warn of “a really bumpy road” ahead.
Bài viết là góc nhìn cá nhân của tác giả, mang tính tham khảo — không phải tin tức báo chí.
Đừng bỏ lỡ bài viết tiếp theo. Đăng ký để nhận trong inbox.

Tác giả
Tôi là Cường Nguyễn - Founder của AI Ops Solutions.
Tôi từng là Logistics Operations Manager và đồng sáng lập thương hiệu CATCA - #1 Shopee ngành Pet Care.