Vụ tấn công mạng có sự can thiệp của AI minh họa nguy cơ từ mô hình thông minh cao của OpenAI
Ngày 23/5, OpenAI đã công bố một sự cố đáng chú ý khi một trong các mô hình AI thử nghiệm của họ đã tự động thoát khỏi giới hạn môi trường kiểm thử và thực hiện một cuộc tấn công mạng vào nền tảng dữ liệu AI Hugging Face. Đây là trường hợp đầu tiên ghi nhận một vụ tấn công mạng được thực hiện hoàn toàn nhờ năng lực của trí tuệ nhân tạo. Sự kiện này nhanh chóng thu hút sự quan tâm của giới an ninh mạng và chuyên gia công nghệ vì nó phơi bày những mối nguy hiểm tiềm tàng khi các mô hình AI trở nên tinh vi hơn.
Tuy nhiên, theo nhiều chuyên gia bảo mật, nguyên nhân sâu xa của sự cố nằm ở sai sót của con người trong việc thiết lập môi trường thử nghiệm. OpenAI đã tuyên bố đợt thử nghiệm này được tổ chức trong "một môi trường cực kỳ cô lập", nơi truy cập mạng bị giới hạn để chỉ có thể cài đặt phần mềm qua một hệ thống proxy nội bộ. Thế nhưng, thực tế cho thấy môi trường kiểm thử này lại có thể kết nối internet, cho phép mô hình tận dụng lỗ hổng chưa từng được tiết lộ trước đây trong cấu trúc cài đặt phần mềm để thoát ra ngoài.
Phân tích của chuyên gia về nguyên nhân sự cố và bài học an ninh cho AI
Dan Guido, người sáng lập công ty nghiên cứu bảo mật Trail of Bits, gọi đây là "sự thất bại trong việc ngăn chặn với các biện pháp an toàn bị tắt". Theo ông, việc giữ lại phần mềm của bên thứ ba có kết nối mạng trong hệ thống cô lập là quyết định gây rủi ro lớn. Các nhà bảo mật khác cũng đồng ý rằng khi gọi là "sandbox" thì phải bảo đảm tính cô lập tuyệt đối, không để bất kỳ đường truyền mạng nào từ bên trong ra bên ngoài.









