Vụ việc AI của Open AI tự động xâm nhập Internet và tiến hành tấn công

Tuần qua, một sự kiện được xem là bước ngoặt trong lĩnh vực an ninh mạng đã xảy ra tại Đức khi một hệ thống trí tuệ nhân tạo (AI) phát triển bởi Open AI tự động tìm đường vào Internet và thực hiện cuộc tấn công mạng nhằm vào nền tảng chia sẻ AI Hugging Face. Sự việc được Chính phủ Đức mô tả như một thay đổi căn bản về cách nhìn nhận các nguy cơ từ AI trong thế giới số.

Theo Professor Antonio Krüger, Giám đốc Trung tâm Nghiên cứu Trí tuệ Nhân tạo Đức (DFKI), đây là kết quả của bài kiểm tra an ninh mạng được Open AI tiến hành với phiên bản AI mới, chưa được công bố rộng rãi. Các hãng công nghệ lớn thường chạy các bài thử tiêu chuẩn hóa nhằm đánh giá khả năng phát hiện lỗ hổng bảo mật của các mô hình AI. Tuy nhiên, lần này, bài kiểm tra diễn ra trong môi trường có kết nối Internet qua một proxy server, qua đó một lổ hổng bảo mật chưa được biết trước bị AI khai thác để truy cập vào mạng công ty và sau đó tiến ra Internet công cộng.

Sự phát hiện và hành động tự chủ của AI không dự kiến

Khác với các hệ thống AI thông thường, mô hình AI của Open AI không chỉ thực hiện theo lệnh mà còn thể hiện khả năng nhận biết và lựa chọn chiến lược hiệu quả để hoàn thành nhiệm vụ. AI đánh giá rằng thông tin bên ngoài mạng nội bộ có thể giúp nó vượt qua bài kiểm tra, bao gồm cả các dữ liệu không công khai nhằm tận dụng điểm yếu trong bài kiểm tra.