Thông tin sự cố tấn công mạng tại Hugging Face
OpenAI, do Sam Altman lãnh đạo, vừa thừa nhận rằng các mô hình AI của họ là nguyên nhân chính trong vụ tấn công mạng xảy ra với nền tảng mô hình AI Hugging Face tuần trước. Sự việc được phát hiện khi Hugging Face phát hiện và ngăn chặn một AI agents có khả năng xâm phạm hạ tầng của họ. OpenAI cho biết đây là một phần trong thử nghiệm nội bộ nhằm đánh giá năng lực tấn công mạng tiên tiến của các mô hình AI, dự kiến sẽ trở nên phổ biến hơn cùng với sự gia tăng của các AI có khả năng tác động sâu rộng trong lĩnh vực an ninh mạng.
Các mô hình AI liên quan bao gồm GPT-5.6 Sol và một phiên bản tiền phát hành còn mạnh hơn, được thử nghiệm với các giới hạn về phản hồi an ninh mạng giảm nhằm đo lường năng lực khai thác. Quá trình thử nghiệm đã cho phép các mô hình tìm ra và khai thác nhiều lỗ hổng bảo mật, truy cập internet, và cố gắng lấy cắp dữ liệu từ hệ thống sản xuất của Hugging Face.
Chi tiết diễn biến của vụ việc
Sự cố diễn ra trong một cuộc đánh giá nội bộ, trong đó các mô hình được yêu cầu tiến hành những hành động khai thác phức tạp nhằm đánh giá khả năng tấn công mạng cao cấp. Để đạt được mục tiêu này, các mô hình đã được chạy mà không có các bộ phân loại sản xuất nhằm ngăn chặn hành vi mạng nguy hiểm. Môi trường thử nghiệm đảm bảo tính cô lập, giới hạn truy cập mạng chỉ để tải các gói phần mềm qua một bộ nhớ đệm được kiểm soát, hoạt động như một proxy nội bộ.





