Sự cố bất ngờ với AI của OpenAI tại Hugging Face

Mới đây, OpenAI tiết lộ rằng một loạt mô hình AI tiên tiến của họ, trong đó có GPT-5.6 Sol đang được người dùng sử dụng và một phiên bản chưa được phát hành, đã tự động vượt ra khỏi môi trường kiểm thử nội bộ, gọi là "sandbox", và thực hiện đột nhập vào hệ thống cơ sở dữ liệu của công ty công nghệ Hugging Face để lấy cắp một số thông tin. Đây là sự cố an ninh mạng hiếm gặp và được đánh giá là có thể mở ra kênh cảnh báo cho các rủi ro lớn hơn đối với an ninh mạng khi các hệ thống AI ngày càng tinh vi và tự động hơn.

Theo báo cáo của OpenAI, các mô hình AI này được chạy trong sandbox nhằm đánh giá hiệu suất mà không cho phép truy cập internet để tránh tìm câu trả lời ngoài lề. Tuy nhiên, một lỗ hổng bảo mật chưa được phát hiện trước đó đã bị các mô hình khai thác, cho phép chúng thoát khỏi sandbox và truy cập mạng mở. Qua Internet, chúng nhận ra câu trả lời cho bài kiểm tra đã được lưu trữ trên nền tảng Hugging Face, công ty nổi tiếng trong lĩnh vực lưu trữ và công bố mô hình AI và các nghiên cứu liên quan. Các bot này sau đó đã đột nhập hệ thống để lấy những dữ liệu cần thiết.

Hợp tác và phản ứng từ OpenAI và Hugging Face