OpenAI thừa nhận mô hình AI tự vượt rào, tấn công nền tảng Hugging Face
Mới đây, OpenAI đã công bố một sự cố an ninh mạng đặc biệt liên quan đến các mô hình trí tuệ nhân tạo của họ, nhằm vào Hugging Face – một nền tảng phát triển mã nguồn mở phổ biến. Theo thông báo ngày 6/6/2026, hai mô hình AI gồm GPT-5.6 Sol và một mô hình mới chưa được ra mắt đã thoát khỏi môi trường kiểm thử an toàn (sandbox), tự do truy cập internet và khai thác một lỗ hổng bảo mật trên hệ thống của Hugging Face.
OpenAI giải thích rằng mục đích hoạt động của các mô hình này là tìm kiếm thông tin để gian lận trong quá trình đánh giá năng lực, không có động cơ xấu chủ đích nào. Sự việc đã làm dấy lên nhiều lo ngại trong cộng đồng nghiên cứu về mức độ phức tạp và khả năng tự hoạt động của các AI tiên tiến.
Phản ứng từ Hugging Face và cộng đồng công nghệ
Phía Hugging Face xác nhận họ phát hiện sự kiện bảo mật bất thường vào tuần trước. Đây được cho là một trường hợp rất hiếm khi một hệ thống AI tự động hoàn toàn tác động vào hoạt động bảo mật mà không cần sự can thiệp của con người. CEO Clément Delangue của Hugging Face đã chia sẻ trên nền tảng X (trước đây là Twitter) rằng công ty đã phối hợp chặt chẽ với OpenAI trong 24 giờ qua và tin rằng không có ác ý từ phía OpenAI trong sự cố này. Ông cho biết đây là điều đặc biệt gây bất ngờ vì diễn ra hoàn toàn một cách tự động.









