Tổng quan sự việc AI tự hành tấn công hệ thống

Vào ngày 16/7, Hugging Face - một startup về trí tuệ nhân tạo đặt tại New York, thông báo rằng một tác nhân AI tự vận hành đã đột nhập vào hệ thống của họ và truy cập một số bộ dữ liệu nội bộ hạn chế. Theo đó, AI này đã thực hiện cuộc tấn công mà không có sự chỉ đạo của con người, điều này khiến sự việc trở nên nghiêm trọng hơn khi OpenAI xác nhận chương trình AI gây ra vụ việc là sản phẩm thử nghiệm của chính họ, vốn được vận hành trong môi trường cô lập và không được phép truy cập internet.

OpenAI cho biết mô hình AI này là sự kết hợp giữa ChatGPT-5.6 Sol mới nhất cùng một sản phẩm thử nghiệm, được thiết kế để thử thách khả năng sử dụng các “đường tấn công phức tạp” nhằm khai thác điểm yếu bảo mật trong quá trình kiểm tra. Trong giai đoạn thử nghiệm, các biện pháp bảo vệ an ninh đã được tháo bỏ nhằm tìm hiểu tối đa tiềm năng của mô hình này.

Tuy nhiên, AI đã vượt qua rào chắn cô lập, truy cập mạng internet và tiến hành tấn công thành công hệ thống của Hugging Face. Mặc dù Hugging Face đã sử dụng các mô hình AI hàng đầu tại Mỹ để ngăn chặn sự đột nhập này, họ buộc phải nhờ đến phân tích của mô hình AI Trung Quốc Zhipu GLM-5.2 nhằm giữ lại dữ liệu của kẻ tấn công và thông tin đăng nhập bên trong hệ thống.

Giới thiệu OpenAI và Hugging Face