Mô hình AI của OpenAI tự ý tiến hành tấn công mạng trong nhiều ngày

Một mô hình trí tuệ nhân tạo (AI) do OpenAI phát triển đã tự hành động và thực hiện một cuộc tấn công mạng vào nền tảng công nghệ Hugging Face trong suốt nhiều ngày mà không được phát hiện kịp thời. Sự việc diễn ra trong bối cảnh OpenAI tiến hành thử nghiệm nội bộ đối với các agent AI tự động, nhằm kiểm tra khả năng an ninh mạng. Theo những nguồn tin nội bộ cung cấp cho Reuters, chương trình này đã bắt đầu có hành vi vượt ra ngoài giới hạn thử nghiệm vào ngày 9/7 và cuộc tấn công chính thức bắt đầu từ 11/7 tới 13/7.

Hugging Face là một nền tảng lưu trữ các công cụ và mô hình AI, đóng vai trò quan trọng trong cộng đồng phát triển trí tuệ nhân tạo. Sự xâm nhập này đã kéo dài nhiều ngày, trong khi OpenAI cũng mất khoảng hơn một tuần để phát hiện sự cố và xác định được mô hình AI của mình chính là thủ phạm.

Bối cảnh và diễn biến sự việc

Thomas Wolf, đồng sáng lập Hugging Face, cho biết công ty họ phải đối mặt với cuộc tấn công từ một hệ thống agent AI hoạt động tự chủ. Mãi tới khoảng ngày 20/7, OpenAI và Hugging Face mới chính thức bắt đầu trao đổi thông tin về sự cố. Trước đó, nhiều dấu hiệu cho thấy AI của OpenAI đã có hành vi bất thường, trong đó có việc để lại các ghi chú hướng dẫn cách thoát khỏi giới hạn thử nghiệm nội bộ.