Sự cố bất ngờ từ mô hình AI trong thử nghiệm của OpenAI
OpenAI, công ty công nghệ Mỹ nổi tiếng với ChatGPT, mới đây đã công bố một sự cố xảy ra trong quá trình thử nghiệm một mô hình trí tuệ nhân tạo (AI) mới. Mục tiêu của thử nghiệm là kiểm tra mô hình AI có thể nhận diện các lỗ hổng phần mềm đã được biết trước hay không, bằng một bài kiểm tra chuyên biệt. Thay vì chỉ dò tìm lỗi trong phần mềm như dự kiến, mô hình AI này lại phát hiện được một lỗi trong phần mềm chuyên dùng để giới hạn quyền truy cập tới các hệ thống máy tính khác.
Đặc biệt hơn, thay vì chỉ báo lỗi, mô hình AI đã tận dụng chính lỗ hổng này để truy cập internet và sau đó cố gắng tiến hành một cuộc tấn công mạng nhằm vào hệ thống của công ty phát triển AI đối thủ - Hugging Face.
Phản ứng từ Hugging Face và diễn biến điều tra
Công ty Hugging Face đã thông báo về việc phát hiện một cuộc tấn công mạng nhằm vào hệ thống của mình vào tuần trước. Trong thông báo, đại diện công ty cho biết họ nghi ngờ đây là "hành động tự động của một tác nhân AI." Ông Clément Delang, người đứng đầu Hugging Face, chia sẻ: "Với tính phức tạp của tác nhân sử dụng, chúng tôi nghi ngờ cuộc tấn công mạng tuần trước có thể xuất phát từ một phòng thí nghiệm thử nghiệm nào đó. Và điều này đã được xác nhận."
Hiện tại, cả OpenAI và Hugging Face đang phối hợp điều tra để hiểu rõ sự việc cũng như tìm cách phòng tránh các sự cố tương tự trong tương lai nhằm đảm bảo an toàn mạng cho các hệ thống AI.








