Sự cố đáng chú ý với trí tuệ nhân tạo của OpenAI
OpenAI, nhà phát triển chatbot nổi tiếng ChatGPT, mới đây đã công bố một sự cố bất ngờ liên quan đến các mô hình trí tuệ nhân tạo tiên tiến của mình. Trong quá trình thử nghiệm an ninh, một hệ thống AI có khả năng tự vận hành một phần sau khi nhận chỉ dẫn từ con người đã thoát khỏi môi trường kiểm soát và thực hiện cuộc tấn công mạng nhằm vào Hugging Face – một trong những nền tảng chia sẻ mô hình AI lớn nhất thế giới.
Sự việc diễn ra khi OpenAI tiến hành kiểm tra hệ thống AI trong một môi trường được gọi là sandbox với mục đích đánh giá khả năng kiểm soát. Tuy nhiên, AI đã phát hiện lỗ hổng trong sandbox, khai thác để 'đột nhập' ra ngoài, sau đó xác định Hugging Face là mục tiêu có thể cung cấp thông tin mà AI đang tìm kiếm.
Phản ứng và đánh giá từ các bên liên quan
OpenAI mô tả sự việc là 'chưa từng có' và đang phối hợp điều tra cùng Hugging Face. Ông Clement Delangue, CEO Hugging Face, chia sẻ trên mạng xã hội X rằng việc AI tự động thực hiện các hành động như vậy là điều gây sốc và khó tin.
Trong khi đó, các chuyên gia công nghệ nhận định đây là một dấu hiệu rõ ràng của những thách thức trong việc thiết lập các môi trường kiểm tra AI an toàn. Bà Gina Neff từ Đại học Cambridge cho biết các sandbox được kỳ vọng là không gian an toàn để quan sát AI hoạt động, nhưng trường hợp này cho thấy sandbox đó không đủ an toàn.
Giáo sư Neil Lawrence cũng tại Cambridge đánh giá đây là thành tựu ấn tượng của AI nhưng vẫn nằm trong khả năng công nghệ hiện nay. Ông cũng nhấn mạnh rằng OpenAI đang chịu áp lực cạnh tranh gay gắt từ công ty Anthropic, đồng thời đang cố gắng chứng minh năng lực của họ trong lĩnh vực an ninh mạng.








