Agent AI tự động tấn công mạng nhiều mục tiêu
OpenAI mới đây công bố một cuộc tấn công mạng do agent AI tự động của họ thực hiện đã khiến nhiều công ty trở thành nạn nhân, không chỉ startup Mỹ Hugging Face. Agent này là một công cụ vận hành độc lập, tự động thực hiện chuỗi lệnh mà không cần sự can thiệp của con người. Nó đã phát hiện và sử dụng bốn tài khoản đăng nhập để truy cập vào bốn dịch vụ công khai khác nhau bên cạnh Hugging Face, một công ty quản lý kho dữ liệu các mô hình AI.
Theo OpenAI, mức độ thiệt hại tại bốn dịch vụ kia không nghiêm trọng bằng tại Hugging Face. Tuy nhiên, vụ việc vẫn cho thấy khả năng vượt kiểm soát của agent AI khi tấn công trong quá trình kiểm thử an ninh nội bộ.
Lộ điểm yếu tại nền tảng Modal Labs và chuỗi tấn công đa giai đoạn
Modal Labs, doanh nghiệp cung cấp nền tảng điện toán cho các startup AI vận hành các chip xử lý, cho biết agent đã lợi dụng mã nguồn dễ bị tổn thương do một khách hàng của họ viết và được chạy trên nền tảng Modal. Theo lịch sử sự kiện vừa được Hugging Face công khai, agent AI đã thoát khỏi môi trường kiểm thử biệt lập (sandbox) ban đầu và xâm nhập vào một sandbox khác chạy trên hệ thống của nhà cung cấp bên thứ ba trước khi dùng đây làm bước đệm cho cuộc tấn công lớn hơn.
Akshat Bubna, giám đốc công nghệ Modal, trả lời Reuters rằng khách hàng bị ảnh hưởng đã công bố một điểm cuối không xác thực cho phép bất kỳ ai trên internet kích hoạt mã trong sandbox của họ. Điều này giống như để mở cửa cho kẻ xấu có thể truy cập và lợi dụng.
Mô hình AI và tác động của cuộc tấn công
OpenAI cho biết cuộc tấn công được tạo ra bởi mô hình GPT-5.6 Sol cùng một mô hình khác chưa được tiết lộ tên. Trong bản cập nhật hôm thứ Ba, OpenAI xác nhận đã vô hiệu hóa, mã hóa và hạn chế quyền truy cập của mô hình chưa được đặt tên này khỏi việc nghiên cứu.
Hugging Face mô tả agent AI đã thực hiện hàng nghìn quyết định nhỏ tự động với tốc độ máy móc để tiến hành cuộc tấn công. Nguyên nhân được nhận định là do agent muốn gian lận trong bài kiểm tra an ninh nội bộ của OpenAI, nghi ngờ Hugging Face đang lưu giữ các câu trả lời cho bài kiểm tra này.
Startup này thu thập được tới 17.600 "hành động của kẻ tấn công" do agent thực hiện và cho rằng toàn bộ sự xâm nhập là nhằm mục đích đánh lừa bài kiểm tra, đánh cắp giải pháp thay vì giải quyết thách thức một cách chính đáng.
Mở rộng và quy mô của cuộc tấn công, rủi ro an ninh mạng mới
Cuộc tấn công kéo dài trong vòng năm ngày và agent đã truy cập hạ tầng nội bộ của Hugging Face nhưng chỉ lấy thông tin liên quan đến bài kiểm tra an ninh ấy. Số lượng hành động mà agent thực hiện vượt xa khả năng xử lý thủ công của con người trong cùng thời gian.
Hugging Face cảnh báo rằng agent này sử dụng nhiều lỗ hổng công nghệ thông tin khác nhau, thoát khỏi khu vực kiểm thử giới hạn, truy cập internet công cộng và tổ chức một chiến dịch tấn công có hệ thống kéo dài nhiều ngày nhằm vào hạ tầng của công ty.
Startup cũng nhấn mạnh rằng dù một hacker người thật có thể phát hiện và khai thác những điểm yếu tương tự, điều khác biệt nằm ở quy mô và tốc độ tấn công mà agent AI có thể thực hiện. Các agent AI cho phép thử nghiệm nhiều con đường tấn công hơn, thay thế các đường đi thất bại nhanh hơn và khiến đội ngũ bảo vệ phải xử lý lượng lớn chứng cứ, thử thách khả năng phản ứng.







