Giới hạn của AI để ngăn chặn hacker khiến nghiên cứu an ninh mạng bị ảnh hưởng

Trong suốt nhiều tháng qua, các tập đoàn công nghệ lớn đã thiết lập các chương trình giám sát và hạn chế chặt chẽ việc sử dụng mô hình AI nhằm ngăn chặn hacker độc hại lợi dụng để thực hiện các cuộc tấn công mạng. Tuy nhiên, chính những giới hạn này đang gây khó khăn cho các chuyên gia bảo vệ hệ thống và nhà nghiên cứu an ninh mạng tấn công (offensive cybersecurity), những người chuyên tìm ra và khai thác lỗ hổng để tăng cường an toàn mạng.

Ví dụ, vào tháng 6 năm nay, chính phủ Mỹ áp dụng các biện pháp kiểm soát xuất khẩu đối với các mô hình AI nổi bật của Anthropic là Mythos và Fable. Nguyên nhân được cho một phần bắt nguồn từ báo cáo chỉ ra khả năng vượt qua các lớp bảo vệ trong những mô hình này nhằm sử dụng AI cho các cuộc tấn công mạng. Mặc dù sau đó lệnh kiểm soát với Mythos 5 và Fable 5 đã được gỡ bỏ một phần, những hạn chế vẫn còn áp dụng đối với một số đối tượng người dùng Mỹ trong quá trình đánh giá tiếp theo.

Chương trình Xác thực và những rào cản với nhà nghiên cứu

Anthropic cùng OpenAI đều phát triển các chương trình cho phép các nhà nghiên cứu an ninh mạng được xác minh có thể truy cập vào các mô hình AI với hạn chế giảm thiểu nhằm phục vụ cho mục đích khám phá lỗ hổng. Anthropic phát triển Chương trình Xác thực An ninh mạng (Cyber Verification Program) và OpenAI vận hành Trusted Access for Cyber. Tuy vậy, các rào cản, quy trình kiểm duyệt, và giới hạn truy cập trong các chương trình này được nhiều chuyên gia cho là quá nghiêm ngặt, ảnh hưởng trực tiếp đến hiệu quả công việc.