Thực trạng năng lực của Kimi K3 trong tấn công mạng

Nghiên cứu phối hợp giữa Viện An ninh Trí tuệ Nhân tạo Anh (AISI) và Trung tâm Chuẩn mực và Đổi mới AI Mỹ (CAISI) vừa công bố một báo cáo đánh giá năng lực của mô hình trí tuệ nhân tạo Kimi K3 do công ty Moonshot AI của Trung Quốc phát triển. Đây là mô hình ngôn ngữ lớn hiện được xem là mạnh nhất tại Trung Quốc ở thời điểm hiện tại, tuy nhiên kết quả đánh giá lại cho thấy Kimi K3 hoạt động kém xa so với các mô hình hàng đầu của Mỹ trong khả năng phát triển các kỹ thuật tấn công mạng.

Báo cáo nêu rõ Kimi K3 chỉ đạt tổng điểm 32,2% trong bài kiểm tra ExploitBench, một tiêu chuẩn đánh giá khả năng của AI trong việc tạo ra các exploit cho những điểm yếu mạng. So với đối thủ trong nước là Zhipu AI với mô hình GLM-5.2 chỉ đạt 24,4%, Kimi K3 có phần vượt trội hơn nhưng vẫn còn cách xa mức trung bình 76,2% của các mô hình Mỹ được giữ kín danh tính.

Khả năng khai thác và mô phỏng tấn công

Trong 41 nhiệm vụ được thử thách trong ExploitBench, Kimi K3 không thể thực hiện được kỹ thuật tùy ý chạy mã (arbitrary code execution) - một hình thức tấn công cao cấp cho phép kiểm soát hoàn toàn hệ thống mục tiêu, trong khi các mô hình Mỹ hàng đầu đã thành công với kỹ thuật này trên 20 nhiệm vụ. Điều này cho thấy một khoảng cách lớn về trình độ khai thác của Kimi K3 so với đối thủ.

Tương tự, trong mô phỏng tấn công mạng 32 bước "The Last Ones" do AISI phát triển, mô hình Trung Quốc chỉ đạt trung bình 17 bước, thấp hơn nhiều so với 28,5 bước của mô hình Mỹ. Dù vậy, Kimi K3 vẫn đủ khả năng tự động hoàn thành một cuộc tấn công giả lập trên một hệ thống doanh nghiệp yếu và ít bảo vệ trong 10 lần thử, cho thấy tiềm năng trong việc đối phó với những mục tiêu yếu thế.

Ý nghĩa và phản ứng trước kết quả

Báo cáo nghiên cứu này được công bố trong bối cảnh Washington đang lo ngại về sự trỗi dậy nhanh chóng của các mô hình AI mã nguồn mở từ Trung Quốc, đặc biệt sau khi Kimi K3 vượt mặt nhiều đối thủ quốc tế trong một số lĩnh vực khác như phát triển giao diện web. Tuy nhiên, khoảng cách rõ nét về khả năng tấn công mạng có thể làm dịu đi phần nào lo ngại của Mỹ và Anh về nguy cơ từ lĩnh vực này.

Trước đó, một số quan chức Mỹ có ý kiến chỉ trích Kimi K3, cáo buộc mô hình sử dụng phương pháp "distillation" từ các mô hình lớn của công ty Anthropic và đánh cắp tài sản trí tuệ Mỹ, dẫn đến mối nguy bị trừng phạt. Trong khi đó, chuyên gia David Sacks, cựu lãnh đạo AI Nhà Trắng và đồng chủ tịch Hội đồng Cố vấn về Khoa học và Công nghệ của cựu Tổng thống Donald Trump, cho rằng những lo ngại về Kimi K3 bị phóng đại và mô hình Mỹ vẫn giữ vị thế dẫn đầu.

Thông tin về các tổ chức đánh giá

Viện An ninh Trí tuệ Nhân tạo Anh (AISI) trực thuộc Bộ Khoa học, Đổi mới và Công nghệ Vương quốc Anh, còn Trung tâm Chuẩn mực và Đổi mới AI Mỹ (CAISI) hoạt động trong khuôn khổ Viện Tiêu chuẩn và Công nghệ quốc gia Mỹ thuộc Bộ Thương mại. Sự hợp tác giữa hai cơ quan này mang lại cái nhìn khách quan về thực trạng năng lực công nghệ AI trong lĩnh vực an ninh mạng.

Những đánh giá chính xác về điểm mạnh và điểm yếu của các mô hình AI như Kimi K3 giúp các nhà hoạch định chính sách có cái nhìn thực tế, tránh quá lo ngại và có biện pháp quản lý phù hợp đối với ngành công nghệ đang phát triển nhanh chóng này.

Những điều bổ ích từ bài viết

  • Mô hình Kimi K3 đạt 32,2% điểm trong bài kiểm tra ExploitBench về khả năng phát triển exploit mạng.
  • Các mô hình Mỹ đạt trung bình 76,2% điểm, vượt xa Kimi K3 và Zhipu AI của Trung Quốc.
  • Kimi K3 thất bại trong thực hiện kỹ thuật chạy mã tùy ý trên tất cả 41 nhiệm vụ thử nghiệm.
  • Trong mô phỏng tấn công mạng 32 bước The Last Ones, Kimi K3 chỉ đạt trung bình 17 bước, thấp hơn nhiều so với mô hình Mỹ.
  • Kimi K3 có thể tự động tấn công thành công một hệ thống doanh nghiệp yếu trong 10 lần thử.

Đăng ký bản tin QMVN

Nhận tin tổng hợp mỗi sáng - chỉ những bài đáng đọc, không spam.

Bài viết được biên tập với sự hỗ trợ của công cụ trí tuệ nhân tạo (AI), tổng hợp từ các nguồn tin dẫn bên dưới và đã qua kiểm duyệt của toà soạn Quang Minh Việt Nam.