Tổng quan sự việc
Công ty Anthropic mới đây đã tố cáo Alibaba, một doanh nghiệp AI Trung Quốc, đã bất hợp pháp khai thác kiến thức số từ Claude, một mô hình ngôn ngữ lớn (LLM) và AI sinh tạo phổ biến của họ. Theo đó, Alibaba đã thiết lập hàng nghìn tài khoản đăng nhập giả nhằm truy cập và sử dụng hàng triệu cặp truy vấn (prompts) cùng phản hồi (responses) từ Claude để trích xuất tri thức số phục vụ việc huấn luyện mô hình AI riêng của mình.
Kỹ thuật chưng cất AI và cách thức tấn công
Kỹ thuật chưng cất (distillation) là phương pháp chuyển giao kiến thức từ một mô hình lớn sang mô hình nhỏ hơn nhằm nâng cao hiệu suất. Việc này được ví như mối quan hệ giữa thầy (Large Language Model - LLM) và trò (Small Language Model - SLM), với LLM giúp cải thiện năng lực cho SLM. Khi áp dụng hợp pháp, đây là quy trình phổ biến trong phát triển AI.
Ngược lại, kỹ thuật chưng cất có thể bị lạm dụng để đánh cắp sở hữu trí tuệ bằng cách rút trích tri thức từ LLM của đối thủ mà không được phép, làm tăng năng lực cho mô hình AI của bên thứ ba một cách phi pháp. Đây là thủ đoạn tinh vi, khó phát hiện vì chỉ tương tác thông thường thông qua truy vấn, không làm ảnh hưởng trực tiếp hay phá vỡ hệ thống.
Để thực hiện hành vi này, Alibaba được cho là đã tạo ra khoảng 25.000 tài khoản giả mạo, vận hành qua các máy chủ và công cụ tự động nhằm giả lập người dùng thật, đồng thời phân tán địa lý để tránh bị phát hiện. Trong khoảng 3 tháng từ tháng 4 đến tháng 6 năm 2026, các tài khoản này đã thực hiện gần 29 triệu lượt trao đổi truy vấn - phản hồi với Claude, tức khoảng 12 đến 13 lượt mỗi tài khoản mỗi ngày.













