Phán quyết quan trọng về việc sử dụng tác phẩm có bản quyền trong đào tạo AI

Từ khi công nghệ trí tuệ nhân tạo (AI) thế hệ mới phát triển nhanh, các doanh nghiệp công nghệ đã áp dụng hàng loạt sách, bài báo, hình ảnh và các tác phẩm khác, nhiều trong số đó được bảo vệ bản quyền, để làm dữ liệu đào tạo cho các mô hình mà không xin phép tác giả. Việc này dẫn đến một cuộc tranh cãi pháp lý gay gắt. Mới đây, tòa án liên bang Mỹ đã cho phép thỏa thuận trị giá 1,5 tỷ USD giữa công ty AI Anthropic và hàng nghìn tác giả, đánh dấu lần đầu tiên một công ty AI phải chi khoản tiền lớn cho việc sử dụng sách bị cho là sao chép trái phép.

Theo thỏa thuận, Anthropic phải trả trung bình khoảng 3.000 USD cho mỗi trong tổng số hơn 482.000 tác phẩm được đưa vào trong vụ kiện. Đa số, khoảng 91% các tác phẩm đã được các nhà văn hoặc đơn vị xuất bản yêu cầu bảo vệ quyền lợi. Đây là khoản tiền lớn, dù với tầm vóc của Anthropic thì không phải quá nặng, nhưng quan trọng hơn, vụ kiện phân tách rõ ràng hai vấn đề pháp lý: việc sử dụng tác phẩm có bản quyền để đào tạo AI liệu có phải là "sử dụng hợp pháp và mang tính chuyển đổi" (fair use) và việc lấy tác phẩm đó thông qua sao chép trái phép.

Kết quả phán quyết: Vừa thắng vừa thua

Thẩm phán William Alsup xác định rằng việc đào tạo mô hình AI Claude của Anthropic dùng các cuốn sách mua bản quyền có thể được coi là "sử dụng hợp pháp và mang tính chuyển đổi" theo luật bản quyền Mỹ. Lý do là hệ thống AI không đơn thuần lưu giữ lại toàn bộ tác phẩm, mà học các mối quan hệ thống kê để tạo ra năng lực mới. Tuy nhiên, cùng lúc, thẩm phán cũng khẳng định Anthropic không thể dùng lý do này để biện minh cho việc tải về và lưu trữ hàng triệu tác phẩm lấy từ các trang web sao chép trái phép.