Anthropic chi 1,5 tỉ USD dàn xếp vụ kiện dùng sách lậu đào tạo AI

TUẤN ĐÔNG (tổng hợp)

VHO - Thỏa thuận dàn xếp trị giá 1,5 tỉ USD giữa Anthropic và các tác giả, nhà xuất bản Mỹ đang làm nóng tranh luận về việc sử dụng tác phẩm có bản quyền để huấn luyện trí tuệ nhân tạo (AI). Vụ việc không chỉ đặt ra câu hỏi về trách nhiệm của các công ty AI mà còn cho thấy cuộc tranh luận toàn cầu về ranh giới giữa đổi mới công nghệ và quyền của người sáng tạo đang bước sang giai đoạn mới.

Ngày 20.7.2026, một thẩm phán Liên bang Mỹ đã phê chuẩn thỏa thuận dàn xếp trị giá 1,5 tỉ USD giữa Anthropic, một công ty nghiên cứu và phát triển trí tuệ nhân tạo (AI) của Mỹ, và nhóm tác giả, nhà xuất bản trong vụ kiện liên quan việc sử dụng các bản sao sách có bản quyền để huấn luyện các mô hình AI đứng sau chatbot Claude.

Đây được xem là một trong những vụ dàn xếp bản quyền lớn nhất tại Mỹ, với số tiền bồi thường dự kiến được phân bổ cho hơn 482.000 tác phẩm.

Anthropic chi 1,5 tỉ USD dàn xếp vụ kiện dùng sách lậu đào tạo AI - ảnh 1
Ảnh minh hoạ

Theo thỏa thuận, các tác giả và chủ sở hữu quyền đủ điều kiện có thể nhận khoảng 3.000 USD cho mỗi tác phẩm. Khoảng 91% số tác phẩm thuộc diện dàn xếp đã có tác giả hoặc nhà xuất bản yêu cầu nhận bồi thường.

Vụ kiện bắt nguồn từ cáo buộc Anthropic đã thu thập hàng triệu bản sao sách có bản quyền từ các nguồn trực tuyến không hợp pháp để xây dựng một thư viện dữ liệu phục vụ quá trình phát triển và huấn luyện AI. Các nguyên đơn cho rằng việc sử dụng những tác phẩm này mà không được phép đã xâm phạm quyền của tác giả và chủ sở hữu bản quyền.

Điểm đáng chú ý là tranh chấp không chỉ xoay quanh câu hỏi liệu AI có được sử dụng sách có bản quyền để huấn luyện hay không, mà còn liên quan đến cách thức doanh nghiệp có được những tác phẩm đó.

Trong một phán quyết trước đó, tòa án Mỹ từng nhận định việc sử dụng sách có bản quyền để huấn luyện AI có thể thuộc phạm vi “sử dụng hợp lý” (fair use) trong một số trường hợp.

Tuy nhiên, việc Anthropic thu thập và lưu trữ hàng triệu bản sao sách từ các nguồn lậu lại bị xác định là hành vi vi phạm bản quyền. Đây là điểm phân định quan trọng, cho thấy việc sử dụng nội dung để huấn luyện AI và việc có được nội dung đó bằng phương thức hợp pháp là hai vấn đề pháp lý có thể được xem xét riêng biệt.

Anthropic đã phủ nhận trách nhiệm pháp lý, nhưng đồng ý dàn xếp vụ kiện. Khoản tiền 1,5 tỉ USD vì thế là khoản dàn xếp để giải quyết tranh chấp, không phải một khoản tiền phạt do tòa án áp đặt.

Vụ việc được đánh giá là dấu mốc đáng chú ý trong cuộc tranh luận đang diễn ra tại Mỹ và nhiều quốc gia về bản quyền trong kỷ nguyên AI. Các mô hình AI lớn cần một lượng dữ liệu khổng lồ để huấn luyện, trong đó có thể bao gồm sách, báo, hình ảnh, âm nhạc và nhiều sản phẩm sáng tạo khác. Khi các công ty công nghệ sử dụng những nguồn dữ liệu này, câu hỏi về quyền được biết, quyền cho phép và quyền được hưởng lợi của tác giả ngày càng trở nên cấp thiết.

Từ vụ Anthropic, một vấn đề lớn được đặt ra là liệu các công ty AI có thể coi những nội dung được công bố trên môi trường số như một nguồn dữ liệu tự do khai thác hay không. Nếu tác phẩm có bản quyền trở thành “nguyên liệu” cho các mô hình AI, cơ chế cấp phép, minh bạch nguồn dữ liệu và phân chia lợi ích giữa doanh nghiệp công nghệ với người sáng tạo sẽ là những vấn đề khó có thể né tránh.

Vụ dàn xếp cũng có thể tạo thêm sức ép đối với các công ty AI trong việc xây dựng cơ chế thu thập dữ liệu minh bạch, hợp pháp và có trách nhiệm. Đồng thời, nó được kỳ vọng sẽ tác động đến cách các tòa án, nhà lập pháp và ngành công nghiệp sáng tạo tiếp cận vấn đề bản quyền trong quá trình phát triển AI.

Tại Việt Nam, câu chuyện này cũng có giá trị tham khảo trong bối cảnh hành lang pháp lý về AI và sở hữu trí tuệ đang tiếp tục được hoàn thiện. Khi các mô hình AI tiếng Việt phát triển và nhu cầu về dữ liệu chất lượng cao ngày càng tăng, câu hỏi về việc sử dụng sách, báo, tác phẩm văn học, âm nhạc và các nội dung tiếng Việt có bản quyền để huấn luyện AI cũng sẽ cần được quan tâm.

Điều này không đồng nghĩa với việc cản trở đổi mới sáng tạo. Ngược lại, một cơ chế rõ ràng về quyền sử dụng dữ liệu, cấp phép và chia sẻ lợi ích có thể giúp tạo nền tảng cho sự phát triển bền vững của cả AI lẫn ngành công nghiệp sáng tạo.

Với quy mô 1,5 tỉ USD, vụ việc Anthropic cho thấy bản quyền đang trở thành một trong những vấn đề lớn nhất mà ngành AI phải đối mặt. Khi cuộc đua phát triển các mô hình ngày càng tăng tốc, câu hỏi không còn đơn giản là AI có thể học được gì từ dữ liệu, mà ngày càng trở thành AI được phép học từ dữ liệu nào, bằng cách nào và ai sẽ được hưởng lợi từ giá trị tạo ra.