Sony đòi Anthropic tới 150.000 USD cho mỗi ca khúc bị cáo buộc vi phạm bản quyền
Sony Music Publishing và Warner Chappell Music vừa đệ đơn kiện Anthropic lên Tòa án quận Bắc California (Mỹ), cáo buộc công ty AI này sử dụng trái phép hàng vạn tác phẩm âm nhạc có bản quyền để phát triển các mô hình Claude.
Hai đồng sáng lập Anthropic là Giám đốc điều hành Dario Amodei và Benjamin Mann cũng bị nêu tên là bị đơn trong vụ kiện.
Trong đơn kiện nộp hôm 28/8, hai công ty xuất bản âm nhạc Sony Music Publishing và Warner Chappell Music cáo buộc Anthropic tiến hành một “chiến dịch trắng trợn” nhằm tải xuống trái phép, thu thập và sao chép các tác phẩm có bản quyền trên quy mô lớn để phát triển, vận hành và thu lợi từ những mô hình Claude.
Sony Music Publishing và Warner Chappell Music cho biết Anthropic đã thu thập hàng vạn tác phẩm âm nhạc có bản quyền, gồm cả những bài nổi tiếng như Eye of the Tiger của Survivor, Ain't No Mountain High Enough của Marvin Gaye, All I Want for Christmas Is You của Mariah Carey và Paper Rings của Taylor Swift.
Hai công ty cáo buộc Anthropic vi phạm bản quyền tác phẩm của họ thông qua nhiều phương thức, trong đó có việc sử dụng hai kho lưu trữ kỹ thuật số là Library Genesis và Pirate Library Mirror.
“Trong số hàng triệu cuốn sách mà Anthropic tải xuống từ các trang web lậu, có nhiều tài liệu chứa lời bài hát và bản nhạc của hàng trăm tác phẩm âm nhạc có bản quyền thuộc những công ty xuất bản. Danh sách này gồm cả những ca khúc nổi tiếng như Livin' on a Prayer, September, Great Balls of Fire, Ramblin' Man và Hallelujah”, đơn kiện nêu.

Vụ Anthropic sao chép và lưu trữ hơn 7 triệu bản sách lậu
Sony Music Publishing và Warner Chappell Music cũng viện dẫn một vụ kiện trước đó liên quan đến việc Anthropic sử dụng sách có bản quyền để phát triển Claude.
Tháng 6/2025, thẩm phán liên bang William Alsup kết luận việc Anthropic sử dụng những cuốn sách có bản quyền mà công ty thu thập hợp pháp để huấn luyện mô hình AI có thể được xem là fair use (sử dụng hợp lí) theo luật Mỹ. Tuy nhiên, ông đồng thời xác định Anthropic đã sao chép, lưu trữ hơn 7 triệu bản sách lậu trong một thư viện trung tâm, và hành vi này không được fair use bảo vệ.
Fair use là khái niệm trong luật bản quyền của Mỹ, cho phép sử dụng một phần tác phẩm có bản quyền mà không cần xin phép chủ sở hữu trong một số trường hợp nhất định, miễn là việc sử dụng đó mang tính hợp lí, không gây thiệt hại đáng kể cho chủ sở hữu bản quyền.
Claude có thể tái tạo nội dung có bản quyền
Sony Music Publishing và Warner Chappell Music cáo buộc rằng việc đưa các tác phẩm âm nhạc có bản quyền vào dữ liệu phát triển Claude khiến mô hình AI này có khả năng tạo ra những bản sao giống hệt hoặc gần giống bản gốc khi trả lời người dùng.
Theo đơn kiện, việc Anthropic huấn luyện Claude bằng nội dung có bản quyền cho phép mô hình AI này tạo ra lời bài hát, từ đó có khả năng cạnh tranh trực tiếp với các ca khúc do con người sáng tác.
Sony Music Publishing và Warner Chappell Music yêu cầu xét xử bởi bồi thẩm đoàn. Hai công ty đề nghị áp dụng mức bồi thường theo luật định lên tới 150.000 USD cho mỗi tác phẩm âm nhạc bị xác định là cố ý vi phạm bản quyền. Họ cũng yêu cầu tối đa 25.000 USD cho mỗi trường hợp bị cáo buộc xóa hoặc làm mất thông tin quản lí quyền tác giả. Nếu các yêu cầu được chấp nhận ở mức tối đa, tổng số tiền Anthropic có thể phải trả sẽ lên tới hàng tỉ USD.
“Ngay cả những công nghệ mang tính cách mạng nhất cũng phải phát triển trong khuôn khổ pháp luật, và các mô hình Claude của Anthropic cũng không phải ngoại lệ”, Sony Music Publishing và Warner Chappell Music viết trong đơn kiện.
Ngành AI đã phải đối mặt với hàng loạt vụ kiện bản quyền kể từ khi các mô hình ngôn ngữ lớn như Claude và GPT của OpenAI bắt đầu làm thay đổi xã hội.
Các hãng công nghệ cần lượng dữ liệu khổng lồ để huấn luyện mô hình AI và thường phải tìm nhiều cách để thu thập chúng. Gần đây, các nhà sử học và lưu trữ học cáo buộc các công ty AI thu thập số lượng lớn sách cổ rồi đưa vào các mô hình ngôn ngữ lớn, thậm chí làm hư hỏng hoặc phá hủy sách trong quá trình này.
Các tài liệu cho thấy Anthropic từng triển khai một dự án nội bộ có tên Project Panama, nhằm mua số lượng rất lớn sách in, sau đó cắt phần gáy sách, đưa từng trang qua máy quét tốc độ cao để chuyển thành dữ liệu số rồi loại bỏ bản sách giấy. Theo tạp chí Forbes, các tài liệu trong vụ kiện cho thấy Anthropic từng có kế hoạch quét từ 500.000 đến 2 triệu cuốn sách trong một hợp đồng kéo dài 6 tháng.
Hồi tháng 7/2026, Anthropic được tòa án liên bang Mỹ phê chuẩn thỏa thuận dàn xếp trị giá 1,5 tỉ USD với các tác giả và chủ sở hữu bản quyền trong một vụ kiện liên quan đến việc công ty sử dụng các bản sách vi phạm bản quyền để phát triển Claude. Thỏa thuận bao phủ hơn 482.000 tác phẩm, với mức chi trả khoảng 3.000 USD cho mỗi tác phẩm đủ điều kiện. Khoảng 91% số tác phẩm thuộc diện dàn xếp đã có tác giả hoặc chủ sở hữu bản quyền yêu cầu nhận tiền bồi thường.
OpenAI cũng đối mặt hàng loạt vụ kiện
OpenAI cũng phải đối mặt với nhiều vụ kiện bản quyền những năm gần đây, gồm cả từ báo The New York Times và Encyclopedia Britannica (hãng công nghệ giáo dục và truyền thông đứng sau bộ bách khoa toàn thư danh tiếng cùng tên).
Cuối năm 2023, The New York Times đã đệ đơn kiện OpenAI và Microsoft, cáo buộc hai công ty này đã sử dụng hàng triệu bài báo của hãng mà không được phép để huấn luyện các mô hình ngôn ngữ lớn làm nền tảng cho chatbot ChatGPT.
Theo đơn kiện, OpenAI và Microsoft đã sao chép nội dung từ các bài báo của The New York Times, gồm cả kết quả điều tra và đoạn trích quan trọng, để đưa vào kho dữ liệu huấn luyện mô hình ngôn ngữ lớn. Sau đó, mô hình ngôn ngữ lớn đưa ra các đoạn nội dung gần như nguyên văn trên The New York Times khi người dùng đặt câu hỏi.
The New York Times lập luận điều này không chỉ vi phạm bản quyền mà còn “làm suy yếu” mô hình kinh doanh báo chí khi người đọc có thể truy vấn thông tin mà không cần đăng ký trả phí.
OpenAI bác bỏ cáo buộc và lập luận rằng việc sử dụng dữ liệu công khai để phát triển mô hình AI có thể thuộc phạm vi fair use (sử dụng hợp lý) theo luật bản quyền Mỹ.
Ngoài ra, OpenAI cũng cáo buộc The New York Times đã sử dụng những cách thức bất thường để khiến ChatGPT tái tạo các đoạn nội dung, thay vì phản ánh cách người dùng thông thường sử dụng chatbot AI này.
Với The New York Times, kết quả vụ kiện có thể ảnh hưởng sâu rộng tới tương lai của ngành báo và cách các công ty AI sử dụng dữ liệu báo chí. Với OpenAI và Microsoft, đây là bước quan trọng trong việc xác định giới hạn pháp lí của việc sử dụng dữ liệu để huấn luyện mô hình AI.
Ngày 26/3/2025, thẩm phán liên bang Sidney Stein cho phép phần cốt lõi của vụ kiện bản quyền giữa The New York Times và OpenAI/Microsoft tiếp tục, dù bác bỏ một số yêu cầu khác của nguyên đơn.
Một diễn biến đáng chú ý khác trong vụ kiện là tranh chấp về dữ liệu trò chuyện của người dùng ChatGPT. Ban đầu, The New York Times yêu cầu OpenAI bảo toàn khoảng 1,4 tỉ cuộc trò chuyện ChatGPT để phục vụ quá trình thu thập chứng cứ.
Sau đó, tranh chấp thu hẹp về việc cung cấp khoảng 20 triệu cuộc trò chuyện của người dùng cá nhân, được khử nhận dạng. The New York Times và các nguyên đơn cho rằng những dữ liệu này có thể giúp tìm bằng chứng về việc ChatGPT tạo ra nội dung giống hoặc tương tự các bài báo có bản quyền.
OpenAI phản đối, cho rằng yêu cầu này quá rộng và có nguy cơ xâm phạm quyền riêng tư của hàng triệu người không liên quan đến vụ kiện. Theo chính sách thông thường, các cuộc trò chuyện mà người dùng xóa sẽ được OpenAI xóa vĩnh viễn trong vòng 30 ngày, nhưng lệnh của tòa buộc công ty tạm thời bảo toàn dữ liệu này để phục vụ quá trình thu thập chứng cứ.
Tháng 12/2025, một thẩm phán liên bang tại quận Manhattan yêu cầu OpenAI giao nộp 20 triệu bản ghi trò chuyện đã được khử nhận dạng để phục vụ quá trình thu thập chứng cứ. OpenAI kháng nghị quyết định này nhưng cuối cùng cho biết phải tuân thủ lệnh của tòa. Công ty cho biết dữ liệu được khử thông tin nhận dạng cá nhân và được lưu trữ riêng trong một hệ thống bảo mật, với quyền truy cập được kiểm soát chặt chẽ.

Ngày 13/3/2026, Encyclopaedia Britannica và công ty con Merriam-Webster kiện OpenAI tại Tòa án quận Nam New York ở Manhattan. Hai công ty cáo buộc OpenAI đã thu thập và sử dụng trái phép gần 100.000 bài viết và mục từ có bản quyền để huấn luyện các mô hình AI.
Theo đơn kiện, Encyclopaedia Britannica cáo buộc OpenAI đã sao chép gần 100.000 bài viết và nội dung tham khảo từ họ và Merriam-Webster mà không được phép để sử dụng trong quá trình phát triển mô hình AI. Hai công ty cũng cho rằng ChatGPT có thể tạo ra câu trả lời sao chép nguyên văn hoặc gần như nguyên văn nội dung của họ.
Theo Encyclopaedia Britannica, điều này có thể khiến họ mất lượng truy cập website, từ đó ảnh hưởng đến doanh thu quảng cáo và thuê bao.
Ngoài ra, Encyclopaedia Britannica cáo buộc ChatGPT đôi khi tạo ra nội dung sai lệch rồi gán những thông tin đó cho họ hoặc Merriam-Webster. Theo nguyên đơn, động thái này không chỉ có thể gây nhầm lẫn cho người dùng mà còn ảnh hưởng đến uy tín của hai thương hiệu. Vì vậy, đơn kiện bao gồm cả cáo buộc vi phạm nhãn hiệu theo Đạo luật Lanham của Mỹ, bên cạnh cáo buộc về bản quyền.
OpenAI bác bỏ các cáo buộc và cho rằng các mô hình AI của công ty được huấn luyện bằng dữ liệu công khai, đồng thời việc sử dụng những dữ liệu này thuộc phạm vi fair use.
Encyclopaedia Britannica cùng Merriam-Webster đề nghị tòa án buộc OpenAI chịu trách nhiệm về những hành vi mà họ cho là vi phạm bản quyền và nhãn hiệu, đồng thời yêu cầu các biện pháp khắc phục và bồi thường theo quy định pháp luật.
Vụ kiện vẫn đang được giải quyết và chưa có phán quyết cuối cùng.