Hội đồng nhìn chung đồng ý rằng vụ kiện này báo hiệu sự thay đổi trong cách tiếp cận của các nhà xuất bản âm nhạc đối với dữ liệu đào tạo AI, có khả năng làm tăng chi phí cấp phép và sự không chắc chắn về mặt pháp lý đối với các nhà phát triển AI. Rủi ro chính là 'thuế cấp phép' đối với R&D trong tương lai, điều này có thể làm giảm biên lợi nhuận cho các công ty AI.
Rủi ro: 'Thuế cấp phép' đối với hoạt động R&D trong tương lai, điều này có thể làm giảm biên lợi nhuận cho các công ty AI.
Phân tích này được tạo bởi đường dẫn StockScreener — bốn LLM hàng đầu (Claude, GPT, Gemini, Grok) nhận các lời nhắc giống hệt nhau với các biện pháp bảo vệ chống ảo tưởng tích hợp. Đọc phương pháp →
Sony Music Publishing và Warner Chappell Music đã nộp đơn kiện Anthropic tại tòa án liên bang California vào thứ Sáu tuần trước, cáo buộc rằng công ty AI này đã vi phạm bản quyền các bài hát để huấn luyện các mô hình Claude của mình. Các đồng sáng lập Anthropic là Dario Amodei và Benjamin Mann bị nêu …
Đọc thêm
Sony Music Publishing và Warner Chappell Music đã nộp đơn kiện Anthropic tại tòa án liên bang California vào thứ Sáu tuần trước, cáo buộc rằng công ty AI này đã vi phạm bản quyền các bài hát để huấn luyện các mô hình Claude của mình. Các đồng sáng lập Anthropic là Dario Amodei và Benjamin Mann bị nêu tên là bị đơn cùng với công ty.
Theo Axios, đơn khiếu nại cáo buộc rằng Anthropic đã huấn luyện các mô hình của mình trên "hàng chục nghìn" tác phẩm có bản quyền của các nhà xuất bản mà không xin phép. Đơn khiếu nại dài 48 trang mô tả hành vi này là "một trong những vụ trộm cắp tài sản trí tuệ lớn nhất và trắng trợn nhất đang diễn ra trong lịch sử." Các bài hát được trích dẫn trong vụ kiện bao gồm "All I Want for Christmas is You" của Mariah Carey, "Paper Rings" của Taylor Swift, "Ain't No Mountain High Enough" của Marvin Gaye, và bản rock anthem những năm 1980 "Eye of the Tiger."
Đơn khiếu nại buộc tội Anthropic đã có được các tác phẩm có bản quyền thông qua các kho lưu trữ vi phạm kỹ thuật số, bao gồm Library Genesis và Pirate Library Mirror. Trong số tài liệu bị cáo buộc là đã tải xuống từ các trang đó có các cuốn sách chứa lời bài hát và bản nhạc cho các bài hát như "Livin' On a Prayer," "Hallelujah," và "Great Balls of Fire." Các nhà xuất bản lập luận rằng việc huấn luyện Claude trên các tác phẩm này cho phép nó tái tạo lại các bản sao gần như y hệt của các tác phẩm và tạo ra lời bài hát AI cạnh tranh với các bài hát do con người sáng tác.
Sony Music Publishing và Warner Chappell đang yêu cầu xét xử bởi bồi thẩm đoàn và thiệt hại theo luật định lên tới $150,000 cho mỗi tác phẩm bị vi phạm. Như Axios lưu ý, thiệt hại theo luật định đặc biệt hiệu quả ở đây vì các nguyên đơn theo đuổi các bản ghi âm thương mại có bản quyền riêng lẻ không cần chứng minh thiệt hại tài chính thực tế để được bồi thường.
Anthropic đã bác bỏ các cáo buộc. "Chúng tôi không đồng tình với các khiếu nại của các nhà xuất bản và chúng tôi có ý định bảo vệ mình một cách mạnh mẽ tại tòa án," công ty nói trong một tuyên bố.
Đây không phải là tranh chấp bản quyền đầu tiên của Anthropic. Vào tháng 9 năm 2025, Anthropic đã giải quyết một vụ kiện tập thể do các tác giả đệ đơn về dữ liệu huấn luyện bị vi phạm, đồng ý trả $1.5 billion sau khi một phán quyết tư pháp cho rằng mặc dù việc đưa các tác phẩm có bản quyền vào huấn luyện AI không vi phạm luật, nhưng việc có được các tác phẩm đó thông qua vi phạm bản quyền thì có. Một vụ kiện riêng biệt từ BMG chống lại Anthropic cáo buộc vi phạm 493 tác phẩm.
Theo TechCrunch, đơn khiếu nại của Sony và Warner Chappell có phạm vi rộng hơn các vụ trước đó và dựa trực tiếp vào bằng chứng và lập luận được phát triển trong vụ kiện trước đó.
Thảo luận AI
Bốn mô hình AI hàng đầu thảo luận bài viết này
Nhận định mở đầu
“Vụ việc có thể đẩy nhanh chi phí cấp phép và sự e dè trong việc thu thập dữ liệu trên toàn lĩnh vực AI, ảnh hưởng đến biên lợi nhuận nhiều hơn bất kỳ khoản bồi thường thiệt hại đơn lẻ nào.”
Vụ kiện này cho thấy các nhà xuất bản âm nhạc đang siết chặt kiểm soát dữ liệu đào tạo AI và có thể làm tăng chi phí cấp phép cho "AI stack". Nếu được chứng minh ở quy mô lớn, thiệt hại theo luật định lên tới 150.000 đô la cho mỗi tác phẩm vi phạm có thể trở nên đáng kể, với hàng chục nghìn bài hát được tham chiếu. Nhưng yếu tố then chốt thực sự là liệu việc đào tạo của Claude có được coi là sao chép hay được bảo vệ bởi "fair use" (sử dụng hợp lý), và liệu bất kỳ kết quả đầu ra nào có vi phạm bản quyền hay không. Thỏa thuận năm 2025 cho thấy vấn đề vi phạm bản quyền, chứ không đơn thuần là sử dụng các tác phẩm có bản quyền. Thiếu ngữ cảnh: nguồn dữ liệu chính xác, tỷ lệ bị vi phạm bản quyền là bao nhiêu và tòa án đánh giá việc đào tạo không tiêu thụ so với sao chép như thế nào.
Bộ đếm: Tòa án có thể xem việc đào tạo là biến đổi và giới hạn trách nhiệm chỉ đến chi phí có thể cấp phép, không phải thiệt hại cho từng bài hát. Một chế độ trách nhiệm rộng hơn cũng có thể yêu cầu chứng minh thiệt hại thực sự trên thị trường, điều này khó chứng minh cho các thành phần nội bộ của mô hình hơn là kết quả đầu ra.
“Sự tập trung pháp lý vào nguồn gốc của dữ liệu đào tạo đã biến việc phát triển mô hình AI từ một thách thức về mở rộng quy mô tính toán thành một cuộc khủng hoảng quản lý rủi ro trách nhiệm pháp lý cao.”
Vụ kiện pháp lý này đánh dấu một bước chuyển quan trọng từ các cuộc tranh luận về 'sử dụng hợp lý' sang một cái bẫy trách nhiệm pháp lý về 'nguồn dữ liệu'. Bằng cách liên kết Anthropic với các kho lưu trữ bị vi phạm bản quyền như Library Genesis, các nhà xuất bản đang bỏ qua các biện pháp pháp lý mờ ám hơn của việc đào tạo AI và tấn công vào chuỗi cung ứng. Nếu Anthropic buộc phải loại bỏ các trọng số dữ liệu vi phạm của mình, hiệu suất của mô hình có thể suy giảm đáng kể, tạo ra một kịch bản 'tài sản bị đầu độc'. Đối với lĩnh vực AI rộng lớn hơn, điều này thiết lập một tiền lệ, trong đó nguồn gốc của dữ liệu đào tạo quan trọng như chính sức mạnh tính toán. Dự kiến chi phí R&D sẽ tăng lên đáng kể khi các công ty chuyển sang các bộ dữ liệu được cấp phép, 'sạch', làm giảm biên lợi nhuận cho các nhà cung cấp LLM thuần túy.
Các nhà xuất bản có thể đang quá tự tin; nếu tòa án phán quyết rằng đầu ra, thay vì quy trình đào tạo, là thước đo chính cho hành vi vi phạm, Anthropic có thể thoát khỏi với những thay đổi cấu trúc nhỏ thay vì phải xóa bỏ mô hình một cách thảm khốc.
“Việc tăng cường rủi ro pháp lý từ các nhà xuất bản âm nhạc sẽ làm tăng yêu cầu về vốn và làm chậm quá trình đào tạo trái phép cho các mô hình tiên phong.”
Vụ kiện làm gia tăng rủi ro sở hữu trí tuệ cho các nhà phát triển AI bằng cách nhắm mục tiêu không chỉ việc thu thập dữ liệu mà còn cả các kết quả đầu ra của mô hình hạ nguồn, những kết quả mà bị cáo buộc tái tạo lời bài hát. Với thiệt hại theo luật định lên tới 150.000 đô la cho mỗi tác phẩm và các tiền lệ từ thỏa thuận dàn xếp 1,5 tỷ đô la của tác giả, chi phí đào tạo có thể tăng mạnh nếu tòa án coi lời bài hát có nguồn gốc từ hành vi vi phạm bản quyền là không mang tính chuyển đổi. Các nhà xuất bản âm nhạc giành được đòn bẩy để yêu cầu các luồng doanh thu cấp phép, trong khi Anthropic đối mặt với việc khám phá có thể tiết lộ quy mô vi phạm. Tác động rộng hơn đến ngành bao gồm việc trì hoãn phát hành và chi tiêu tuân thủ cao hơn, đặc biệt đối với các phương pháp đào tạo mở. Bối cảnh còn thiếu là liệu Anthropic có các lập luận sử dụng hợp lý khả thi sau khi phát hiện hành vi vi phạm bản quyền hay có thể chuyển sang các bộ dữ liệu được cấp phép mà không làm giảm hiệu suất hay không.
Bài báo hạ thấp phán quyết tháng 9 năm 2025 rằng việc đào tạo trên các tác phẩm có bản quyền tự nó không phải là vi phạm; nếu Anthropic chứng minh các kết quả là có tính chuyển đổi hoặc việc sử dụng là không đáng kể, thiệt hại có thể thấp hơn nhiều so với con số 150.000 đô la được nêu bật.
“Sony/Warner có cơ sở pháp lý vững chắc hơn so với những người tiền nhiệm do tiền lệ về vi phạm bản quyền, nhưng rủi ro thiệt hại được giới hạn bởi mức chuẩn đã được giải quyết trước đó là 1,5 tỷ USD và các biện pháp bảo vệ sử dụng hợp lý vẫn còn hiệu lực.”
Vụ kiện này khác biệt đáng kể so với thỏa thuận tháng 9 năm 2025. Vụ kiện đó đã thiết lập một nguyên tắc pháp lý (việc sao chép ≠ vi phạm bản quyền đào tạo, nhưng *việc có được thông qua sao chép* thì vi phạm pháp luật). Sony/Warner giờ đây có tiền lệ tư pháp và một quy trình thực hiện. Thiệt hại theo luật định là 150.000 đô la cho mỗi tác phẩm sáng tác trên 'hàng chục nghìn' có thể vượt quá 1,5 tỷ đô la tổng mức độ rủi ro. Tuy nhiên, bài báo đã nhầm lẫn hai vấn đề riêng biệt: liệu Claude có thể tái tạo lời bài hát hay không (có khả năng đúng) so với việc nó có được đào tạo trên bản nhạc bị sao chép hay không (khó chứng minh trên quy mô lớn). Lập luận bào chữa của Anthropic sẽ dựa vào việc sử dụng hợp lý và liệu việc tái tạo lời bài hát từ dữ liệu đào tạo có cấu thành hành vi xâm phạm hay chỉ đơn thuần là nhận dạng mẫu. Thỏa thuận 1,5 tỷ đô la với các tác giả có thể neo kỳ vọng về thiệt hại xuống thấp hơn.
Tiền lệ tháng 9 có thể thực sự *hạn chế* đòn bẩy của Sony/Warner: nếu tòa án đã xác định rằng việc đào tạo trên các tác phẩm có bản quyền không phải là bất hợp pháp, các nhà xuất bản phải chứng minh Anthropic đã lấy *các tác phẩm soạn nhạc cụ thể này* thông qua hành vi vi phạm bản quyền và rằng đầu ra của Claude cạnh tranh đáng kể với các tác phẩm gốc — một yêu cầu hẹp hơn nhiều so với 'chúng tôi đã đào tạo dựa trên các bài hát của mình'.
Cuộc tranh luận
Phản hồi Gemini
“Rủi ro thực sự là sự không chắc chắn về pháp lý và chi phí cấp phép, chứ không phải là việc loại bỏ hàng loạt các mô hình khỏi dữ liệu bị đánh cắp một cách không thể tránh khỏi.”
Gemini phóng đại rủi ro "tài sản độc hại". Ngay cả khi phát hiện dữ liệu bị đánh cắp, việc đào tạo lại bằng dữ liệu được cấp phép/sạch có thể duy trì hiệu suất thay vì xóa bỏ hoàn toàn. Rủi ro lớn hơn, ít được thảo luận hơn là sự không chắc chắn về pháp lý và chi phí cấp phép: các yêu cầu về nguồn gốc, thiệt hại trên mỗi bài hát và các lệnh cấm có thể buộc phải tìm nguồn cung ứng dữ liệu tốn kém, tùy chỉnh và làm chậm quá trình lặp lại, nhiều hơn là sự sụp đổ hoàn toàn của mô hình. Sự thay đổi đó cho thấy con đường ưu tiên cấp phép có thể đã được tính vào biên lợi nhuận.
Phản hồi Gemini
“Mối đe dọa kinh tế là một loại thuế cấp phép vĩnh viễn đối với dữ liệu đào tạo, chứ không phải sự hủy diệt kỹ thuật thảm khốc đối với trọng số mô hình.”
Lý thuyết 'tài sản độc hại' của Gemini bỏ qua thực tế kỹ thuật về trọng số. Ngay cả khi tòa án yêu cầu loại bỏ, Anthropic có thể sử dụng 'học máy không học' hoặc đào tạo lại có mục tiêu thay vì sụp đổ toàn bộ mô hình. Rủi ro thực sự không phải là suy thoái kỹ thuật, mà là 'thuế cấp phép' đối với R&D trong tương lai. Nếu các nhà xuất bản buộc mô hình bản quyền định kỳ đối với dữ liệu đào tạo nền tảng, các bội số định giá phần mềm dưới dạng dịch vụ (SaaS) có biên lợi nhuận cao hiện tại cho các công ty AI sẽ đối mặt với sự nén đáng kể.
Phản hồi ChatGPT
“Các quy tắc về nguồn gốc sẽ phân tách AI mở và AI đóng nhiều hơn so với chi phí cấp phép đồng nhất.”
ChatGPT đã giảm nhẹ rủi ro xóa bỏ hoàn toàn mô hình một cách chính đáng nhưng lại đánh giá thấp cách các quy tắc về nguồn gốc có thể phân chia ngành: các phòng thí nghiệm đóng sẽ đàm phán các giấy phép số lượng lớn trong khi các nỗ lực mã nguồn mở bị đình trệ do chi phí xác minh. Thuế cấp phép của Gemini sau đó sẽ cộng dồn không đồng đều, ảnh hưởng nặng nề nhất đến việc đào tạo phân tán. Động lực này ưu ái các công ty hiện tại có đội ngũ pháp lý hơn là sự khác biệt thuần túy về công nghệ, một sự chia rẽ mà cả hai đều không giải quyết mặc dù có tiền lệ tháng 9 hạn chế các yêu cầu đào tạo.
Phản hồi Grok
“Phán quyết tháng 9 thu hẹp phạm vi tấn công của Sony/Warner vào hành vi vi phạm ở cấp độ đầu ra và nguồn cung cấp cụ thể cho hành vi vi phạm bản quyền, chứ không phải bản thân việc đào tạo — làm cho việc cấp phép có chọn lọc rẻ hơn so với luận điểm phân chia ngụ ý.”
Grok gắn cờ rủi ro phân nhánh—mô hình đóng vs. mã nguồn mở—nhưng bỏ lỡ cơ hội chênh lệch giá ngay lập tức: Anthropic có thể cấp phép chọn lọc cho các đầu ra rủi ro cao (lời bài hát, bản nhạc) trong khi dựa vào biện pháp bảo vệ sử dụng hợp lý cho việc huấn luyện nội bộ. Tiền lệ tháng Chín thực tế *bảo vệ* việc huấn luyện; Sony/Warner phải chứng minh vi phạm bản quyền *và* thiệt hại thị trường. Đó là một tiêu chuẩn cao hơn so với những gì hội đồng giả định. Chi phí cấp phép tăng lên, nhưng không đồng đều.
Kết luận ban hội thẩm
BEARISH Đạt đồng thuậnHội đồng nhìn chung đồng ý rằng vụ kiện này báo hiệu sự thay đổi trong cách tiếp cận của các nhà xuất bản âm nhạc đối với dữ liệu đào tạo AI, có khả năng làm tăng chi phí cấp phép và sự không chắc chắn về mặt pháp lý đối với các nhà phát triển AI. Rủi ro chính là 'thuế cấp phép' đối với R&D trong tương lai, điều này có thể làm giảm biên lợi nhuận cho các công ty AI.
'Thuế cấp phép' đối với hoạt động R&D trong tương lai, điều này có thể làm giảm biên lợi nhuận cho các công ty AI.
Tin Tức Liên Quan
Người đàn ông Mỹ nhận tội vì tội lừa đảo chiếm đoạt hàng triệu từ người nghe nhạc trực tuyến bằng AI.
Luke Littler nộp đơn đăng ký nhãn hiệu khuôn mặt để chống lại AI giả mạo
BMG kiện Anthropic vì sử dụng lời bài hát của Bruno Mars, Rolling Stones trong quá trình đào tạo AI
Đây không phải lời khuyên tài chính. Hãy luôn tự nghiên cứu.