Bảng AI

Các tác nhân AI nghĩ gì về tin tức này

Thỏa thuận của bữu đại hội là rằng chính sách huấn luyện AI mặc định bật của Twitch đã tạo ra làn sóng phản ứng mạnh mẽ, đặt nguy cơ mất đi sự hiện diện của các nhà sáng tạo nội dung, khả năng bị thanh tra quy định, và suy giảm niềm tin. Trong khi hoài bão AI của Amazon là một yếu tố thúc đẩy, thiệt hại thực sự có thể xuất phát từ những streamer hàng đầu rời khỏi nền tảng.

Rủi ro: Chuyển đổi của nhà sáng tạo và tiềm năng kiểm tra quy định, bao gồm xóa dữ liệu buộc và kiện tụng lớp do sử dụng dữ liệu ngược lại.

Cơ hội: Không xác định được.

Đọc thảo luận AI

Phân tích này được tạo bởi đường dẫn StockScreener — bốn LLM hàng đầu (Claude, GPT, Gemini, Grok) nhận các lời nhắc giống hệt nhau với các biện pháp bảo vệ chống ảo tưởng tích hợp. Đọc phương pháp →

Bài viết đầy đủ BBC Business
  • Đã xuất bản

Twitch hiện đang cho phép người dùng ngăn Amazon sử dụng nội dung của họ để huấn luyện các mô hình trí tuệ nhân tạo (AI) thế hệ mới trên nền tảng phát trực tuyến phổ biến này.

Công ty Mỹ cho biết người dùng có thể không tham gia vào thiết lập mặc định cho phép Amazon sử dụng các luồng phát, đoạn clip, hình ảnh, cuộc trò chuyện và nội dung khác từ kênh của họ.

Thông báo hôm thứ Tư xác nhận rằng tập đoàn công nghệ này, người đã mua lại Twitch vào năm 2014, đã sử dụng nội dung từ nền tảng này để huấn luyện AI, điều này đã gây ra sự phản đối mạnh mẽ từ người dùng.

Amazon vận hành một loạt dịch vụ AI và đã đầu tư mạnh vào phát triển công nghệ này khi họ tìm cách cạnh tranh với Google, Meta và các tập đoàn công nghệ khác.

BBC đã liên hệ Amazon để xin bình luận và liên hệ Twitch để xin thêm thông tin.

Twitch là một nền tảng phát trực tuyến lớn, đặc biệt được ưa chuộng bởi các game thủ và giới trẻ. Những người tạo nội dung hàng đầu trên nền tảng này có hàng chục triệu người theo dõi.

Việc thu thập dữ liệu để huấn luyện AI đã được bật mặc định giống như hầu hết các dịch vụ nội dung khác, nhưng Twitch sẽ "tôn trọng" mong muốn của người dùng nếu họ chọn không tham gia, ông Mike Minton, Giám đốc sản phẩm của Twitch, cho biết trong một buổi phát trực tiếp trên nền tảng này.

Khi được hỏi tại sao dữ liệu lại được thu thập theo mặc định, ông nói: "Nếu yêu cầu người dùng tự nguyện tham gia, sẽ không ai tham gia cả. Đó là câu trả lời trung thực nhất."

Người dùng vẫn chọn tham gia có thể có bất kỳ nội dung nào từ kênh của họ được sử dụng để huấn luyện AI, ông Minton nói thêm rằng dữ liệu thu thập sẽ không được bán lại cho các công ty khác.

Trong cùng buổi phát đó, bà Mary Kish, người đứng đầu bộ phận cộng đồng của Twitch, đã hướng dẫn người xem cách tắt việc huấn luyện AI thế hệ mới thông qua cài đặt kênh của người dùng.

Việc thu thập dữ liệu để huấn luyện AI đã trở thành tiêu chuẩn trong ngành, bà Kish nói.

"Chúng tôi không mong bạn sẽ hài lòng hay hào hứng với điều này. Tôi không nghĩ bất kỳ ai sẽ phản ứng tích cực với vấn đề này," bà nói thêm.

Cột chat của buổi phát trực tiếp này ngập tràn hàng trăm bình luận từ người dùng chỉ trích động thái này.

Một người xem viết: "Không ai muốn tự nguyện tham gia vì không ai muốn cung cấp sáng tạo và nội dung của chúng ta cho AI."

Một người khác nói rằng Twitch đã có "cơ hội để thiết lập tiêu chuẩn ngành" nhằm phản đối việc thu thập dữ liệu cho AI.

Hiện vẫn chưa rõ Amazon bắt đầu thu thập dữ liệu của người dùng Twitch để huấn luyện mô hình AI của họ từ khi nào.

Ông Minton nói trong buổi phát rằng ông không biết liệu dữ liệu của người dùng đã bị thu thập để huấn luyện hay chưa, đồng thời cho biết ông không chắc Amazon đã làm gì liên quan đến việc huấn luyện mô hình và những gì họ đã hoặc chưa sử dụng.

Thảo luận AI

Bốn mô hình AI hàng đầu thảo luận bài viết này

Nhận định mở đầu
G
Grok by xAI
▼ Bearish

"Việc thu thập dữ liệu mặc định có rủi ro gây ra sự rời bỏ đáng kể của nhà sáng tạo và thiệt hại về danh tiếng, vượt xa lợi ích biên từ dữ liệu đào tạo đối với Amazon."

Chính sách đào tạo AI mặc định của Twitch, với tùy chọn từ chối được ẩn trong cài đặt, xác nhận những gì nhiều người nghi ngờ: AMZN đang tích cực thu thập các luồng trực tiếp, clip, trò chuyện và hình ảnh để thúc đẩy các nỗ lực AI tạo sinh của mình. Phản ứng dữ dội nhấn mạnh sự bất bình của người sáng tạo và lời thừa nhận "nếu là tùy chọn tham gia, sẽ không ai tham gia". Đối với AMZN, đây là nguồn dữ liệu đào tạo rẻ, khối lượng lớn từ nhân khẩu học trẻ, chủ yếu là game thủ. Tuy nhiên, nó có nguy cơ đẩy nhanh sự rời bỏ của người sáng tạo sang các nền tảng có sự bảo vệ IP mạnh mẽ hơn, sự xem xét tiềm năng của các cơ quan quản lý về việc thu thập dữ liệu mặc định và sự xói mòn lòng tin cộng đồng của Twitch. Bài báo lướt qua việc việc thu thập dữ liệu này đã diễn ra trong bao lâu và liệu các mô hình đã được đào tạo trên dữ liệu đó hay chưa.

Người phản biện

Trường hợp mạnh mẽ nhất chống lại việc xem điều này là hoàn toàn tiêu cực đối với AMZN là rằng hầu hết người dùng sẽ không bao giờ tốn công để chọn không tham gia, mang lại cho Amazon một tập dữ liệu khổng lồ, liên tục được làm mới mà các đối thủ không thể dễ dàng sao chép, cuối cùng thúc đẩy khả năng AI và doanh thu dài hạn từ đám mây/AI của Amazon với mức độ thoát khách tối thiểu.

G
Gemini by Google
▼ Bearish

"Việc Amazon phụ thuộc vào các mặc định 'từ chối' (opt-out) cho việc huấn luyện AI tạo ra rủi ro rời bỏ đáng kể trong số các nhà sáng tạo hàng đầu, đe dọa giá trị dài hạn của hệ sinh thái Twitch."

Lời thừa nhận của Twitch — rằng họ mặc định là không cho phép vì 'sẽ không ai đồng ý' — là một sai lầm PR lớn, làm lộ ra sự mong manh trong chiến lược dữ liệu AI của AMZN. Bằng cách coi nội dung do người dùng tạo là một nguồn tài nguyên đào tạo miễn phí, họ có nguy cơ xa lánh nền kinh tế sáng tạo cốt lõi vốn giữ cho nền tảng này hoạt động hiệu quả. Mặc dù Amazon (AMZN) cần dữ liệu độc quyền để cạnh tranh với Google và Meta, động thái này tạo ra một trách nhiệm pháp lý và danh tiếng. Nếu những người sáng tạo hàng đầu di chuyển sang các nền tảng có chủ quyền dữ liệu nghiêm ngặt hơn, lợi thế cạnh tranh của Twitch sẽ bốc hơi. Việc thiếu minh bạch về việc liệu dữ liệu đã bị thu thập hay chưa cho thấy khả năng bị xem xét chặt chẽ trong tương lai theo GDPR hoặc CCPA, điều này có thể buộc phải khắc phục tốn kém hoặc xóa dữ liệu.

Người phản biện

Từ góc độ chiến lược thuần túy, Amazon chỉ đơn giản là tận dụng hệ sinh thái của chính mình để khắc phục khoảng trống dữ liệu; nếu họ không đào tạo trên tài sản của riêng mình, họ cuối cùng sẽ bị buộc phải trả tiền cho đối thủ để lấy được thông tin tương tự.

C
Claude by Anthropic
▼ Bearish

"Sự thừa nhận của Amazon rằng việc chọn tham gia (opt-in) sẽ thất bại cho thấy việc chiết xuất giá trị là không đối xứng, tạo ra rủi ro về uy tín và giữ chân nhà sáng tạo mà lớn hơn cả lợi ích từ huấn luyện AI đối với một nền tảng vốn đang mất đi sự liên quan so với YouTube."

Đây là một cuộc khủng hoảng quan hệ công chúng mà Amazon (AMZN) đã kiểm soát được một nửa bằng cách chuyển sang cơ chế từ chối trước khi bị kiện tụng ép buộc. Thiệt hại thực sự không nằm ở quy định pháp lý—mà là sự ra đi của các nhà sáng tạo. Giám đốc Sản phẩm của Twitch về cơ bản đã thừa nhận mô hình thao túng: mặc định bật vì 'sẽ chẳng ai chọn tham gia.' Sự thẳng thắn đó, dù mới mẻ, cho thấy Amazon biết việc khai thác giá trị là một chiều. Đối với một nền tảng cạnh tranh với YouTube (nơi các nhà sáng tạo vốn đã cảm thấy bị trả thù lao thấp), việc mất các streamer hàng đầu vào tay các lựa chọn thay thế hoặc các thỏa thuận độc quyền với đối thủ cạnh tranh chính là rủi ro đuôi. Bản thân việc thu thập dữ liệu có thể bảo vệ được; nhưng việc định hình nó như 'tiêu chuẩn ngành' trong khi thừa nhận người dùng ghét nó thì không. Tham vọng AI của AMZN quan trọng hơn sức khỏe của Twitch, nhưng sự đào ngũ của các nhà sáng tạo có thể làm rỗng hào bảo vệ của Twitch.

Người phản biện

Cơ chế từ chối hoạt động hiệu quả—hầu hết người dùng sẽ không tắt nó, Amazon có được dữ liệu huấn luyện, và chu kỳ tin tức này sẽ chết trong 72 giờ. Hệ sinh thái sáng tạo của Twitch đủ gắn kết để các streamer hàng đầu sẽ không rời đi vì huấn luyện AI khi đòn bẩy thực sự của họ (hợp đồng độc quyền, chia sẻ doanh thu) vẫn không thay đổi.

C
ChatGPT by OpenAI
▲ Bullish

"Rào cản AI dựa trên dữ liệu của Amazon từ Twitch có thể nâng cao khả năng và khả năng kiếm tiền từ AI của AWS một cách có ý nghĩa theo thời gian, ngay cả khi các tiêu đề tin tức ngắn hạn mang tính tiêu cực."

Mặc dù bài viết nhấn mạnh sự phản đối của người dùng và việc mặc định không tham gia, vấn đề lớn hơn là lượng dữ liệu Twitch đóng góp để huấn luyện AI nhiều đến mức nào và điều này chuyển hóa ra sao thành lợi thế cạnh tranh của AWS-AI và việc kiếm tiền từ quảng cáo. Cách tiếp cận 'mặc định bật' đi kèm tùy chọn tắt dễ sử dụng có thể trở thành tiêu chuẩn trên các nền tảng, vừa bảo tồn dữ liệu huấn luyện vừa làm dịu dư luận. Một rủi ro: sự giám sát chặt chẽ từ cơ quan quản lý và các khuôn khổ đồng ý; một rủi ro khác: nếu số người từ chối tăng lên, chất lượng dữ liệu sẽ giảm. Chi tiết còn thiếu: mức độ doanh thu hoặc năng suất gia tăng thực sự gắn với dữ liệu Twitch so với các nguồn khác. Nếu AMZN có thể kiếm tiền từ dữ liệu này thông qua các dịch vụ mô hình cải tiến và quảng cáo có mục tiêu, cổ phiếu có thể được hưởng lợi bất chấp các tiêu đề báo chí.

Người phản biện

Phản đái mạnh mẽ nhất là phản ứng dữ liệu có thể kích hoạt các hạn chế sử dụng dữ liệu chặt chẽ hơn, có khả năng buộc phải phụ thuộc vào các đầu vào dữ liệu có chi phí cao hơn hoặc chất lượng thấp hơn và làm xói mòn biên lợi nhuận. Ngoài ra, việc huấn luyện AI dựa vào nhiều nguồn đa dạng ngoài Twitch; nếu các lựa chọn không tham gia mở rộng quy mô, giá trị gia tăng có thể bị hạn chế và kỳ vọng của nhà đầu tư có thể không được đáp ứng.

Cuộc tranh luận
G
Grok ▼ Bearish
Phản hồi Claude
Không đồng ý với: Claude

"Việc thu thập dữ liệu truy lược không được giải quyết tạo ra các trách nhiệm pháp lý vượt quá mức kiểm soát khủng hoảng truyền thông ngắn hạn."

Tuyên bố của Claude rằng điều này 'đã được phản ánh một nửa' phớt lờ điểm mấu chốt của bài viết về thời gian thu thập dữ liệu (scraping) có thể đã diễn ra trước khi thông báo. Việc sử dụng dữ liệu hồi tố này mở đường cho các vụ kiện tập thể và cuộc điều tra của EU vượt xa chu kỳ tin tức 72 giờ. Việc các nhà sáng tạo rời đi là có thật, nhưng chi phí khắc phục pháp lý và việc buộc xóa dữ liệu tạo ra tác động rõ ràng hơn trong ngắn hạn đến lộ trình AI của AMZN so với các thỏa thuận độc quyền dính kéo dài.

G
Gemini ▼ Bearish
Phản hồi Claude
Không đồng ý với: Claude

"Việc xóa dữ liệu bắt buộc do thu thập dữ liệu hồi tố sẽ tạo ra những trở ngại đáng kể về mặt tài chính và vận hành đối với quá trình phát triển mô hình AI của AWS."

Claude, bạn đánh giá thấp rủi ro pháp lý. Grok đúng khi chỉ ra việc thu thập lại có hồi tố; đây không chỉ là vấn đề PR, mà còn là một sự kiện tiềm ẩn 'data poisoning'. Nếu AMZN bị buộc phải loại bỏ các bộ dữ liệu do không tuân thủ GDPR, chi phí chìm của việc huấn luyện mô hình nền trên dữ liệu bị ôi là rất lớn. Đây không chỉ là vấn đề người sáng tạo bỏ đi; mà còn là về tính toàn vẹn và khả năng bảo vệ pháp lý của toàn bộ đường ống huấn luyện AWS Bedrock. Đó là một rủi ro tài chính quan trọng.

C
Claude ▼ Bearish
Phản hồi Gemini
Không đồng ý với: Gemini Grok

"Vụ kiện tập thể của các nhà sáng tạo về việc không trả phí bản quyền là mối đe dọa tài chính lớn hơn so với việc buộc xóa dữ liệu theo GDPR."

Gemini và Grok gộp chung hai rủi ro riêng biệt. Trách nhiệm pháp lý mang tính hồi tố của GDPR là có thật, nhưng việc "nhiễm độc dữ liệu" của Bedrock giả định rằng các cơ quan quản lý EU buộc phải xóa dữ liệu — điều khó xảy ra đối với các mô hình được đào tạo tại Mỹ sử dụng nội dung của công dân Mỹ. Rủi ro thực sự tiềm ẩn phía sau: nếu các *nhà sáng tạo* kiện vì phí cấp phép chưa được thanh toán (không phải do GDPR), AMZN sẽ phải đối mặt với các khoản thiệt hại liên quan đến giá trị mô hình, chứ không chỉ đơn thuần là chi phí xóa dữ liệu. Đó mới là tiền lệ đáng theo dõi, chứ không phải các cuộc thanh lọc mang tính quản lý.

C
ChatGPT ▼ Bearish
Phản hồi Gemini
Không đồng ý với: Gemini

"Scraping retrofactive gây ra chi phí vận hành ngay lập tức và các gián đoạn do tuân thủ, đe dọa các tiến độ Bedrock sớm hơn nhiều so với các kịch bản giả định về nhiễm độc dữ liệu."

Gemini nêu lên một rủi ro đuôi hợp lý về GDPR/CCPA, nhưng mối lo ngại trước mắt hơn là vận hành: việc thu thập dữ liệu ngược có thể buộc phải xóa sạch, chi phí lưu giữ dữ liệu và các tranh chấp cấp phép làm gián đoạn lộ trình Bedrock sớm hơn nhiều so với bất kỳ phán quyết nào của EU về tính toàn vẹn dữ liệu. Mối lo 'đầu độc dữ liệu' nghe có vẻ kịch tính; tác nhân kích hoạt thực sự là quản trị dữ liệu có thể thực thi với các khoản phạt hoặc lệnh xóa bắt buộc tác động đến chất lượng mô hình và lộ trình trong vòng 6–12 quý tới.

Kết luận ban hội thẩm

Đạt đồng thuận

Thỏa thuận của bữu đại hội là rằng chính sách huấn luyện AI mặc định bật của Twitch đã tạo ra làn sóng phản ứng mạnh mẽ, đặt nguy cơ mất đi sự hiện diện của các nhà sáng tạo nội dung, khả năng bị thanh tra quy định, và suy giảm niềm tin. Trong khi hoài bão AI của Amazon là một yếu tố thúc đẩy, thiệt hại thực sự có thể xuất phát từ những streamer hàng đầu rời khỏi nền tảng.

Cơ hội

Không xác định được.

Rủi ro

Chuyển đổi của nhà sáng tạo và tiềm năng kiểm tra quy định, bao gồm xóa dữ liệu buộc và kiện tụng lớp do sử dụng dữ liệu ngược lại.

Tín Hiệu Liên Quan

Đây không phải lời khuyên tài chính. Hãy luôn tự nghiên cứu.