Amazon có thể dùng nội dung Twitch của bạn để huấn luyện AI—trừ khi bạn chọn thoát

15 tháng 8, 2026·6 phút đọc

Twitch vừa cập nhật cài đặt tài khoản cho phép streamer chọn thoát (opt-out) khỏi việc nội dung của họ được dùng để huấn luyện mô hình AI của Amazon. Động thái này vấp phải phản ứng dữ dội từ hơn 16.000 nhà sáng tạo, đặt ra câu hỏi lớn về quyền riêng tư dữ liệu và tính minh bạch trong bối cảnh dữ liệu huấn luyện AI chất lượng cao ngày càng khan hiếm.

Amazon có thể dùng nội dung Twitch của bạn để huấn luyện AI—trừ khi bạn chọn thoát

Amazon có thể dùng nội dung Twitch của bạn để huấn luyện AI—trừ khi bạn chọn thoát

Twitch đã cập nhật cài đặt tài khoản để cho phép các streamer chọn thoát (opt-out) khỏi việc nội dung của họ được sử dụng để huấn luyện các mô hình trí tuệ nhân tạo (AI) của công ty mẹ Amazon. Mặc dù động thái này đã phần nào trấn an một số nhà sáng tạo, nhưng vẫn còn nhiều điều mơ hồ về việc nền tảng phát trực tiếp này đã bắt đầu sử dụng bài đăng, luồng phát và video của người dùng cho mục đích này từ khi nào, làm dấy lên những lo ngại mới về cách các ông lớn công nghệ xử lý dữ liệu người dùng.

Quy trình chọn thoát diễn ra như thế nào?

Quy trình chọn thoát khá đơn giản. Từ trang web hoặc ứng dụng di động Twitch, bạn nhấp vào hình đại diện tài khoản, chọn Cài đặt (Settings), sau đó điều hướng đến phần Bảo mật và Quyền riêng tư (Security and Privacy) trong menu. Tại đó, bạn sẽ thấy tùy chọn Huấn luyện AI tạo sinh (Generative AI Training), nơi bạn có thể tắt việc sử dụng nội dung của mình cho mục đích này.

Trong ngôn ngữ mô tả bên cạnh công tắc, Twitch lưu ý rằng "việc tắt tùy chọn này không ngăn Twitch và Amazon sử dụng nội dung kênh của bạn cho các mục đích khác được mô tả trong Thông báo về quyền riêng tư của Twitch." Các mục đích này bao gồm các tính năng nền tảng hỗ trợ AI được thiết kế để tạo điều kiện cho sự tăng trưởng và kiếm tiền của streamer, chẳng hạn như hỗ trợ chiến dịch tài trợ theo thời gian thực, khám phá người xem thông qua đề xuất, và an toàn cộng đồng nhờ các công cụ như AutoMod.

Phản ứng dữ dội từ cộng đồng sáng tạo

Cài đặt mới này nhằm mục đích ghi nhận quyền của người sáng tạo trong việc quyết định cách nội dung họ tạo ra được sử dụng. Tuy nhiên, sự ra mắt của nó cũng đặt ra câu hỏi về việc Twitch và Amazon đã sử dụng nội dung đó như thế nào cho đến nay.

Trong một diễn đàn chuyên thảo luận về chủ đề này, hơn 16.000 nhà sáng tạo đã bày tỏ sự phản đối việc nội dung của họ bị sử dụng mặc định để huấn luyện các hệ thống AI của Amazon—một thực hành chỉ được phát hiện sau khi cập nhật cài đặt.

Phản ứng dữ dội này xảy ra sau một buổi phát trực tiếp trong đó Mary Kish, người đứng đầu bộ phận cộng đồng của Twitch, giải thích về việc giới thiệu các thay đổi. Điều hành này thừa nhận rằng thay đổi này sẽ gây ra phản ứng tiêu cực. Mike Minton, người đứng đầu bộ phận sản phẩm của Twitch, cũng lưu ý—trong điều mà ông gọi là "một câu trả lời thẳng thắn"—rằng việc giữ tùy chọn sử dụng nội dung để huấn luyện AI được bật mặc định là cần thiết, vì nếu không thì "không ai sẽ tham gia" vào quá trình này.

Minton chỉ ra rằng các cơ chế này không chỉ riêng Twitch và cho rằng có khả năng các công ty phát triển hệ thống AI khác cũng đang trích xuất nội dung từ Twitch và các dịch vụ khác để sử dụng trong việc huấn luyện mô hình của họ. "Tôi không biết chắc chắn," ông nói, "nhưng tôi nghĩ khá hợp lý khi cho rằng hầu như bất kỳ nội dung công khai nào cũng được sử dụng để huấn luyện mô hình theo cách này hay cách khác, có hoặc không có sự cho phép. Vì vậy, tôi nghĩ chúng ta cũng cần thừa nhận rằng có rất nhiều thứ nằm ngoài tầm kiểm soát trực tiếp của chúng ta."

Những câu hỏi chưa có lời giải về nguồn gốc dữ liệu

Những tuyên bố này đặt ra những câu hỏi mới: Nội dung Twitch đã được sử dụng để huấn luyện mô hình AI từ khi nào? Amazon có phải là công ty duy nhất sử dụng dữ liệu này không, hay các đối tác kinh doanh của họ cũng tham gia? Và quan trọng hơn, quyền tác giả của nội dung do người sáng tạo xuất bản được tôn trọng ở mức độ nào?

Điều khoản dịch vụ của Twitch, có hiệu lực từ tháng 3/2024, đã quy định rằng người dùng cấp cho Twitch và các bên được cấp phép quyền sử dụng, sao chép, sửa đổi, điều chỉnh, phân phối và tạo tác phẩm phái sinh từ nội dung của họ. Tuy nhiên, cho đến nay, họ vẫn chưa nêu rõ rằng các tài liệu đó có thể được sử dụng để huấn luyện các mô hình AI tạo sinh.

Vấn đề cốt lõi về dữ liệu huấn luyện

Trường hợp này cho thấy một trong những thách thức lớn nhất mà các nhà phát triển hệ thống AI đang phải đối mặt: tình trạng thiếu hụt ngày càng tăng dữ liệu chất lượng cao cho việc huấn luyện mô hình.

Mặc dù các công ty như OpenAI đã đạt được thỏa thuận với nhiều nhà xuất bản khác nhau để sử dụng một phần nội dung của họ cho mục đích này, các nguồn dữ liệu khả dụng đang ngày càng cạn kiệt khi công nghệ tiến bộ và nhu cầu về dữ liệu tăng lên. Kết quả là, nhiều giải pháp thay thế đã xuất hiện, làm sống lại cuộc tranh luận về đạo đức và tính minh bạch của các quy trình huấn luyện.

Một thời gian gần đây, Meta đã sử dụng bài đăng và hình ảnh mà người dùng chia sẻ trên Facebook và Instagram để huấn luyện mô hình AI của họ. Gần đây, người ta cũng phát hiện ra rằng công ty này đã sử dụng hoạt động của nhân viên và ảnh chụp màn hình do người dùng kính thông minh của họ chụp cho mục đích tương tự. Các trường hợp tương tự cũng được ghi nhận với Google và YouTube.

Vì vậy, dữ liệu huấn luyện chất lượng cao đã trở thành một nguồn tài nguyên chiến lược khác—cùng với chip, bộ nhớ và điện năng—mà các nhà phát triển hàng đầu về mô hình AI nhận thấy đang thiếu hụt khi họ cố gắng duy trì nhịp độ đổi mới mà thị trường yêu cầu. Mọi dấu hiệu đều cho thấy một phần nhu cầu đó sẽ được đáp ứng bằng thông tin do chính người dùng tạo ra, đổi lại quyền truy cập miễn phí vào các dịch vụ kỹ thuật số hàng ngày.

Chia sẻ:FacebookX
Nội dung tổng hợp bằng AI, mang tính tham khảo. Xem bài gốc ↗