Email nội bộ Microsoft – OpenAI: Nỗi lo "vòng xoáy hủy diệt" đang giết chết ngành báo chí
Tài liệu nội bộ vừa được công khai trong vụ kiện bản quyền cho thấy chính các lãnh đạo Microsoft và OpenAI từng thừa nhận việc thu thập dữ liệu tin tức để huấn luyện AI là hành vi "đánh cắp sức lao động lớn nhất trong lịch sử loài người".
Các tài liệu nội bộ của Microsoft và OpenAI vừa được công bố trong một vụ kiện bản quyền đã phơi bày góc nhìn thật của chính những người trong cuộc về cách họ đối xử với dữ liệu báo chí trước khi tung ra ChatGPT và Copilot.
Lời thừa nhận gây sốc từ chính nội bộ Microsoft
Theo hồ sơ tóm tắt phán quyết vừa được giải mật, Brent Hecht – Giám đốc Khoa học Ứng dụng của Microsoft – đã nhiều lần cảnh báo trong các tài liệu rằng việc thu thập tin tức để huấn luyện AI là "một vụ đánh cắp kinh hoàng với quy mô chưa từng có", và có thể được coi là "vụ đánh cắp sức lao động lớn nhất trong lịch sử loài người".
Điều đáng chú ý là những cảnh báo này đến từ chính người trong cuộc, chứ không phải từ các bên nguyên đơn đang kiện Microsoft và OpenAI.
Trong một tài liệu khác, Hecht còn trực tiếp phản bác lập luận của Microsoft và OpenAI rằng việc huấn luyện AI trên nội dung tin tức là sử dụng hợp lý (fair use). Ông cho rằng kế hoạch thu thập dữ liệu tin tức trên quy mô lớn đã tạo ra "một sự nhạo báng hoàn toàn đối với khái niệm 'sử dụng hợp lý'".
Cuộc chiến pháp lý với các cơ quan báo chí
Vụ kiện do The New York Times dẫn đầu cùng nhiều tổ chức báo chí khác cáo buộc Microsoft và OpenAI đã thông đồng với nhau để vi phạm luật bản quyền bằng cách lấy số lượng lớn nội dung tin tức nhằm huấn luyện các mô hình AI của mình.
Đáng chú ý, trong nhiều năm qua cả hai công ty đã nỗ lực giữ kín những thông tin này khỏi công chúng. Tuy nhiên, đến nay những chi tiết lẽ ra không bao giờ được đánh dấu là "bảo mật" đang dần bị rò rỉ qua các thủ tục tố tụng.
Mối lo về "vòng xoáy hủy diệt" đối với ngành tin tức
Nội dung các email còn cho thấy nỗi lo ngại sâu sắc của cả Microsoft lẫn OpenAI về một "vòng xoáy hủy diệt" (doom loop): các mô hình AI tóm tắt và tái sử dụng nội dung tin tức mà không trả tiền cho các cơ quan báo chí, khiến doanh thu của họ sụt giảm, buộc họ phải cắt giảm nhân sự và sản xuất ít nội dung hơn – từ đó bào mòn chính nguồn dữ liệu mà AI cần để tồn tại và phát triển.
Hệ quả đối với Việt Nam
Câu chuyện này không chỉ là vấn đề của báo chí Mỹ. Tại Việt Nam, các cơ quan báo chí cũng đang đối mặt với áp lực tương tự khi ChatGPT, Gemini, Copilot và nhiều chatbot AI khác ngày càng trở thành kênh tìm kiếm thông tin phổ biến, làm giảm lưu lượng truy cập trực tiếp vào các trang tin.
- Các tòa soạn Việt Nam cần sớm xem xét cơ chế cấp phép nội dung cho các nền tảng AI
- Cơ quan quản lý cần bổ sung khung pháp lý rõ ràng về quyền của tác giả đối với dữ liệu huấn luyện AI
- Độc giả nên nhận thức rõ rằng nội dung chất lượng chỉ có thể tồn tại nếu được trả tiền một cách công bằng
Việc những người đứng sau các sản phẩm AI hàng đầu thế giới từng thừa nhận hành vi thu thập dữ liệu của mình là "đánh cắp" cho thấy lập luận pháp lý của họ có thể sẽ gặp nhiều khó khăn trong các phiên tòa sắp tới.
Bài viết liên quan

Công nghệ
Nộp đơn xin việc lẽ ra nên khó hơn. Thật đấy
25 tháng 8, 2026

Công nghệ
Mô hình AI hàng đầu giỏi Vật lý đến đâu? Nghiên cứu mới chỉ ra các bài kiểm tra hiện hành đang đánh giá sai
16 tháng 9, 2026

Công nghệ
Mỹ kiểm soát Venezuela nhưng vẫn phải dùng công nghệ giám sát AI của Trung Quốc
18 tháng 9, 2026