AI và sự tàn phá của Creative Commons
Các mô hình ngôn ngữ lớn đang nuốt chửng mọi nội dung trực tuyến mà không quan tâm đến bản quyền hay giấy phép, phá vỡ khế ước xã hội đã duy trì sự cởi mở của Internet suốt 40 năm qua. Tác giả Chester Wisniewski cảnh báo rằng việc chia sẻ kiến thức đang bị biến từ món quà cho thế giới thành gánh nặng pháp lý, đẩy chúng ta vào một kỷ nguyên đen tối của số hóa.
AI và sự tàn phá của Creative Commons
Trong suốt bốn thập kỷ, cộng đồng công nghệ đã xây dựng được một thế cân bằng mong manh giữa bảo hộ bản quyền phần mềm và tinh thần cởi mở. Giờ đây, các mô hình ngôn ngữ lớn (LLM) đang cuốn phăng tất cả. Bài viết của Chester Wisniewski đặt ra một câu hỏi nhức nhối: liệu chúng ta có đang tự tay phá hủy nền tảng của chính mình?
Từ thời kỳ hoàng kim của sự cởi mở
Wisniewski hồi tưởng về thời niên thiếu, khi ông gõ từng dòng BASIC từ các tạp chí vào chiếc Commodore 64, rồi tự học REXX để viết game cho hệ thống BBS do mình điều hành. Chính những ví dụ "mở" ấy đã trao cho ông — và hàng triệu người khác — cơ hội học những nguyên lý lập trình đầu tiên.
Đó là kỷ nguyên mà câu hỏi liệu phần mềm có thể được bảo hộ bản quyền hay không vẫn còn đang tranh cãi. Shareware và freeware xuất hiện, rồi đến phong trào copyleft với các giấy phép như GPL, MPL, CC-SA — buộc bất kỳ tác phẩm phái sinh nào cũng phải kế thừa quyền tự do của bản gốc.
Internet hiện đại và điện toán đám mây không thể tồn tại nếu thiếu phần mềm tự do và mã nguồn mở. Mọi dịch vụ đám mây, mọi trục xương sống của Internet đều là tác phẩm phái sinh đứng trên vai những người khổng lồ thế hệ trước.
Nếu không có sự cởi mở ấy, trực tuyến ngày nay có lẽ chỉ giống AOL và CompuServe, đắt đỏ gấp hàng trăm lần và mang tính đầu sỏ còn cao hơn nhiều.
Khế ước xã hội đã bị phá vỡ
Wisniewski cho rằng người ta bàn rất nhiều về tác động môi trường, rủi ro an ninh mạng và thông tin sai lệch của AI tạo sinh, nhưng gần như bỏ qua sự tàn phá nền tảng cởi mở.
LLM đang tiêu thụ mọi thứ chúng tìm thấy trên mạng, không màng bản quyền hay giấy phép. Các tác phẩm phái sinh có thể phản ánh hoặc không phản ánh giấy phép của người sáng tạo gốc, và đến nay dường như không có ý chí thực thi pháp lý nào cho những nghĩa vụ này.
Kết quả là tác giả đối mặt với hàng loạt hệ quả:
- Không còn động lực chia sẻ: công khai mã nguồn đồng nghĩa với việc AI dễ dàng tìm ra lỗ hổng để lợi dụng sai sót của mình; giữ kín thì những sai sót ấy khó bị phát hiện hơn.
- Pull request rác: đăng code lên GitHub đồng nghĩa với việc bị nhấn chìm trong làn PR do bot AI và người dùng thiếu kinh nghiệm tạo ra, ngốn hết thời gian quý báu chỉ để phân loại.
- Nội dung bị đầu độc: thứ ta tìm thấy trực tuyến có thể là code rác, thư viện độc hại, hoặc tác phẩm bị đánh cắp — khiến người dùng vô tình liên đới trách nhiệm.
Các giấy phép và thỏa thuận hiện hành tuy chưa hoàn hảo nhưng đã được chứng minh có thể thực thi trước tòa, trao cho người sáng tạo quyền kiểm soát tác phẩm của mình. AI đã tước đi quyền lực ấy.
Kỷ nguyên đen tối của số hóa
Wisniewski không giấu giếm sự bi quan. Ông mô tả việc chia sẻ kiến thức — từng là món quà dành cho thế giới — đang bị bóp méo thành gánh nặng pháp lý cho tác giả. Hành động cởi mở bị lợi dụng để củng cố thêm quyền lực và sự giàu có của một số ít, mà không hề tôn trọng hay ghi công những người lao động thực sự.
AI đã biến việc chia sẻ kiến thức từ một món quà cho thế giới thành một mối nguy cho tác giả. Hành động cởi mở sẽ bị bóp méo và lợi dụng để tạo ra thêm của cải và quyền lực tập trung, không chút tôn trọng hay ghi công những ai đã làm ra công việc thực sự.
Điều này sẽ để lại hệ quả tiêu cực khôn lường. 35 năm cởi mở đã tạo ra gần như mọi thứ chúng ta đang hưởng lợi trực tuyến, biến đổi thế giới theo hướng tích cực và trao quyền cho con người.
Tác giả kêu gọi cộng đồng tác giả, lập trình viên, nhà công nghệ và nghệ sĩ cùng nhau tạo ra một Phục hưng số mới trước khi quá nhiều thứ bị mất đi. Nếu không, chúng ta có thể kết thúc trong một phiên bản kỳ dị của Fahrenheit 451 — nơi tri thức bị đốt cháy không phải bằng lửa, mà bằng thuật toán.
Góc nhìn cho độc giả Việt Nam
Với cộng đồng lập trình viên và nội dung sáng tạo tại Việt Nam, cảnh báo này đặc biệt đáng lưu tâm. Nhiều dự án mã nguồn mở Việt Nam đang đối diện nguy cơ bị đưa vào dữ liệu huấn luyện mà không có ghi nhận, trong khi hành lang pháp lý về bản quyền trong huấn luyện AI vẫn còn khoảng trống. Việc chủ động chọn giấy phép phù hợp và minh bạch hóa nguồn dữ liệu sẽ là cách bảo vệ thiết thực nhất cho những ai muốn tiếp tục chia sẻ một cách lành mạnh.