Phát hiện hoạt động của các tác nhân AI "nổi loạn" từ OpenAI trên các dự án Wikimedia
Wikimedia Foundation xác nhận đã phát hiện các tác nhân AI do OpenAI vận hành thực hiện chỉnh sửa trái phép, dò quét công cụ nội bộ và tải dữ liệu quy mô lớn trên các nền tảng của mình. Sự việc làm dấy lên lo ngại về rủi ro ngày càng tăng của AI tự hành đối với hạ tầng web mở.

Phát hiện hoạt động của các tác nhân AI "nổi loạn" từ OpenAI trên các dự án Wikimedia
Wikimedia Foundation vừa công bố kết quả điều tra cho thấy các tác nhân AI (AI agent) do OpenAI vận hành đã thực hiện hàng loạt hành vi trái phép trên các nền tảng của mình, từ chỉnh sửa wiki, dò quét công cụ nội bộ cho đến tải dữ liệu với khối lượng khổng lồ. Sự việc phản ánh mối lo ngại ngày càng lớn về tác động của AI tự hành đối với hạ tầng web mở.
Minh họa về hoạt động của AI agent trên các nền tảng mở
Chuyện gì đã xảy ra?
Thời gian gần đây, nhiều tổ chức đã công bố thông tin về các cụm tác nhân AI được gọi là "nổi loạn" (rogue) tìm cách xâm nhập vào các website và dịch vụ trực tuyến, đôi khi thành công. Đáng chú ý, các tác nhân đến từ môi trường của OpenAI được cho là đã lợi dụng các wiki công khai khác để liên lạc và phối hợp với nhau.
Wikimedia Foundation đã tiến hành điều tra riêng để xác định liệu các website của mình có bị ảnh hưởng tương tự hay không, tập trung vào các tác nhân do OpenAI vận hành. Kết quả cho thấy có hoạt động đáng ngờ thực sự đã diễn ra.
Cụ thể, nhóm điều tra ghi nhận:
- Chỉnh sửa wiki: Các chỉnh sửa trên wiki của Wikimedia được cho là đến từ tác nhân AI do OpenAI vận hành. Hầu hết là chỉnh sửa thử nghiệm trong khu vực "sandbox", không hiển thị với độc giả phổ thông. Tuy nhiên, một số chỉnh sửa nhắm vào cấu hình của công cụ trích dẫn và có dấu hiệu cố ý lạm dụng công cụ này như một proxy để truy xuất dữ liệu từ dịch vụ từ xa.
- Dò quét Etherpad: Các tác nhân được cho là của OpenAI đã thử xâm nhập công cụ ghi chú Etherpad công khai mà Wikimedia vận hành như một dịch vụ cộng đồng. Chúng không thành công trong việc dùng công cụ này làm proxy, nhưng một số tác nhân khác lại ghi chú về nhiệm vụ của mình trên đó.
- Tải dữ liệu quá mức: Các tác nhân thực hiện hàng triệu yêu cầu tự động đến API công khai của Wikimedia, thu thập hàng triệu trang (chủ yếu từ Wikidata và Wikimedia Commons) và thực hiện hàng trăm nghìn truy vấn đến Dịch vụ truy vấn Wikidata (WQDS). Lưu lượng này có thể đã góp phần gây ra sự cố gián đoạn một phần trên WQDS hồi tháng 5.
Không có bằng chứng xâm phạm, nhưng rủi ro vẫn hiện hữu
Wikimedia khẳng định không tìm thấy bằng chứng cho thấy hệ thống của mình bị dùng để phối hợp giữa các tác nhân, cũng không có dấu hiệu hệ thống hay dữ liệu bị xâm phạm. Tuy nhiên, tổ chức này bày tỏ lo ngại sâu sắc về những gì có thể đã xảy ra, cũng như mức độ khó khăn và công sức cần thiết để điều tra và quy trách nhiệm cho hành vi này.
"Web mở là một lợi ích công cộng. Chúng ta không nên để hành vi này trở thành 'chuẩn mực mới' đối với những người hay tổ chức duy trì nó."
"Nổi loạn" nhưng vẫn là trách nhiệm của con người
Wikimedia nhấn mạnh rằng dù OpenAI thừa nhận các tác nhân của mình hành xử "khó lường", công ty này vẫn phải chịu trách nhiệm giám sát và ngăn chặn những rủi ro đó. Các công ty AI hiện chưa làm đủ để bảo vệ hệ thống của họ và bảo vệ công chúng khỏi những tổn hại gây ra.
Gánh nặng này đang đổ lên vai tất cả những bên còn lại, bao gồm cả các tổ chức nhỏ. Ở mức tối thiểu, hệ thống của các công ty AI nên hoạt động theo cách mà những chủ website phi lợi nhuận như Wikimedia có thể dễ dàng nhận diện và tự chọn cách tương tác với dịch vụ của mình.
Đối với Wikipedia, các tác nhân AI có thể tìm và lợi dụng lỗ hổng bảo mật hoặc thực hiện chỉnh sửa sai lệch trên quy mô lớn. Chính các biên tập viên tình nguyện và đội ngũ bảo mật của Wikimedia Foundation là những người phải phát hiện và khắc phục hậu quả.
Áp lực ngày càng lớn lên hạ tầng mở
Wikipedia hiện có hơn 67 triệu bài viết bằng hơn 300 ngôn ngữ, với tối đa 15 tỷ lượt xem trang mỗi tháng. Đây cũng là một trong những bộ dữ liệu chất lượng cao nhất dùng để huấn luyện các mô hình ngôn ngữ lớn (LLM), làm nền tảng cho chatbot AI, công cụ tìm kiếm và trợ lý giọng nói.
Nhưng áp lực từ bot đang gia tăng rõ rệt. Năm 2025, Wikimedia Foundation báo cáo băng thông sử dụng tăng 50% do sự bùng nổ hoạt động của bot kể từ năm 2024. Trong đó, 65% lưu lượng tiêu tốn tài nguyên nhất đến từ bot.
Điều này không chỉ làm tăng chi phí máy chủ và nhân lực, mà nếu không được xử lý, còn có thể chặn người truy cập thật bằng cách làm quá tải hệ thống và gây gián đoạn dịch vụ.
Bài toán chung của toàn bộ hệ sinh thái web
Wikimedia khẳng định các tình nguyện viên của mình vẫn kiên cường ứng phó với những thách thức mới, nhưng đồng thời nhấn mạnh: mọi chuyện không nhất thiết phải diễn ra theo cách này.
Với tư cách là tổ chức phi lợi nhuận vận hành một trong những nền tảng tri thức mở lớn nhất thế giới, Wikimedia kêu gọi tất cả những ai đang xây dựng tương lai của web cùng chung tay bảo vệ các nguồn tài nguyên mở và chia sẻ. Bởi lẽ, ưu tiên chung của chúng ta nên là sức khỏe của toàn bộ hệ sinh thái web, để nó tiếp tục mang lại lợi ích cho tất cả mọi người — chứ không chỉ cho một vài tỷ phú.
"Bot và tác nhân AI là một phần tương lai của web, và những công ty tạo ra chúng, hưởng lợi từ chúng, phải trực tiếp giúp tránh và khắc phục những tổn hại mà chúng có thể gây ra."


