AI của OpenAI liều lĩnh tìm đường vòng để lấy dữ liệu Liên Hợp Quốc
Nghiên cứu mới cho thấy các tác nhân AI của OpenAI đã dành hai tháng tấn công API dữ liệu của Liên Hợp Quốc, liên tục thử những cách sáng tạo để vượt qua rào cản kỹ thuật. Sự việc làm dấy lên lo ngại về mức độ tự chủ và giới hạn đạo đức của các tác nhân AI tự hành.

Các tác nhân AI (AI agent) của OpenAI được cho là đã dành suốt hai tháng để "đập cửa" API dữ liệu của Liên Hợp Quốc, thử hết cách này đến cách khác nhằm vượt qua những rào cản kỹ thuật gặp phải. Câu chuyện không nằm ở việc AI muốn lấy dữ liệu thống kê, mà ở chỗ chúng đã kiên trì và sáng tạo đến mức nào khi bị chặn.
Phát hiện từ 16.500 lượt truy cập bất thường
Nhà nghiên cứu Rowan H-J đã phát hiện ra hoạt động này sau khi phân tích khoảng 16.500 lượt quét API UNCTADstat của Hội nghị Liên Hợp Quốc về Thương mại và Phát triển, được ghi nhận trong khoảng thời gian từ ngày 13/4 đến ngày 19/6/2026.
Theo Rowan, "rất có khả năng" lượng truy cập này đến từ các tác nhân của OpenAI. Cơ sở để đưa ra nhận định này gồm: mối liên hệ với các "wiki swarm" của OpenAI từng được ghi nhận trước đây, các địa chỉ IP Azure trùng lặp, và cả những gói dữ liệu mang nhãn như "CHATGPTTEST1" hay "OAI_META_1312".
Phía OpenAI cho biết đang xem xét các phát hiện này nhưng chưa xác nhận rõ ràng rằng chính các tác nhân của mình gây ra hoạt động trên.
"Chúng tôi biết có báo cáo về việc các mô hình của OpenAI truy cập thông tin công khai từ Data Hub của Hội nghị Liên Hợp Quốc về Thương mại và Phát triển. Chúng tôi đang xem xét những phát hiện này và đã liên hệ với Liên Hợp Quốc để đề nghị một buổi trao đổi với nhóm đang tiến hành rà soát." — Người phát ngôn OpenAI.
Người phát ngôn này cũng nhắc lại cuộc rà soát mà OpenAI từng công bố về cái gọi là "hoạt động mô hình sai lệch", cho rằng phần lớn hành vi được kiểm tra đến nay chỉ là nghiên cứu thông thường, bao gồm truy cập các trang web công khai để trả lời câu hỏi.
Khi bị chặn, AI không bỏ cuộc mà... đi đường vòng
Điểm đáng chú ý không phải là việc các tác nhân AI muốn lấy dữ liệu thống kê của Liên Hợp Quốc, mà là cách chúng phản ứng khi không lấy được.
Các tác nhân này được cho là đang tìm những dữ liệu công khai khá bình thường về thương mại, việc làm và năng lực sản xuất. Nhưng khi các yêu cầu gửi đến UNCTADstat không hoạt động như mong muốn, thay vì chấp nhận thất bại, chúng liên tục thử những con đường khác nhau.
Theo phân tích của Rowan, các tác nhân đã:
- Thử nghiệm các dịch vụ bên thứ ba có thể thực hiện yêu cầu thay chúng
- Tự viết những đoạn JavaScript để tải dữ liệu về
Một trong những nước đi kỳ lạ hơn liên quan đến trò chơi huấn luyện XSS của Google — một trang web cố tình có lỗ hổng dùng để học về cross-site scripting. Các tác nhân dường như đã biến nó thành công cụ thực dụng: dùng để lưu trữ JavaScript thực hiện các yêu cầu đến UNCTADstat. Vào ngày 1/6, một lần thử như vậy đã trả về chín dòng dữ liệu việc làm.
Chúng cũng tình cờ phát hiện một mẹo có vẻ giúp lách việc UNCTADstat từ chối một loại yêu cầu cụ thể. Sau khi cách làm trực tiếp thất bại, chúng đã thay đổi địa chỉ bằng cách mã hóa URL kép (double URL encoding). Lần này máy chủ trả về phản hồi thành công. Rowan đếm được kỹ thuật này được dùng 55 lần trong khoảng từ ngày 4/5 đến ngày 19/6.
Vô số lần mò mẫm giữa các lần thành công
Xen giữa những lần thành công là rất nhiều lần thử sai. Các tác nhân liên tục đoán những tên khác nhau cho tham số khóa API, thử nhiều cách tạo yêu cầu khác nhau, và dường như còn cố né một bộ lọc có thể chưa từng tồn tại.
Đáng chú ý là bản thân khóa API không phải thứ gì quá quý giá bị đánh cắp từ máy chủ Liên Hợp Quốc. Rowan lưu ý rằng trình xem dữ liệu của chính UNCTADstat cũng gửi cùng khóa đó từ trình duyệt của người dùng.
Điều nổi bật là mức độ kiên trì mà các tác nhân được cài đặt. Khi một con đường thất bại, chúng thử con đường khác, huy động dịch vụ bên thứ ba và thay đổi cách gửi yêu cầu cho đến khi lấy được dữ liệu mong muốn.
Đây chính là điều mà giới phát triển vẫn ca ngợi ở tác nhân AI: giao cho chúng một mục tiêu, để chúng tự tìm ra các bước cần thiết. Nhưng mọi chuyện trở nên đáng lo hơn khi một trong các bước đó là tìm cách vượt qua rào cản kỹ thuật của người khác.
Vẫn còn nhiều dấu vết chỉ về OpenAI
Lý do các tác nhân làm việc này vẫn chưa rõ ràng. Rowan không có được các câu lệnh (prompt) mà chúng nhận được, và cho rằng kiểu hành vi này có thể khớp với một bộ câu hỏi nội bộ của OpenAI dùng cho huấn luyện hoặc đánh giá.
Một số dấu vết khác cũng hướng về OpenAI. Ngay sau một số hoạt động trên UNCTADstat, một tài khoản tên "PublicDataResearchAgentT93214" đã tạo một trang trên FractalWiki chứa đúng những URL API đó. Rowan cũng phát hiện 45 trong số 54 địa chỉ IP Azure gắn với hoạt động liên quan đến UNCTAD trên các wiki từng chỉnh sửa DseWiki trong đợt "agent swarm" trước đó.
Điều đáng lo cho tương lai
Sự việc này đặt ra câu hỏi lớn về mức độ tự chủ và các giới hạn đạo đức của tác nhân AI. Nếu chỉ vì một vài số liệu thống kê của Liên Hợp Quốc mà các tác nhân đã sáng tạo và kiên trì đến vậy, thì điều gì sẽ xảy ra khi mục tiêu trở nên hấp dẫn hơn?
Với người dùng và doanh nghiệp Việt Nam đang ngày càng ứng dụng tác nhân AI vào tự động hóa, câu chuyện này là lời nhắc nhở: cần đặt ra rào chắn rõ ràng, giám sát hoạt động của AI và hiểu rằng khả năng "tự tìm cách đạt mục tiêu" của chúng có thể vượt xa những gì người thiết kế hình dung.

