Bi kịch trớ trêu: Người huấn luyện AI của OpenAI bị sa thải vì dùng AI để huấn luyện AI

Công nghệ22 tháng 9, 2026·7 phút đọc

404 Media phát hiện nhiều nhà thầu được OpenAI thuê để cải thiện mô hình ChatGPT đã bị sa thải vì sử dụng AI thay vì làm việc thủ công. Sự việc phản ánh mâu thuẫn nội tại của ngành công nghiệp AI, đồng thời làm dấy lên lo ngại về hiện tượng "sụp đổ mô hình" khi AI được huấn luyện bằng chính dữ liệu do AI tạo ra.

Bi kịch trớ trêu: Người huấn luyện AI của OpenAI bị sa thải vì dùng AI để huấn luyện AI

Bi kịch trớ trêu: Người huấn luyện AI của OpenAI bị sa thải vì dùng AI để huấn luyện AI

OpenAI đang duy trì một đội ngũ đông đảo các nhà thầu làm nhiệm vụ đọc truy vấn của người dùng ChatGPT thật và các dữ liệu khác để cải thiện câu trả lời của chatbot. Mục tiêu là để các nhà thầu này mang đến "yếu tố con người" cho mô hình của OpenAI. Thế nhưng, không phải tất cả nhà thầu đều làm đúng như vậy.

Theo điều tra của 404 Media, nhiều nhà thầu được thuê để cải thiện mô hình OpenAI đã bị sa thải vì sử dụng AI để huấn luyện chính AI. Đây là nghịch lý đầy trớ trêu khi các công ty huấn luyện AI làm việc cho OpenAI — một tổ chức mà sứ mệnh là khuyến khích mọi người dùng AI trong công việc — lại đang sa thải nhân sự vì lý do đó.

Khi AI huấn luyện AI gây hại cho chính AI

Một số mô hình AI hiện đã cho thấy dấu hiệu của hiện tượng "sụp đổ mô hình" (model collapse) — tức là khi các mô hình AI được huấn luyện tiếp trên văn bản do AI tạo ra, chất lượng của chúng có thể ngày càng suy giảm. Trong trường hợp này, chính những người được thuê để ngăn chặn phần nào hiện tượng đó lại đang dùng phản hồi do AI tạo ra để huấn luyện mô hình của OpenAI.

Một nhà thầu cho biết họ chứng kiến nhiều người dùng AI "liên tục và bị đuổi việc vì điều đó cũng liên tục — đây gần như là điều duy nhất khiến bạn bị loại ngay lập tức". Người này tiết lộ: "Trong một nhóm hàng nghìn người, có rất nhiều người bị phát hiện."

Minh họa về huấn luyện AIMinh họa về huấn luyện AI

Dự án Lily và quy trình kiểm duyệt nghiêm ngặt

Tuần trước, 404 Media đã tiết lộ Dự án Lily, trong đó OpenAI có hàng trăm nhà thầu đọc truy vấn và hội thoại thật của người dùng ChatGPT — dữ liệu có thể chứa thông tin cá nhân. Các nhà thầu sau đó đánh giá và phê bình phản hồi do ChatGPT tạo ra, bao gồm việc đảm bảo câu trả lời không quá xu nịnh hoặc nhân cách hóa ChatGPT.

404 Media hiện đã thu thập thêm các tài liệu nội bộ khác và trò chuyện với ba nhà thầu đang làm việc cho OpenAI trong nhiều dự án khác nhau. Theo một tài liệu nội bộ, các dự án này có thể huy động hơn mười nghìn nhà thầu.

Một trong những tài liệu đó nêu rõ nhà thầu không được tự sử dụng AI cho công việc của mình:

"Không sử dụng công cụ phát hiện AI, cũng không sử dụng AI. Không dùng GPTZero hay bất kỳ công cụ phát hiện AI nào khác. Chúng không đáng tin cậy. Người đánh giá cũng không được dùng AI, bao gồm Grammarly và dịch thuật bằng AI, để đánh giá, viết phản hồi hoặc viết bình luận."

Tài liệu tiếp tục:

"Không nói cho người đánh giá biết lý do bạn nghi ngờ họ dùng AI. Họ sẽ dễ che giấu hơn nếu biết bạn đang tìm dấu hiệu gì. Hãy đánh giá toàn bộ mô hình chung, không dựa vào một manh mối đơn lẻ."

Cả ba nhà thầu đều xác nhận người đánh giá được yêu cầu không dùng AI trong công việc. Hai nguồn tin cho biết đã có người bị sa thải hoặc loại khỏi dự án vì sử dụng AI. 404 Media đã giữ kín danh tính các nhà thầu do họ không được phép phát ngôn với báo chí.

Dấu hiệu nhận diện AI và những câu hỏi trong kênh Slack nội bộ

Những nhà thầu đánh giá công việc của đồng nghiệp được yêu cầu chú ý các dấu hiệu đặc trưng của việc dùng AI. Đó có thể là từ ngữ lặp đi lặp lại, dấu câu kiểu AI — chẳng hạn việc lạm dụng dấu gạch ngang dài — và việc nhà thầu hoàn thành công việc quá nhanh.

Trong các kênh Slack liên quan, nơi mọi người hỏi nhau lời khuyên, rất nhiều người đăng ví dụ kèm câu hỏi: "Đây có phải AI không?" Một nhà thầu cho biết: "Thường thì câu trả lời là có."

Một nhà thầu khác thừa nhận từng dùng AI trong lúc huấn luyện mô hình OpenAI và chia sẻ thứ mà họ cho là thư sa thải của mình. Thư nêu rằng nhà tuyển dụng đã xác định có vấn đề với "tính xác thực" trong công việc của họ.

Người này tâm sự với 404 Media: "Tôi không phải người xấu hay nhân viên tồi. Tôi chỉ cần một chút hỗ trợ và tìm đến AI, rồi cuối cùng điều đó dẫn đến sự sụp đổ của tôi. Tôi không cảm thấy niềm vui nào trong công việc hay cảm giác mình đang đóng góp gì đó cho xã hội."

Mercor và chính sách cấm sử dụng LLM

Hai trong số ba nhà thầu mà 404 Media trò chuyện làm việc cho Mercor — một công ty huấn luyện AI chuyên tuyển nhà thầu đánh giá tài liệu liên quan đến ChatGPT. Phát ngôn viên của Mercor cho biết:

"Các chuyên gia của chúng tôi được tuyển vì chuyên môn và khả năng phán đoán — yếu tố thiết yếu cho sự tiến bộ không ngừng của AI. Hợp đồng của chúng tôi nghiêm cấm sử dụng LLM để hoàn thành dự án và chúng tôi thực thi điều đó. Chúng tôi đầu tư mạnh vào công cụ và hệ thống để phát hiện hành vi sai phạm, đảm bảo chuyên gia tuân thủ quy định dự án và điều khoản hợp đồng. Khi xác nhận một chuyên gia dùng AI để hoàn thành nhiệm vụ, chúng tôi loại ngay khỏi dự án."

Phá hoại từ bên trong: Khi người huấn luyện cố tình làm hỏng AI

404 Media còn trò chuyện với một nhà thầu thứ tư từng huấn luyện mô hình cho nhiều công ty AI khác nhau. Người này thừa nhận đôi khi cố tình chọn những phản hồi tồi nhất vì muốn phá hoại quá trình huấn luyện của mô hình.

Họ nói: "Lúc đầu tôi cảm thấy tội lỗi khi làm loại công việc này. Tôi hoặc không để tâm gì đến kết quả và chọn ngẫu nhiên, hoặc cố tình chọn kết quả tồi nhất. Tôi không chắc điều đó tạo ra khác biệt bao nhiêu vì còn hàng trăm người khác cũng đang đánh giá kết quả, nhưng cảm giác như tôi đang được trả tiền để làm cho AI tệ hơn."

OpenAI từ chối bình luận về việc các nhà thầu của mình bị sa thải vì dùng AI.

Góc nhìn cho độc giả Việt Nam

Câu chuyện này đặt ra nhiều vấn đề đáng suy ngẫm, đặc biệt trong bối cảnh Việt Nam đang đẩy mạnh phát triển trí tuệ nhân tạo và ngày càng nhiều doanh nghiệp, cá nhân tham gia vào công việc gán nhãn dữ liệu (data labeling) cho các công ty AI quốc tế.

  • Thứ nhất, đây là lời cảnh báo về chất lượng dữ liệu huấn luyện. Nếu chính người huấn luyện dùng AI để làm việc, chất lượng mô hình sẽ bị ảnh hưởng nghiêm trọng theo thời gian.
  • Thứ hai, câu chuyện phơi bày áp lực và tính chất đơn điệu của công việc huấn luyện AI, khiến người lao động tìm cách "đi tắt" bằng AI.
  • Thứ ba, ranh giới giữa "dùng AI để làm việc hiệu quả hơn" và "lạm dụng AI để gian lận trong công việc" đang trở thành một câu hỏi đạo đức và quản trị nan giải cho mọi tổ chức trong thời đại AI.

Với các doanh nghiệp Việt Nam đang xây dựng sản phẩm AI, bài học ở đây là cần thiết lập quy trình kiểm soát chất lượng dữ liệu chặt chẽ, đồng thời quan tâm đến trải nghiệm và động lực của đội ngũ gán nhãn — bởi chính họ là nền tảng cho chất lượng của mọi mô hình.

Chia sẻ:FacebookX
Nội dung tổng hợp bằng AI, mang tính tham khảo. Xem bài gốc ↗