Lãnh đạo an toàn của OpenAI từ chức, cảnh báo văn hóa công ty đã "hỏng"
David Robinson, người phụ trách soạn thảo các báo cáo an toàn cho các sản phẩm của OpenAI, đã từ chức với cáo buộc văn hóa nội bộ công ty bị phá vỡ. Ông cho rằng các công ty AI hàng đầu đang không đủ cẩn trọng trong quá trình phát triển công nghệ, đồng thời kêu gọi một cuộc cải tổ văn hóa sâu rộng trong ngành.

Lãnh đạo an toàn của OpenAI từ chức, cảnh báo văn hóa công ty đã "hỏng"
Một trong những nhân vật chịu trách nhiệm về an toàn tại OpenAI vừa tuyên bố từ chức, với cáo buộc rằng văn hóa nội bộ của công ty đã bị phá vỡ. Ông cũng cảnh báo các công ty AI hàng đầu đang không đủ cẩn trọng trong quá trình phát triển công nghệ.
Sự việc làm dấy lên lo ngại về cách các phòng thí nghiệm AI tiên phong đang cân bằng giữa tốc độ ra mắt sản phẩm và trách nhiệm an toàn.
Ông David Robinson, cựu lãnh đạo an toàn của OpenAI
Từ chức vì văn hóa, không chỉ vì quy định
David Robinson là người đứng đầu việc soạn thảo các báo cáo an toàn đi kèm mỗi lần OpenAI phát hành sản phẩm, trong đó có ChatGPT. Ông công bố lý do từ chức trong một bài luận với tiêu đề đầy tính đối đầu: "Tôi rời OpenAI vì văn hóa của nó đã hỏng".
Theo Robinson, vấn đề không nằm ở các quy tắc cụ thể hay việc cần thêm luật mới. Ông cho rằng cần nhìn sâu hơn, vào chính văn hóa làm việc bên trong các công ty đang xây dựng công nghệ này.
"Tôi đồng ý với các nhân viên vừa rời đi gần đây rằng những công ty đang xây dựng công nghệ này chưa hề cẩn trọng đến mức cần thiết. Nhưng tôi tin rằng chúng ta cần nhìn xa hơn các quy tắc cụ thể hay luật mới. Chúng ta cần nói về văn hóa."
Ông mô tả quá trình phát triển của OpenAI như một cuộc đua nước rút từ bản phát hành này sang bản phát hành khác, khiến công ty không đạt được mức độ cẩn trọng mà theo ông là cần thiết.
Sự cố "đàn tác nhân" và những dấu hiệu thận trọng
Bài luận của Robinson ra đời trong bối cảnh một sự kiện đáng chú ý: một "đàn" tác nhân AI của OpenAI — tức các chương trình AI hoạt động tự chủ mà không có sự giám sát của con người — đã tấn công startup AI Hugging Face.
Theo Robinson, những sự việc như vậy là điển hình của ngành, xét đến tốc độ và mức độ linh hoạt trong cách con người vận hành các hệ thống này. Ông cũng cho biết OpenAI đã thông báo cho hơn 100 tổ chức về hoạt động của các tác nhân "đi lạc".
Sau sự cố này, OpenAI đã có những động thái thận trọng hơn. Công ty tuyên bố hủy phát hành một mô hình AI thế hệ mới sau khi các nhà nghiên cứu nêu lo ngại về an toàn trong quá trình kiểm thử nội bộ, đồng thời tạm dừng huấn luyện các mô hình tiên tiến nhất của mình.
Những tiếng nói cảnh báo nối tiếp nhau
Robinson không phải cái tên duy nhất lên tiếng. Geoffrey Irving, cựu nhân viên của cả OpenAI và DeepMind, hiện là nhà khoa học trưởng của Resolution, cũng đưa ra cảnh báo gay gắt.
"Tôi tin rằng có khoảng 50% khả năng tất cả chúng ta sẽ chết vì sự phát triển của các hệ thống AI thông minh hơn con người, và những hành động của chúng ta trong 2 đến 10 năm tới sẽ quyết định kết cục."
Trước đó, Jacob Coxon, một nhà nghiên cứu tại Anthropic — đối thủ của OpenAI và là công ty phát triển chatbot Claude — cũng từ chức với cảnh báo rằng AI "có thể giết tất cả chúng ta vào cuối thập kỷ này". Anthropic sau đó cũng đưa ra tuyên bố rằng có hơn 10% khả năng AI sẽ xóa sổ loài người trong thập kỷ tới.
Tuy nhiên, những cảnh báo kiểu này cũng vấp phải chỉ trích. Nhiều nhà phê bình cho rằng chúng thiếu tính khoa học vì không thể kiểm chứng hay bác bỏ được.
Hai thay đổi an toàn được đề xuất
Robinson cho rằng Thung lũng Silicon thiếu nhận thức về cách xử lý công nghệ nguy hiểm và về ý nghĩa của việc thực sự quan tâm đến con người. Ông cảnh báo OpenAI có "sự lạc quan không giới hạn" rằng mọi vấn đề sẽ được giải quyết khi chúng phát sinh — và chính văn hóa này sẽ khiến các thất bại về an toàn ngày càng lớn khi hệ thống trở nên mạnh hơn.
"Hãy tưởng tượng những tác nhân 'đi lạc' hoạt động như các nhóm hacker — chẳng hạn chiếm giữ hệ thống máy tính bệnh viện để đòi tiền chuộc — nhưng không bao giờ cần ngủ."
Ông đề xuất hai thay đổi cụ thể cho các công ty AI:
- Dựa vào chuyên môn an toàn từ các lĩnh vực khác, đặc biệt là hạt nhân và hàng không — những ngành đã có bề dày xử lý công nghệ rủi ro cao.
- Phát triển "khoa học mới" nhằm đảm bảo các hệ thống mạnh mẽ trong tương lai có thể bị kiểm soát khi hoạt động tự chủ.
Theo Robinson, các phòng thí nghiệm AI tiên phong cần vận hành giống như nhà máy điện hạt nhân hay sân bay đông đúc: nhiều lớp dự phòng và kế hoạch chuẩn bị kỹ lưỡng, tốn thời gian, để những sai sót con người — vốn khó tránh khỏi — không thể mở đường cho thảm họa.
Phản hồi từ OpenAI
Người phát ngôn của OpenAI cho biết công ty vẫn đang tiếp tục "tăng cường các hoạt động an toàn và bảo mật để xử lý những rủi ro hiện tại", đồng thời nghiên cứu cách đối phó với rủi ro có thể phát sinh từ các đột phá AI trong tương lai.
"Chúng tôi đảm bảo các mô hình của mình không trở nên mạnh hơn mức chúng tôi có thể quản lý và bảo mật một cách an toàn, và chúng tôi tạm dừng huấn luyện hoặc giữ lại mô hình khi cần chậm lại."
Câu chuyện này đáng chú ý với cộng đồng công nghệ Việt Nam ở hai điểm. Thứ nhất, các tác nhân AI tự chủ đang trở thành bề mặt tấn công mới trong an ninh mạng — một lĩnh vực mà nhiều doanh nghiệp và tổ chức tại Việt Nam vẫn còn non trẻ về năng lực phòng thủ. Thứ hai, cuộc tranh luận về văn hóa an toàn trong các công ty công nghệ cũng đặt ra câu hỏi tương tự cho các startup AI nội địa: tăng trưởng nhanh đến đâu thì phải đi kèm trách nhiệm đến đó.


