Các nhà nghiên cứu AI cảnh báo: siêu trí tuệ 'nguy hiểm đúng như tên gọi của nó'

Công nghệ29 tháng 9, 2026·4 phút đọc

Một loạt video phỏng vấn các nhà nghiên cứu AI đến từ OpenAI, Google và Anthropic đưa ra những cảnh báo gay gắt về nguy cơ tuyệt chủng của loài người. Geoffrey Irving cho rằng khả năng này giống như 'tung đồng xu', trong khi những người trong cuộc thừa nhận họ đang xây dựng công nghệ mà chính họ không thể kiểm soát.

Các nhà nghiên cứu AI cảnh báo: siêu trí tuệ 'nguy hiểm đúng như tên gọi của nó'

Trong một loạt video mới được công bố trên trang frominside.ai, hàng chục nhà nghiên cứu AI — bao gồm cả những người đang và từng làm việc tại OpenAI, Google và Anthropic — đã lên tiếng cảnh báo về những rủi ro sinh tồn mà siêu trí tuệ nhân tạo (superintelligence) có thể gây ra. Những chia sẻ này phản ánh trực tiếp quan điểm của chính những người đang xây dựng nên công nghệ đó.

"Theo quan điểm của tôi, khả năng loài người bị tuyệt chủng gần giống như việc tung một đồng xu," Geoffrey Irving, cựu nhân viên của OpenAI và Google DeepMind, phát biểu trong một cuộc phỏng vấn.

Minh họa về AI và an toàn trí tuệ nhân tạoMinh họa về AI và an toàn trí tuệ nhân tạo

Những con số đáng báo động

Không chỉ riêng Irving, nhiều đồng nghiệp của ông cũng đưa ra những ước tính gây sốc. Neel Nanda, nhà khoa học nghiên cứu tại Google DeepMind, cho rằng có "ít nhất 10% khả năng AI gây ra sự tuyệt chủng của loài người, và con số đó là quá cao đến mức vô lý."

Daniel Kokotajilo, cựu nhà nghiên cứu của OpenAI, thậm chí còn đi xa hơn khi mô tả siêu trí tuệ AI là "có sức mạnh gần như thần thánh", đồng thời thừa nhận: "Thật không may, chúng ta hoàn toàn không biết cách kiểm soát chúng. Và do đó, nhiều khả năng sẽ không ai kiểm soát được chúng. Điều này nguy hiểm đúng như tên gọi của nó, và tuyệt đối không được phép xảy ra."

Trang web tập hợp tiếng nói từ bên trong ngành

Palisade Research, tổ chức tự nhận là phi lợi nhuận chuyên nghiên cứu năng lực và động cơ của AI, đã thu thập và công bố các cuộc phỏng vấn này. Bên cạnh những video riêng lẻ, trang web còn tổng hợp các đoạn chia sẻ của nhiều người về cùng một chủ đề, bao gồm cả câu hỏi liệu những cảnh báo này có phải chỉ là chiêu trò tiếp thị hay không.

Một số nhà nghiên cứu tỏ ra rất thẳng thắn về xung đột lợi ích của chính mình. Mary Phuong đến từ Google nói: "Tôi nghĩ bạn hoàn toàn nên nghi ngờ những gì tôi đang nói, bởi vì tôi đang được trả lương bởi chính phòng thí nghiệm đó."

Trong khi đó, Nanda giải thích lý do anh vẫn tiếp tục công việc: "Nếu tôi không tin rằng công việc của mình đang trực tiếp giảm thiểu những rủi ro sinh tồn này, tôi sẽ nghỉ việc… Nhưng những công ty này sẽ không dừng việc tạo ra các hệ thống đó chỉ vì tôi nghỉ việc."

Bối cảnh đáng lo ngại hơn

Những cảnh báo này xuất hiện trong bối cảnh hàng loạt động thái đáng chú ý gần đây từ chính các ông lớn công nghệ. OpenAI mới đây đã tạm dừng huấn luyện các mô hình "có năng lực mạnh nhất" của mình, trong khi Nvidia giới thiệu nền tảng an toàn AI mới với tuyên bố có thể kiểm soát các tác nhân AI nổi loạn "trong vòng vài mili giây". Các nhà nghiên cứu hàng đầu cũng cảnh báo rằng AI có khả năng tự cải thiện chính mình có thể mang đến "những rủi ro cực độ".

Đối với độc giả Việt Nam, đây là hồi chuông đáng lưu tâm khi làn sóng AI đang thâm nhập mạnh mẽ vào mọi lĩnh vực — từ startup, giáo dục đến sản xuất. Việc các chuyên gia trực tiếp xây dựng công nghệ này công khai thừa nhận những lo ngại về khả năng kiểm soát cho thấy câu chuyện an toàn AI không còn là vấn đề học thuật xa vời, mà đã trở thành một phần cấp thiết trong quá trình phát triển công nghệ.

Điều gì đang thực sự diễn ra?

Điểm đáng chú ý là ngay cả những người trong cuộc cũng không đưa ra được một giải pháp thống nhất. Các video không đề xuất một hướng đi chung nào, mà chỉ đặt ra câu hỏi lớn hơn: liệu nhân loại có đang đi quá nhanh so với khả năng kiểm soát của chính mình?

Cuộc tranh luận về an toàn AI vì thế vẫn còn bỏ ngỏ, và câu trả lời có thể sẽ quyết định tương lai của chính chúng ta.

Chia sẻ:FacebookX
Nội dung tổng hợp bằng AI, mang tính tham khảo. Xem bài gốc ↗