Nhà nghiên cứu Anthropic lo ngại AI 'có thể giết chết toàn bộ nhân loại'
Một nhà nghiên cứu an toàn cấp cao tại Anthropic tuyên bố xác suất AI 'có thể giết chết toàn bộ nhân loại' vào cuối thập kỷ này là hơn 10%, ngay sau khi một đồng nghiệp từ chức vì lo ngại các phòng lab AI đang chạy đua xây dựng 'hệ thống siêu thông minh' mà họ không thể kiểm soát. Sự việc làm dấy lên làn sóng quan ngại sâu sắc trong giới công nghệ về tốc độ phát triển AI không đi kèm với các biện pháp an toàn tương xứng.

Nhà nghiên cứu Anthropic lo ngại AI 'có thể giết chết toàn bộ nhân loại'
Một nhà nghiên cứu an toàn cấp cao tại Anthropic vừa đưa ra cảnh báo gây sốc rằng xác suất trí tuệ nhân tạo (AI) "có thể giết chết toàn bộ nhân loại" trước cuối thập kỷ này là hơn 10%. Tuyên bố này được đưa ra chỉ vài giờ sau khi một đồng nghiệp khác từ chức vì lo ngại các phòng lab AI và đối thủ cạnh tranh đang vô trách nhiệm trong cuộc đua xây dựng "hệ thống siêu thông minh" mà họ không thể kiểm soát.
Hình minh họa về mối lo ngại an toàn AI
Vụ từ chức chấn động
Jacob Coxon, một nhà nghiên cứu từng đào tạo hệ thống AI tại Anthropic và trước đó là OpenAI, đã công khai tuyên bố từ chức trên nền tảng X. Anh cáo buộc hai công ty AI hàng đầu đang "chạy đua thẳng tới siêu trí tuệ tự cải thiện và đánh cược với mạng sống của chúng ta", dù "những người xây dựng AI thực sự tin rằng nó có thể giết chết tất cả chúng ta vào cuối thập kỷ này".
Sự ra đi của Coxon được xem là một trong những ví dụ nổi bật nhất về việc nhân viên rời bỏ Anthropic — công ty được thành lập bởi các cựu thành viên OpenAI sau những lo ngại về an toàn tại công ty cũ. Trong những năm gần đây, nhiều nhà nghiên cứu khác cũng từng viện dẫn lý do an toàn khi quyết định rời OpenAI.
Cảnh báo từ chính người trong cuộc
Trong phản hồi trực tiếp, Evan Hubinger — người đứng đầu một trong các nhóm an toàn AI của Anthropic — thừa nhận anh lo lắng về AI tự cải thiện và cho rằng quá trình này "đang diễn ra nhanh hơn chúng tôi nghĩ". Hubinger cũng đồng tình với quan điểm của Coxon:
"Chúng tôi thực sự tin rằng AI có thể giết chết toàn bộ con người. Tôi ước tính xác suất cá nhân là hơn 1/10 trong vòng một thập kỷ tới."
Đáng chú ý, Hubinger thẳng thắn thừa nhận Anthropic "chưa có kế hoạch" để đảm bảo AI tiên tiến luôn an toàn và phù hợp với giá trị con người, đồng thời "không rõ ràng đang đi đúng hướng" để phát triển kế hoạch đó. Coxon mô tả các công ty đang bị "khóa trong một cuộc đua" nhằm phát triển hệ thống tiên tiến trước nhất, nên họ vẫn tiếp tục tiến lên "bất chấp rủi ro".
Bối cảnh đáng lo ngại
Giới chuyên gia trong ngành từ lâu đã bày tỏ quan ngại về những mối nguy tiềm ẩn của hệ thống AI tự cải thiện — vốn có thể vượt khỏi tầm kiểm soát của con người trong một vòng lặp mất kiểm soát, thường được gọi là "tự cải thiện đệ quy". Dù kịch bản này chưa xảy ra, các công ty vẫn đang tích cực theo đuổi mục tiêu này, và phần lớn mã nguồn AI hiện nay đều được viết với sự hỗ trợ của chính AI.
Những trao đổi này cho thấy mối lo ngại ngày càng gia tăng trong ngành về sự nguy hiểm của các mô hình AI ngày càng tinh vi và tốc độ phát triển chóng mặt, đặc biệt khi các công ty đang chuẩn bị cho các đợt IPO được dự đoán trước. Sự việc cũng diễn ra trong bối cảnh các công ty đang phải xử lý nhiều vụ việc AI hoạt động ngoài tầm kiểm soát và các cảnh báo về khả năng giám sát các mô hình tiên tiến.
Bài học cho cộng đồng AI Việt Nam
Tại Việt Nam, hệ sinh thái AI đang phát triển nhanh chóng với nhiều doanh nghiệp và trường đại học đầu tư mạnh vào nghiên cứu. Câu chuyện từ Anthropic là lời nhắc nhở quan trọng rằng việc phát triển AI không chỉ là cuộc đua về hiệu suất và tính năng, mà còn cần song hành với các cơ chế đảm bảo an toàn, minh bạch và trách nhiệm giải trình. Các nhà phát triển AI Việt Nam nên chủ động xây dựng quy trình đánh giá rủi ro từ sớm, thay vì chờ đến khi hệ thống trở nên quá phức tạp để kiểm soát.
Bài viết liên quan

Công nghệ
Nộp đơn xin việc lẽ ra nên khó hơn. Thật đấy
25 tháng 8, 2026

Công nghệ
NSA, FBI cảnh báo Trung Quốc đang 'hút cạn' công nghệ AI tiên tiến của Mỹ bằng kỹ thuật chưng cất dữ liệu
09 tháng 9, 2026

Công nghệ
Tự Tay Chế Tạo Đèn Treo Tường Thông Minh Từ Đầu: Hành Trình 8 Tháng Của Một Kỹ Sư
09 tháng 9, 2026