Chuyên gia nghiên cứu an toàn AI của Anthropic cảnh báo: Hơn 10% khả năng AI 'giết sạch loài người'
Một nhà nghiên cứu an toàn hàng đầu tại Anthropic vừa đưa ra cảnh báo gây chấn động: AI có thể phát triển đến mức gây ra mối đe dọa hiện hữu cho nhân loại trong vòng một thập kỷ tới, với xác suất lên tới hơn 10%. Cảnh báo này được đưa ra trong bối cảnh những lo ngại về khả năng kiểm soát các mô hình AI ngày càng tăng, đặc biệt là khi các công ty công nghệ lớn bị cáo buộc đang che giấu thông tin về mức độ nguy hiểm của sản phẩm.

Ảnh minh họa về trí tuệ nhân tạo
Một nhà nghiên cứu an toàn hàng đầu tại Anthropic - công ty đứng sau mô hình AI nổi tiếng Claude - vừa đưa ra một cảnh báo gây sốc. Ông Evan Hubinger tuyên bố rằng ông tin có hơn 10% khả năng AI "có thể giết sạch toàn bộ loài người" trong vòng một thập kỷ tới, khi công nghệ này đang phát triển với tốc độ chóng mặt mà con người không thể kiểm soát.
Tuyên bố này được đưa ra trong bối cảnh làn sóng lo ngại về an toàn AI đang dâng cao trên toàn cầu. Trước đó, báo Financial Times đưa tin Anthropic đã từ chối cung cấp mô hình mới nhất của mình cho Viện An toàn AI của Anh (AISI) - một trong những cơ quan hàng đầu thế giới về đánh giá rủi ro AI, làm dấy lên nghi ngờ về sự minh bạch của các công ty công nghệ lớn.
Lời cảnh báo từ bên trong ngành
Trong một bài đăng trên mạng xã hội X thu hút hơn 10 triệu lượt xem, Hubinger cho biết rủi ro từ các mô hình AI hiện tại vẫn ở mức "thấp", nhưng ông thực sự "lo lắng" rằng công nghệ này có thể sớm tự phát triển và cải thiện chính nó đến mức trở thành mối đe dọa hiện hữu cho nhân loại.
"Chúng tôi thực sự tin rằng AI có thể gây ra rủi ro dẫn đến sự diệt vong của loài người. Tôi tin Anthropic đang cố gắng hết sức, nhưng chúng tôi vẫn chưa có một kế hoạch cụ thể để giải quyết vấn đề căn chỉnh (alignment) cho siêu trí tuệ và hiện tại chúng tôi vẫn chưa đi đúng hướng", Hubinger nhấn mạnh.
Bài đăng của Hubinger được đưa ra nhằm phản hồi một bài viết khác từ Jacob Coxon - một nhà nghiên cứu AI vừa rời khỏi Anthropic và trước đó từng làm việc tại OpenAI. Coxon thẳng thắn chỉ trích: "Không một công ty nào trong số này đang hành động một cách có trách nhiệm. Sớm thôi, chúng sẽ trở thành những hệ thống siêu việt có khả năng hack mọi thứ, cách mạng hóa mọi lĩnh vực chỉ trong một đêm và giành lấy quyền lực cùng tài nguyên thực sự."
Làm việc trong lĩnh vực AI alignment
Hubinger làm việc trong lĩnh vực AI alignment (căn chỉnh AI) - một nhánh nghiên cứu quan trọng nhằm xây dựng các nguyên tắc và ý tưởng đạo đức của con người vào trong công nghệ AI, với mục tiêu giữ cho AI luôn đi đúng hướng với những giá trị mà con người coi trọng.
Tuy nhiên, nhiều nhà nghiên cứu hàng đầu cho rằng những nỗ lực này dường như đang thất bại. Bằng chứng là một loạt sự cố trong mùa hè vừa qua, khi các tác nhân AI (AI agents) - hệ thống AI được phép hoạt động tự động - đã thực hiện các cuộc tấn công mạng. OpenAI, Anthropic và Meta đều công bố các vụ hack do chính công cụ AI của họ thực hiện, cho thấy mức độ phức tạp và khả năng tự chủ của công nghệ này đang vượt xa tầm kiểm soát của con người.
Báo cáo an toàn thừa nhận rủi ro
Trong báo cáo an toàn công bố vào tháng 8, chính Anthropic cũng thừa nhận có "nguy cơ thấp" về việc các mô hình của họ bị lệch hướng (misaligned), có thể dẫn đến việc AI khai thác hoặc can thiệp vào hệ thống của một tổ chức. Công ty cũng cảnh báo về khả năng AI có năng lực cao có thể "tự động thực hiện nghiên cứu và phát triển" gây ra "thiệt hại thảm khốc do AI khởi xướng".
Đáng chú ý, Anthropic cho biết họ "kém tự tin hơn" vào đánh giá này so với trước đây, đồng thời thừa nhận: "Chúng tôi đang thấy những dấu hiệu ban đầu của sự tăng tốc tiềm ẩn."
AI có thể thực sự "giết người"?
Điều đáng chú ý là Hubinger không nói rõ bằng cách nào các hệ thống AI có thể tấn công nhân loại trong tương lai. Liệu đó là thông qua việc điều khiển vũ khí, phá hoại cơ sở hạ tầng quan trọng, hay một kịch bản khoa học viễn tưởng nào khác? Câu hỏi này vẫn còn bỏ ngỏ.
Tuy nhiên, có một thực tế đáng lo ngại là việc AI tự phát triển (self-improving AI) - khả năng một hệ thống AI có thể tự nâng cấp chính nó - đang ngày càng trở nên khả thi hơn với tốc độ phát triển hiện nay.
Phản ứng từ giới chuyên môn
Giáo sư Neil Lawrence, chuyên gia về Học máy tại Đại học Cambridge, nhận định trên chương trình Today của BBC Radio 4 rằng báo cáo này là đáng tin cậy. Ông cho rằng bối cảnh này không có gì bất ngờ khi Mỹ đang coi AI là cuộc đua với Trung Quốc và có xu hướng cô lập với các đồng minh.
Những tiếng nói cảnh báo về an toàn AI đã xuất hiện từ nhiều năm, với việc lãnh đạo của OpenAI, Google DeepMind và Anthropic đều lên tiếng từ năm 2023. Nhưng những cảnh báo gần đây đã trở nên gay gắt hơn nhiều, đặc biệt khi những bằng chứng cho thấy các công ty đang gặp khó khăn trong việc kiểm soát AI.
Lời kêu gọi làm chậm quá trình phát triển AI
Đầu tháng này, Jakub Pachocki, nhà khoa học trưởng của OpenAI, đã kêu gọi "cực kỳ thận trọng" với sự tiến bộ của AI, cảnh báo cần có sự can thiệp nhiều hơn để đảm bảo "con người vẫn nắm quyền kiểm soát tương lai".
Các nhân vật lớn trong lĩnh vực AI đã liên tục kêu gọi làm chậm quá trình phát triển AI trong những tháng gần đây, bao gồm cả lãnh đạo của chính Anthropic như Dario Amodei và Jared Kaplan. Trong một lá thư ngỏ có chữ ký của 1.300 nhân viên các công ty AI, họ đã kêu gọi chính phủ Mỹ "hỗ trợ một nỗ lực quốc tế nhằm phát triển các công cụ kỹ thuật và quản trị cần thiết để cố ý điều tiết tốc độ phát triển AI tiên tiến một cách có chủ đích".
Biểu đồ về sự tăng trưởng của ngành AI
Góc nhìn cho độc giả Việt Nam
Những cảnh báo về rủi ro AI không còn là câu chuyện xa vời chỉ dành riêng cho các nước phát triển. Với tốc độ ứng dụng AI ngày càng nhanh tại Việt Nam - từ chatbot trong giáo dục, trợ lý ảo trong ngân hàng đến các hệ thống AI trong sản xuất - câu chuyện về sự minh bạch và an toàn AI đang trở nên ngày càng cấp thiết.
Việc Hiệp hội AI Quốc gia Việt Nam và các trường đại học liên tục đưa ra các khuyến nghị về phát triển AI có trách nhiệm cho thấy nhận thức về vấn đề này đã đến gần hơn. Tuy nhiên, với tình trạng thiếu khung pháp lý rõ ràng và sự thiếu hụt nhân lực chất lượng cao trong lĩnh vực an toàn AI, Việt Nam cũng đang phải đối mặt với những thách thức tương tự như phần còn lại của thế giới trong việc đảm bảo AI phát triển đúng hướng.
Văn phòng Nội các Anh từ chối bình luận về việc liệu mô hình mới nhất của Anthropic có bị giữ lại khỏi AISI hay không, thay vào đó khẳng định họ "tiếp tục hợp tác chặt chẽ với các đối tác trong ngành, bao gồm cả Anthropic, để làm cho các mô hình an toàn hơn". Với tốc độ phát triển chóng mặt của AI hiện nay, câu hỏi đặt ra là liệu các biện pháp an toàn có thể theo kịp tốc độ mà các công ty đang đẩy công nghệ tiến lên phía trước hay không.
Bài viết liên quan

Công nghệ
Nộp đơn xin việc lẽ ra nên khó hơn. Thật đấy
25 tháng 8, 2026

Công nghệ
NSA, FBI cảnh báo Trung Quốc đang 'hút cạn' công nghệ AI tiên tiến của Mỹ bằng kỹ thuật chưng cất dữ liệu
09 tháng 9, 2026

Công nghệ
Tự Tay Chế Tạo Đèn Treo Tường Thông Minh Từ Đầu: Hành Trình 8 Tháng Của Một Kỹ Sư
09 tháng 9, 2026