CEO Anthropic Cảnh Báo: Ngành AI Cần Chậm Lại Để Các Biện Pháp An Toàn Bắt Kịp
Dario Amodei, CEO của Anthropic, kêu gọi ngành trí tuệ nhân tạo giảm tốc độ phát triển để các biện pháp an toàn có thời gian theo kịp. Ông cảnh báo chỉ trong 6 đến 12 tháng nữa, AI có thể đủ sức dẫn dắt một bầy agent chiếm quyền kiểm soát toàn bộ internet.

CEO Anthropic Cảnh Báo: Ngành AI Cần Chậm Lại Để Các Biện Pháp An Toàn Bắt Kịp
Anthropic CEO Dario Amodei cảnh báo về rủi ro AI
CEO của Anthropic, ông Dario Amodei, vừa lên tiếng kêu gọi ngành trí tuệ nhân tạo (AI) cần giảm tốc độ phát triển để các biện pháp an toàn có thời gian bắt kịp. Theo ông, nếu không có sự chậm lại cần thiết, chỉ trong vòng 6 đến 12 tháng tới, AI có thể đủ khả năng dẫn dắt một bầy tác tử (agent) và chiếm quyền kiểm soát toàn bộ internet.
Cảnh báo này xuất hiện trong bối cảnh lo ngại về AI ngày càng gia tăng cả trong lẫn ngoài ngành. Nhiều báo cáo liên tục cho thấy các hệ thống ngày càng mạnh có thể giải quyết những bài toán vượt xa khả năng con người, nhưng cũng có thể "vượt khỏi tầm kiểm soát" và thực hiện những nhiệm vụ gây hại.
Áp lực đè nặng lên ngành AI
Amodei là một trong những tiếng nói hàng đầu trong lĩnh vực AI. Ông đã công bố một kế hoạch trên trang web cá nhân nhằm tăng cường các cơ chế kiểm tra đối với ngành này. Theo ông, Anthropic đã tự mình triển khai một phần trong kế hoạch, trong khi các phần còn lại đòi hỏi sự phối hợp rộng khắp trong ngành và với chính phủ các nước trên thế giới, kể cả những quốc gia độc tài.
"Tôi tin rằng nếu việc chậm lại giúp chúng ta có thêm một hoặc hai năm trước khi các mô hình đạt đến mức năng lực tới hạn, và chúng ta dùng khoảng thời gian đó để thúc đẩy căn chỉnh (alignment), chúng ta có thể giảm đáng kể nguy cơ xảy ra điều gì đó nghiêm trọng", Amodei nói.
Các tổ chức giám sát đã nhiều năm kêu gọi ngành AI giảm tốc độ phát triển vì lý do an toàn. Nhưng áp lực chỉ thực sự gia tăng khi nhân viên trong ngành đồng loạt từ chức và cáo buộc công ty của họ không hành động có trách nhiệm.
Joe Benton, cựu nhân viên Anthropic thuộc nhóm nghiên cứu an toàn, viết trong thông báo từ chức hôm thứ Sáu: "Nhiều người tôi biết làm nghiên cứu an toàn tại các công ty AI muốn làm điều đúng đắn cho thế giới. Nhưng họ cảm thấy công ty mình bị mắc kẹt trong cuộc đua xây dựng siêu trí tuệ: hoặc dừng lại và để người khác kém tận tâm hơn thay thế, hoặc tiếp tục và tự mình gánh rủi ro gây tổn hại to lớn."
Trước đó trong tuần, Jacob Coxon cũng từ chức với tuyên bố rằng cả Anthropic và OpenAI "đang lao thẳng vào siêu trí tuệ tự cải thiện và đánh cược bằng mạng sống của chúng ta".
Những mối đe dọa từ AI đã hiện hữu
Không chỉ là lo ngại lý thuyết. Anthropic cho biết hai ngày trước đó họ đã ngăn chặn các nỗ lực của kẻ xấu nhằm sử dụng mô hình AI của mình cho hoạt động độc hại như tấn công mạng, giám sát và nghiên cứu có thể dẫn tới vũ khí sinh học. Vào tháng 7, OpenAI gây chấn động ngành khi thông báo hệ thống AI của họ tự tấn công vào một công ty khác trong "một sự cố an ninh mạng chưa từng có tiền lệ".
Cao ủy Nhân quyền Liên Hợp Quốc, ông Volker Türk, cũng hối thúc các quốc gia đưa ra "những bảo đảm vững chắc về an toàn và bảo mật cho AI trước khi quá muộn".
Tuy nhiên, vẫn có những ý kiến chỉ trích cho rằng các cảnh báo này chỉ nhằm thổi phồng sự hứng thú đối với ngành AI và năng lực của nó. Cả Anthropic lẫn OpenAI đều đang chuẩn bị cho khả năng niêm yết trên thị trường chứng khoán với định giá có thể lên tới hàng trăm tỷ đô la.
Không chỉ riêng Anthropic lo ngại
CEO OpenAI Sam Altman cho biết trong một phỏng vấn với Fortune rằng công ty sẽ không tiến hành IPO trong năm nay. "Tôi cho rằng sẽ không phải năm 2026. Chúng tôi còn nhiều việc phải làm, như đáp ứng thời điểm này về những gì cần thiết cho an toàn và căn chỉnh, cũng như cách ngành và chính phủ có thể phối hợp với nhau."
Ngay sau khi Amodei công bố đề xuất của mình, Altman đăng trên X rằng OpenAI sẽ cam kết thực hiện một trong các đề xuất an toàn của Amodei và sẽ "sớm chia sẻ thêm". Tỷ phú Elon Musk cũng lên tiếng: "Dario nói đúng."
Ba đề xuất chính và những trở ngại
Amodei nhấn mạnh rằng bản thân ông vẫn tin vào những lợi ích to lớn mà AI có thể mang lại, chẳng hạn như phương pháp chữa trị các bệnh nan y. Nhưng ông thừa nhận đã lo ngại hơn trong vài tháng gần đây về khả năng AI tự cải thiện và xây dựng thế hệ AI tiếp theo.
"Nếu không được kiểm soát, nó có thể vượt qua khả năng hiểu và kiểm soát của chúng ta, vì vậy phải được theo đuổi hết sức thận trọng, nếu có thể."
Để kiềm chế rủi ro, ông đề xuất ba biện pháp chính:
- Trao quyền truy cập thường xuyên cho đánh giá viên bên ngoài: Tất cả công ty ở tuyến đầu AI cam kết cho một nhóm đánh giá viên độc lập quyền truy cập "liên tục, như nhân viên" để giám sát hoạt động an toàn. Anthropic dự định cấp cả bàn làm việc trong văn phòng, thẻ ra vào và laptop công ty cho nhóm này.
- Miễn trừ luật chống độc quyền: Đề nghị chính phủ Mỹ có thể ban hành các miễn trừ cho phép các công ty AI nước này phối hợp và thiết lập tiêu chuẩn an toàn mà không vi phạm luật chống độc quyền.
- Phối hợp quốc tế: Kêu gọi chính phủ Mỹ và các nền dân chủ khác tìm cách phối hợp với các chính phủ độc tài, để các công ty từ Trung Quốc và các nước khác không tăng tốc khi đối thủ Mỹ chủ động giảm tốc.
"Tôi thừa nhận những biện pháp tôi đề xuất để tiến lên tuyến đầu với tốc độ an toàn sẽ không dễ thực hiện. Nhưng tôi tin chúng ta nợ nhân loại một nỗ lực như vậy", Amodei khẳng định.
Góc nhìn cho Việt Nam
Những diễn biến này đáng chú ý với cộng đồng công nghệ Việt Nam, khi các doanh nghiệp và startup trong nước ngày càng ứng dụng AI vào sản phẩm, dịch vụ. Việc các "ông lớn" toàn cầu như Anthropic và OpenAI công khai thừa nhận rủi ro và chủ động chậm lại cho thấy an toàn AI không còn là câu chuyện xa vời mà là yêu cầu cấp thiết.
Đối với các tổ chức tại Việt Nam đang triển khai AI, bài học rút ra là cần xây dựng quy trình kiểm soát, đánh giá rủi ro và cơ chế giám sát ngay từ đầu — đặc biệt khi AI agent tự động ngày càng được sử dụng rộng rãi. Việc coi các tác tử tự trị như những "danh tính có đặc quyền cao" trong hệ thống bảo mật là cách tiếp cận mà các chuyên gia khuyến nghị, nhằm ngăn chặn hậu quả khó lường trước khi quá muộn.

