CEO Anthropic đề xuất kế hoạch 'tiết chế tốc độ phát triển AI'

Công nghệ12 tháng 9, 2026·5 phút đọc

Dario Amodei, CEO của Anthropic, đã công bố ba chiến lược nhằm làm chậm tốc độ phát triển AI, bao gồm việc tự nguyện cho phép các chuyên gia đánh giá bên thứ ba tiếp cận nội bộ công ty. Ông nhấn mạnh sự cần thiết của việc phối hợp quốc tế và các tiêu chuẩn an toàn chung, trong bối cảnh tranh luận về an toàn AI đang ngày càng gay gắt.

CEO Anthropic đề xuất kế hoạch 'tiết chế tốc độ phát triển AI'

CEO Anthropic đề xuất kế hoạch 'tiết chế tốc độ phát triển AI'

Trong bối cảnh những cảnh báo ngày càng nghiêm trọng từ giới nghiên cứu về hiểm họa của trí tuệ nhân tạo, CEO Anthropic Dario Amodei vừa công bố một bài viết đề xuất ba chiến lược cụ thể để "tiết chế tốc độ phát triển AI" (pace the frontier). Đáng chú ý, ông tuyên bố Anthropic sẽ tự nguyện cam kết đơn phương thực hiện một trong những chiến lược này.

Bài viết ra đời ngay sau khi nhà nghiên cứu Jacob Coxon tuyên bố từ chức khỏi Anthropic, bày tỏ lo ngại rằng các công ty AI hàng đầu đang "đánh cược bằng mạng sống của chúng ta" trong khi chính những người xây dựng công nghệ này "tin rằng nó có thể giết chết tất cả chúng ta vào cuối thập kỷ". Những tuyên bố tương tự cũng được một số nhân viên khác tại Anthropic lặp lại.

Ba trụ cột trong kế hoạch của Amodei

Mặc dù không đề cập trực tiếp đến vụ từ chức của Coxon, Amodei cho biết hai sự kiện đã thuyết phục ông rằng đã đến lúc phải tiếp cận AI một cách thận trọng hơn: vụ hack OpenAI-HuggingFace, và thực tế rằng "AI đang tiến bộ nhanh chóng một cách đáng kinh ngạc" trong những tháng gần đây, đặc biệt là với "khả năng ngày càng tăng trong việc tự xây dựng thế hệ AI tiếp theo".

"Chúng ta phải làm chậm tốc độ cải thiện năng lực của các mô hình AI. Tiến bộ vẫn sẽ có vẻ nhanh, và chúng ta phải sử dụng khôn ngoan khoảng thời gian mà mình có được."

1. Chuyên gia đánh giá nhúng (Embedded Evaluators)

Bước đầu tiên mà Amodei đề xuất là mời các chuyên gia đánh giá nhúng từ các tổ chức bên thứ ba như METR vào làm việc trực tiếp trong công ty. Những người này sẽ xác minh rằng các công ty AI thực sự tuân thủ cam kết về tốc độ phát triển và an toàn, đồng thời đảm bảo các sự cố an toàn được báo cáo đầy đủ.

Ông so sánh những chuyên gia này với các thanh tra viên từng được nhúng vào đội ngũ nhân viên ngân hàng. Anthropic cam kết sẽ cấp cho họ thẻ ra vào, bàn làm việc, máy tính xách tay và quyền truy cập "tương đương với những gì các nhóm đánh giá rủi ro nội bộ có", ngoại trừ các trường hợp bị giới hạn bởi luật pháp hoặc hợp đồng.

Amodei cũng kêu gọi chính phủ yêu cầu các công ty AI tiên phong khác thực hiện điều tương tự.

2. Tiêu chuẩn an toàn chung giữa các công ty

Chiến lược thứ hai là kêu gọi các công ty AI hàng đầu "trong các quốc gia dân chủ" phối hợp xây dựng tiêu chuẩn an toàn chung cũng như giới hạn tốc độ phát triển AI không kiểm soát.

Amodei thừa nhận lo ngại rằng sự phối hợp như vậy có thể dẫn đến sự giám sát của cơ quan chống độc quyền. Ông đề xuất chính phủ Mỹ nên đóng vai trò trung gian hoặc ít nhất là tạo điều kiện cho các cuộc thảo luận này, thông qua một "miễn trừ hẹp" cho các cuộc trao đổi về an toàn.

3. Phối hợp toàn cầu, bao gồm cả Trung Quốc

Cuối cùng, Amodei kêu gọi phối hợp toàn cầu, trong đó Mỹ và các đồng minh "cố gắng phối hợp với các chính phủ độc tài, trong chừng mực có thể". Ông thừa nhận điều này đồng nghĩa với "hợp tác với Trung Quốc" và có "những giới hạn rõ ràng về những gì có thể đạt được".

Tuy nhiên, ông vẫn cho rằng có thể có cơ hội đạt được đồng thuận, ngay cả khi chỉ là "cấm một số ứng dụng hẹp và rõ ràng nguy hiểm của AI, chẳng hạn như sử dụng AI để sản xuất vũ khí sinh học".

Tranh cãi về 'nỗi sợ AI'

Với quan điểm sẵn sàng thừa nhận những nguy hiểm tiềm tàng của AI, Amodei đã bị một số người ủng hộ AI chỉ trích là "người bi quan" (doomer) với những phát ngôn góp phần tạo ra làn sóng phản đối AI hiện nay. Đáp lại, ông cho rằng mình đã cố gắng đưa ra góc nhìn "cân bằng" và lập luận rằng làn sóng phản đối này "về cơ bản là một cuộc khủng hoảng niềm tin".

Trong khi đó, các nhà phê bình trong ngành lại tỏ ra hoài nghi về những cảnh báo mang tính tận thế này, cho rằng chúng đánh lạc hướng khỏi những tác hại mà công nghệ đã và đang gây ra. Nhà báo Brian Merchant nhận xét rằng ông chưa từng thấy "tài liệu từng bước đáng tin cậy nào giải thích chính xác cách AI có thể chuyển từ tự cải thiện sang tiêu diệt toàn bộ loài người", và cho rằng các đề xuất tương tự của Amodei "có khả năng chỉ phục vụ lợi ích của Anthropic và OpenAI — đó là hình ảnh của sự chiếm đoạt quy định".

Bất chấp những chỉ trích, Amodei khẳng định ông vẫn "tin rằng AI có thể cải thiện to lớn chất lượng cuộc sống con người".

"Khát vọng đạt được những lợi ích này của tôi không hề suy giảm. Nhưng những lợi ích đó chỉ có thể đạt được nếu chúng ta xây dựng công nghệ theo đúng cách, và — miễn là chúng ta sử dụng tốt khoảng thời gian có được — việc đặc biệt thận trọng để làm đúng là điều đáng giá."

Chia sẻ:FacebookX
Nội dung tổng hợp bằng AI, mang tính tham khảo. Xem bài gốc ↗