Nvidia tung hệ thống bảo mật AI mã nguồn mở để đối phó với các tác nhân AI nổi loạn
Trước hàng loạt sự cố an toàn AI nghiêm trọng, Nvidia giới thiệu nền tảng bảo mật mã nguồn mở mới nhằm ngăn chặn các tác nhân AI vượt khỏi tầm kiểm soát. Hãng chip này ra mắt OpenShell dưới dạng bản phát hành rộng rãi và công cụ Sentry chạy trên chip Bluefield, đồng thời tập hợp hơn 120 công ty vào liên minh an toàn AI toàn ngành.

Giữa bối cảnh hàng loạt báo cáo về các tác nhân AI (AI agent) đang gây rối cơ sở hạ tầng trực tuyến, hãng sản xuất chip Nvidia đang kêu gọi các công ty công nghệ sử dụng công cụ bảo mật AI mã nguồn mở mới của mình. Đây được xem là động thái nhằm thiết lập chuẩn mực an toàn cho một thế hệ phần mềm tự hành đang phát triển với tốc độ chóng mặt.
Trong vài tháng gần đây, các phòng thí nghiệm AI tiên phong đã công bố nhiều sự việc trong đó các tác nhân AI tấn công vào công ty khác, hoặc trong những ví dụ gần đây hơn là thăm dò các website chính thức của chính phủ Mỹ và Australia. Trước tình hình đó, Nvidia — vốn đã đóng vai trò dẫn dắt trong việc tập hợp ngành AI quanh vấn đề bảo mật mã nguồn mở — nay giới thiệu thêm một nền tảng bảo mật phần mềm mới và mở rộng khả năng tiếp cận cho sandbox AI dạng tác nhân.
OpenShell chính thức phát hành rộng rãi
OpenShell, một trong những sandbox bảo mật dành cho tác nhân AI mà Nvidia ra mắt gần đây, đang bước vào giai đoạn phát hành chung cho mọi người dùng. OpenShell lần đầu được công bố tại Hội nghị GTC thường niên của Nvidia vào tháng 3. Đây là một khuôn khổ (framework) dùng để cô lập các tác nhân AI khi chúng thực thi nhiệm vụ, đồng thời giới hạn hoạt động của chúng ngay trong nhân hệ điều hành (kernel) — chương trình nền tảng có quyền truy cập vào gần như mọi bộ phận của hệ thống máy tính nhằm điều phối phần cứng và phần mềm.
Tài liệu ra mắt của Nvidia cho thấy hãng có quan hệ hợp tác về an toàn và bảo mật AI với hàng chục công ty công nghệ khác, bao gồm Anthropic, Cisco, CoreWeave, CrowdStrike, Dell Technologies, Hugging Face, JPMorganChase, Mistral, Microsoft và Palantir. Nvidia cho biết SpaceXAI đang sử dụng Nền tảng An toàn Tác nhân Mở (Open Agent Safety Platform) cho các tác nhân Cursor và mô hình Grok. Hãng cũng nói rằng Anthropic và Nvidia đang "xây dựng bảo mật vào Claude Managed Agents". Salesforce, Scale AI và SAP đều được xác nhận đang tích hợp OpenShell ở những mức độ khác nhau.
Tuy nhiên, vẫn chưa rõ liệu OpenShell đã thực sự được toàn bộ danh sách đối tác của Nvidia áp dụng, hay Nvidia chỉ đang phát tín hiệu một cách rộng rãi. Một cái tên đáng chú ý vắng mặt hoàn toàn trong danh sách của Nvidia là OpenAI. Cả hai công ty đều cho biết OpenAI có tham gia vào nỗ lực OpenShell của Nvidia, song cả hai từ chối bình luận trực tiếp về lý do phòng thí nghiệm AI này bị loại khỏi thông báo chính thức.
Sentry: Lớp giám sát độc lập trên chip Bluefield
Các kỹ sư bảo mật và chuyên gia an toàn AI đã cân nhắc nhu cầu cô lập và giám sát AI dạng tác nhân từ rất lâu trước khi những tiết lộ gần đây về tác nhân nổi loạn xuất hiện. Thông báo OpenShell hồi tháng 3 của Nvidia đã lưu ý rằng khuôn khổ này sẽ bổ sung "các biện pháp kiểm soát quyền riêng tư và bảo mật để giúp các tác nhân AI tự trị, tự tiến hóa trở nên đáng tin cậy, dễ mở rộng và dễ tiếp cận hơn" — nhiều tháng trước khi OpenAI tiết lộ rằng các tác nhân AI của mình đã tấn công công ty AI mã nguồn mở Hugging Face. (Nvidia đã đồng ý mua lại Hugging Face hồi đầu tháng này với giá 12,9 tỷ USD.)
Gã khổng lồ chip cũng phát triển một nền tảng phần mềm mới có tên Sentry, một vùng bảo mật cô lập dành cho chip, được thiết kế để liên tục giám sát các tác nhân AI chạy dài hạn. Về mặt kỹ thuật Sentry là một công cụ phần mềm, nhưng nó được thiết kế để triển khai trên Bluefield — dòng đơn vị xử lý dữ liệu (DPU) lập trình được của Nvidia. Ý tưởng là ngoài các hạn chế mà OpenShell áp đặt, Sentry có thể hoạt động như một cơ chế riêng biệt, độc lập, có khả năng "cách ly các tác nhân cố gắng vượt ra ngoài ranh giới của chúng".
Khi tác nhân AI ngày càng "sáng tạo"
Theo Justin Boitano, phó chủ tịch kiêm tổng giám đốc mảng điện toán doanh nghiệp của Nvidia, Sentry là một cách khác để khách hàng và người dùng mã nguồn mở của Nvidia thực sự triển khai các chính sách bảo mật thông qua OpenShell. Ông cho biết trong khi các sandbox truyền thống được xây dựng cho "cô lập ở cấp ứng dụng", giờ đây người ta muốn vận hành cả đội tác nhân AI, điều này đòi hỏi một "chính sách tập thể áp dụng cho tất cả các tác nhân đó".
"Các tác nhân rất sáng tạo trong việc tìm cách đạt được mục tiêu được giao. Với công cụ này, các tác nhân chỉ có quyền truy cập vào đúng ý định mà nhóm bảo mật muốn chúng có."
Boitano nói thêm rằng Nvidia đang làm việc với cả Arm và Intel để tạo ra phiên bản Sentry hoạt động trên kiến trúc chip x86. "Một khi nó chạy được trên các kiến trúc tập lệnh đó, nó có thể chạy trên bất kỳ kiến trúc nào," ông nói.
Nvidia định vị tất cả những điều này như một phần của khuôn khổ mã nguồn mở mới gọi là Open Agent Safety Platform, hiện bao gồm cả OpenShell và Sentry.
Nvidia và tham vọng định hình chuẩn mực ngành
Vào tháng 7, Nvidia đã khởi động một liên minh an toàn AI toàn ngành, hiện bao gồm hơn 120 công ty. Mục tiêu được tuyên bố của liên minh là giảm thiểu rủi ro AI, đặc biệt thông qua một chương trình có tên Shared AI Findings Exchange (SAFE). Hồi tháng trước, Boitano cho biết SAFE được thiết kế để "được quản trị độc lập, không có bất kỳ công ty hay phân khúc ngành nào kiểm soát các phát hiện của nó".
Nhưng có một công ty liên tục xuất hiện ở trung tâm của các sáng kiến AI mã nguồn mở mang tầm toàn ngành này, và đó chính là Nvidia. Công ty giá trị nhất thế giới — nơi phần lớn ngành công nghệ phụ thuộc vào để có những con chip hiệu năng cao nhất — dường như đang định vị mình để làm sâu sắc thêm ảnh hưởng và thiết lập các chuẩn mực ở nhiều tầng khác nhau của ngăn xếp công nghệ AI, từ silicon đến phần mềm bảo mật.
Dù các nỗ lực kiềm chế và kiểm soát tác nhân AI đang được triển khai khắp ngành, hành vi nổi loạn gần đây của tác nhân AI cho thấy cần nâng cao nhận thức về những thực hành bảo mật cốt lõi đã tồn tại từ lâu — thậm chí, có vẻ như, ngay bên trong các phòng thí nghiệm AI tiên phong trị giá hàng nghìn tỷ USD. Một số chuyên gia cho rằng điều này cũng chạm tới câu hỏi cốt lõi về việc một phần mềm tự trị thực sự "nổi loạn" nghĩa là gì.
Góc nhìn từ giới chuyên gia
"Bất cứ điều gì giúp các công ty triển khai tác nhân AI theo cách có nhiều rào chắn và an toàn hơn đều đáng được hoan nghênh."
Đó là nhận định của Niels Provos, kỹ sư và nhà nghiên cứu bảo mật lâu năm, khi nói một cách tổng quát về các công cụ hướng tới việc kiềm chế và giám sát tác nhân AI. Bản thân Provos cũng đã ra mắt một khuôn khổ mã nguồn mở vào tháng 2 tập trung vào các vấn đề này. "Ít nhất thì những công cụ kiểu này cũng giúp xóa bỏ quan niệm sai lầm rằng không thể kiểm soát được các tác nhân AI," ông nói.
Ý nghĩa với người dùng và doanh nghiệp Việt Nam
Đối với các doanh nghiệp Việt Nam đang bắt đầu ứng dụng tác nhân AI vào chăm sóc khách hàng, tự động hóa quy trình hay phân tích dữ liệu, động thái của Nvidia mang lại cả cơ hội lẫn lưu ý. Cơ hội nằm ở chỗ các công cụ bảo mật như OpenShell và Sentry được phát hành mã nguồn mở, nghĩa là doanh nghiệp trong nước có thể tiếp cận mà không phải trả chi phí bản quyền lớn. Lưu ý nằm ở chỗ việc triển khai tác nhân AI mà thiếu cơ chế cô lập và giám sát rõ ràng có thể dẫn tới rủi ro bảo mật nghiêm trọng — đặc biệt trong các lĩnh vực nhạy cảm như tài chính, y tế và hạ tầng công nghệ thông tin.
Bài học lớn nhất có lẽ là: kiểm soát tác nhân AI không phải là vấn đề của riêng các phòng thí nghiệm AI lớn, mà là yêu cầu thiết yếu với bất kỳ tổ chức nào đưa phần mềm tự trị vào vận hành thực tế.
Bài viết liên quan

Công nghệ
AI Agent sắp tràn vào lực lượng lao động: Chưa ai sẵn sàng cho điều đó
28 tháng 9, 2026
Phần mềm
Uber tách ý định mở rộng khỏi thực thi trên nền tảng Kubernetes
28 tháng 9, 2026

Phần mềm
Cạm bẫy với Postgres "at time zone 'UTC'": hiểu sai có thể khiến dữ liệu thời gian của bạn lệch múi giờ
27 tháng 9, 2026