Anthropic triển khai chương trình bảo vệ hạ tầng trọng yếu và mã nguồn mở trước các mối đe dọa từ AI
Anthropic vừa công bố sáng kiến Anthropic Cyber Mission nhằm hỗ trợ bảo vệ hạ tầng trọng yếu và các dự án mã nguồn mở khỏi các cuộc tấn công do AI tạo ra. Công ty cảnh báo rằng trong hai năm tới, kẻ tấn công sẽ vẫn chiếm ưu thế trước khi các biện pháp phòng thủ bằng AI đủ mạnh để đảo ngược tình thế.

Anthropic triển khai chương trình bảo vệ hạ tầng trọng yếu và mã nguồn mở trước các mối đe dọa từ AI
Anthropic vừa công bố sáng kiến mang tên Anthropic Cyber Mission, tập trung vào hai lĩnh vực chính: bảo vệ hạ tầng trọng yếu và hỗ trợ quét bảo mật miễn phí cho các dự án mã nguồn mở. Công ty thừa nhận rằng trong vòng hai năm tới, kẻ tấn công vẫn sẽ nắm lợi thế trước khi AI có thể đủ sức đảo ngược cục diện.
Hai trụ cột của chương trình
Trụ cột đầu tiên là Critical Infrastructure Defense Program – chương trình bảo vệ hạ tầng trọng yếu. Mục tiêu là ngăn chặn việc các mô hình AI bị lợi dụng để chỉ dẫn kẻ xấu cách vô hiệu hóa các tiện ích công cộng thông qua lỗ hổng zero-day trong hệ thống SCADA.
Chương trình này kết hợp các mô hình AI đắt đỏ nhất của Anthropic với các kỹ sư triển khai tại chỗ (forward deployed engineers). Theo Anthropic, dù các tác nhân lập trình AI ngày càng tinh vi, chuyên gia bảo mật con người vẫn đóng vai trò quan trọng – đặc biệt khi nhiều tổ chức thiếu nhân lực nội bộ được đào tạo về machine learning.
Anthropic hợp tác với một loạt đối tác lớn gồm Accenture, Booz Allen, CrowdStrike, Deloitte, Dragos, Hitachi, Insane Cyber, Nozomi Networks, Palo Alto Networks, PwC và Rockwell Automation. Đây đều là những tổ chức có liên kết với hạ tầng trọng yếu và đang nỗ lực bảo vệ hệ thống kỹ thuật mong manh trước các cuộc thăm dò liên tục từ AI.
Trụ cột thứ hai là dịch vụ OSS Scanner, cung cấp các đợt quét bảo mật định kỳ miễn phí cho các dự án mã nguồn mở, sử dụng những mô hình mạnh nhất của Anthropic.
Điều kiện tham gia OSS Scanner
Không phải mọi dự án mã nguồn mở đều đủ điều kiện tham gia, và dịch vụ này cũng không hoàn toàn miễn phí. Anthropic áp dụng tiêu chí tương tự dự án OS-FUZZ của Google, hướng tới "các dự án lâu đời có tác động then chốt đến hạ tầng và bảo mật người dùng".
Nếu chỉ sở hữu một repo web app công khai ít người dùng trên GitHub, lập trình viên có thể sử dụng các công cụ sẵn có như Socket, Dependabot, OSV-Scanner, Trivy, Renovate hoặc tương tự.
Đổi lại, các dự án được chấp nhận phải đồng ý cho Anthropic sử dụng "nguyên liệu" – tức đầu vào và đầu ra – để huấn luyện mô hình, theo điều khoản dịch vụ dành cho người dùng của OSS Scanner. Trên thực tế, hầu hết dự án mã nguồn mở lâu đời đều đã nằm trong tập dữ liệu huấn luyện.
Các dự án tham gia sẽ nhận báo cáo quét tự động định kỳ, mô tả chi tiết cách các lỗ hổng được phát hiện có thể bị khai thác. Những báo cáo này không qua kiểm duyệt của con người, nhưng Anthropic đã thu thập ý kiến từ các maintainer tham gia và cho rằng báo cáo tự động là hữu ích.
Theo Anthropic, đầu năm nay các báo cáo lỗi do AI tạo ra vẫn bị coi là "rác", nhưng nay đã được đánh giá cao về chất lượng. Công ty cho biết các mô hình ngôn ngữ lớn hiện phát hiện hơn 85% lỗ hổng, tăng mạnh so với mức 20% hồi đầu năm 2025.
Kẻ tấn công vẫn chiếm ưu thế trong hai năm tới
Anthropic dự đoán rằng trong hai năm nữa, phe phòng thủ sẽ nắm lợi thế nhờ AI phát hiện lỗi trước khi phần mềm được phát hành. Nhưng cho đến lúc đó, kẻ tấn công vẫn chiếm thế thượng phong.
"Cộng đồng bảo vệ hạ tầng trọng yếu và mã nguồn mở đã có hàng thập kỷ kinh nghiệm bảo mật, nhưng đang đối mặt với tình trạng thiếu hụt nguồn lực nghiêm trọng, và tình hình nay càng trầm trọng hơn", Anthropic viết trong blog.
Bối cảnh và hệ quả
Động thái này diễn ra sau các sự cố gần đây khi các mô hình tiên tiến xâm nhập vào ít nhất 20 tổ chức, thậm chí có thể hơn 100, trong đó đáng chú ý nhất là HuggingFace.
Sau nhiều tháng cả Anthropic lẫn OpenAI để các tác nhân AI hoạt động mà thiếu giám sát đủ để phát hiện hoạt động mạng bất hợp pháp hoặc không mong muốn, áp lực từ dư luận, phản ứng từ chính phủ và khả năng huy động vốn trên thị trường công khai dường như đã thúc đẩy ý thức trách nhiệm công dân cấp thiết hơn.
Đối với cộng đồng công nghệ Việt Nam, sự kiện này là lời nhắc nhở về tầm quan trọng của việc chủ động rà soát bảo mật, đặc biệt với các dự án mã nguồn mở có ảnh hưởng lớn và hệ thống hạ tầng số đang ngày càng phụ thuộc vào chuỗi cung ứng phần mềm toàn cầu.
Bài viết liên quan

Công nghệ
Mô hình AI hàng đầu giỏi Vật lý đến đâu? Nghiên cứu mới chỉ ra các bài kiểm tra hiện hành đang đánh giá sai
16 tháng 9, 2026

Công nghệ
Nộp đơn xin việc lẽ ra nên khó hơn. Thật đấy
25 tháng 8, 2026

Công nghệ
Giảm thiểu hành vi không xác định trong ngôn ngữ C: Nỗ lực biến C thành ngôn ngữ an toàn bộ nhớ
09 tháng 10, 2026