Anthropic tái cấu trúc chương trình bảo mật thành mô hình ba tầng

Công nghệ06 tháng 10, 2026·5 phút đọc

Anthropic đã hợp nhất Project Glasswing và Cyber Verification Program thành một chương trình bảo mật mở rộng với ba tầng truy cập khác nhau. Công ty tuyên bố các đối tác đã phát hiện hơn 129.000 lỗ hổng được xác minh trong giai đoạn từ tháng 4 đến tháng 7/2026, nhưng tỷ lệ vá lỗi thực tế vẫn còn rất thấp.

Anthropic tái cấu trúc chương trình bảo mật thành mô hình ba tầng

Anthropic tái cấu trúc chương trình bảo mật thành mô hình ba tầng

Anthropic vừa công bố hợp nhất hai chương trình bảo mật của mình — Project Glasswing và Cyber Verification Program (CVP) — thành một chương trình duy nhất với ba tầng truy cập khác nhau. Động thái này diễn ra chỉ một tuần sau khi công ty lên tiếng cảnh báo về khả năng an ninh mạng của mô hình GLM-5.3 đến từ đối thủ Z.ai.

Theo Anthropic, chương trình mới được thiết kế để mở rộng quyền truy cập cho các tổ chức bảo mật, giúp họ có được những năng lực cần thiết nhằm bảo vệ hệ thống của mình. Công ty cho biết mục tiêu là gắn kết chặt chẽ hơn giữa khả năng của mô hình và từng nhiệm vụ cụ thể.

Ba tầng truy cập mới

Chương trình được chia thành ba tầng riêng biệt:

  • Defense Access — Dành cho các đội ngũ bảo mật tại doanh nghiệp, tổ chức phi lợi nhuận, trường đại học và cơ quan chính phủ tập trung vào việc phòng thủ hệ thống. Ở tầng này, Claude Opus 5.5 bị từ chối trong 46 trên tổng số 50 lần thử nghiệm và chỉ thành công 4 lần.
  • Red Team Access — Dành cho hoạt động kiểm thử xâm nhập và đánh giá tấn công mạng. Người tham gia vẫn sẽ gặp phải sự từ chối của mô hình đối với những tương tác có thể gây tổn hại về thể chất hoặc gây gián đoạn diện rộng. Claude Opus 5.5 hoàn thành 34 trong số 50 nhiệm vụ khi bật các biện pháp bảo vệ của tầng này.
  • Specialized Access — Đây được xem như phiên bản đổi tên của Project Glasswing. Tầng này được dành riêng cho một nhóm hạn chế các tổ chức đã được xác minh, có thẩm quyền kiểm thử những hệ thống an toàn có thể ảnh hưởng đến tính mạng con người hoặc gây xáo trộn thị trường, chẳng hạn như hệ thống điều hành bay, lưới điện, mạng viễn thông, hạ tầng chuyển tiền liên ngân hàng và mạng hành chính chính phủ.

Con số ấn tượng nhưng khoảng cách vá lỗi còn lớn

Anthropic tuyên bố chương trình bảo mật của mình đã giúp các đối tác phát hiện ít nhất 129.000 lỗ hổng phần mềm được xác minh trong khoảng thời gian từ tháng 4 đến tháng 7/2026. Ngoài ra, các nỗ lực quét mã nguồn mở của chính công ty cũng tìm thêm 5.500 lỗ hổng được xác minh từ tháng 4 đến tháng 10.

"Trong số các lỗ hổng đã được xác minh này, hơn 33.000 lỗ hổng đã được đánh giá ở mức độ nghiêm trọng cao hoặc tới hạn. Đây có thể vẫn là con số thấp hơn thực tế, vì nó dựa trên dữ liệu khảo sát từ chỉ một phần các đối tác Glasswing. Do đó, chúng tôi kỳ vọng tác động thực sự sẽ cao hơn ít nhất năm lần." — Anthropic cho biết.

Tuy nhiên, câu hỏi đáng quan tâm hơn là khi nào những lỗ hổng này sẽ được vá. Số liệu của chính Anthropic cho thấy trong số 5.674 lỗ hổng dương tính thật, có 3.014 lỗ hổng mức độ nghiêm trọng cao và 1.522 lỗ hổng mức tới hạn — nhưng chỉ có 516 lỗ hổng đã được vá.

Điều này cho thấy khoảng cách đáng kể giữa việc phát hiện và khắc phục. Dù ngành công nghiệp thường xuyên ca ngợi năng lực an ninh mạng của các mô hình AI, việc tạo ra bản vá, kiểm thử và triển khai lẽ ra phải gần như tự động ở thời điểm hiện tại. Nhưng thực tế cho thấy vẫn còn nhiều điểm nghẽn cần được giải quyết.

Bối cảnh và những hoài nghi

Project Glasswing và CVP ra mắt vào tháng 4/2026, cùng thời điểm với sự xuất hiện của Mythos — mô hình tiên tiến được Anthropic quảng bá mạnh mẽ. Project Glasswing cho phép các đối tác truy cập sớm vào Mythos để rà soát lỗ hổng trong hệ thống trước khi kẻ tấn công kịp khai thác.

Tuy nhiên, không phải ai cũng bị thuyết phục. Nhà nghiên cứu Patrick Garrity của VulnCheck tỏ ra không mấy ấn tượng với các CVE được Project Glasswing phát hiện. Ông lưu ý rằng chưa đến 0,5% trong số 225 lỗ hổng liên quan đến Anthropic mà ông theo dõi đang bị khai thác thực tế trên môi trường thật.

Bên cạnh đó, cảnh báo của chính Anthropic hồi tháng trước về những rủi ro từ GLM-5.3 phần nào làm suy yếu lập luận rằng mô hình Mythos của họ có điều gì đó thực sự đặc biệt.

Vấn đề lưu trữ dữ liệu

Trong khoảng một đến hai tháng tới, người tham gia chương trình sẽ cần cho phép Anthropic lưu trữ dữ liệu của họ như một phần trong các yêu cầu về an toàn AI. Sau đó, chương trình Enterprise Frontier Safeguards của công ty sẽ cung cấp tùy chọn không lưu trữ dữ liệu. Những tổ chức đã được cấp quyền không lưu trữ dữ liệu khi sử dụng Claude Fable 5.1 hoặc Claude Mythos 5.1 có thể tham gia CVP với các điều khoản tương tự.

Đối với các doanh nghiệp và tổ chức tại Việt Nam đang quan tâm đến việc ứng dụng AI trong an ninh mạng, động thái này của Anthropic phản ánh một xu hướng rõ ràng: các nhà cung cấp AI đang ngày càng phân tầng quyền truy cập dựa trên mức độ nhạy cảm của nhiệm vụ, đồng thời siết chặt hơn các yêu cầu về minh bạch dữ liệu. Đây là điều mà các đội ngũ bảo mật cần cân nhắc khi lựa chọn nền tảng AI cho hoạt động kiểm thử và phòng thủ của mình.

Chia sẻ:FacebookX
Nội dung tổng hợp bằng AI, mang tính tham khảo. Xem bài gốc ↗