NSA, FBI cảnh báo Trung Quốc đang 'hút cạn' công nghệ AI tiên tiến của Mỹ bằng kỹ thuật chưng cất dữ liệu

Công nghệ09 tháng 9, 2026·6 phút đọc

Các cơ quan an ninh Mỹ gồm NSA, CISA và FBI công bố báo cáo cáo buộc các công ty AI Trung Quốc như DeepSeek, Alibaba, Moonshot AI đã có hệ thống khai thác hàng tỷ token từ các mô hình AI tiên tiến của Mỹ như Claude, GPT, Gemini và Grok thông qua kỹ thuật chưng cất (distillation). Hành vi này được đánh giá là mối đe dọa chiến lược tới vị thế dẫn đầu công nghệ của Mỹ và có thể được hậu thuẫn từ chính phủ Trung Quốc.

NSA, FBI cảnh báo Trung Quốc đang 'hút cạn' công nghệ AI tiên tiến của Mỹ bằng kỹ thuật chưng cất dữ liệu

NSA, FBI cảnh báo Trung Quốc đang 'hút cạn' công nghệ AI tiên tiến của Mỹ bằng kỹ thuật chưng cất dữ liệu

Cơ quan An ninh Quốc gia Mỹ (NSA), Cơ quan An ninh Mạng và Cơ sở hạ tầng (CISA) và Cục Điều tra Liên bang (FBI) vừa công bố một báo cáo chung cáo buộc các công ty AI hàng đầu Trung Quốc đang có hệ thống khai thác các mô hình AI tiên tiến của Mỹ thông qua kỹ thuật chưng cất (distillation) ở quy mô công nghiệp. Báo cáo chỉ ra rằng hành vi này không chỉ giúp Trung Quốc cải thiện nhanh chóng năng lực AI mà còn đe dọa trực tiếp đến lợi thế công nghệ và an ninh kinh tế của Mỹ.

Chiến dịch khai thác quy mô lớn từ các "ông lớn" AI Trung Quốc

Theo báo cáo, các công ty AI Trung Quốc gồm DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun và Z.AI được cho là đã trích xuất hàng tỷ token qua hàng triệu lượt yêu cầu từ các mô hình AI tiên tiến của Mỹ như Claude, GPT, Gemini và Grok. Quá trình này được ghi nhận diễn ra từ ít nhất là cuối năm 2024.

"Chúng tôi đánh giá rằng hoạt động này có khả năng diễn ra khi chính phủ Trung Quốc nhận thức rõ về các chiến dịch trích xuất dữ liệu này", báo cáo của ba cơ quan tình báo và an ninh Mỹ nêu rõ.

Chưng cất (distillation) được mô tả như một cuộc "tấn công" vào mô hình AI nhằm thu thập các đầu ra, hiểu quy trình suy luận và từ đó sử dụng để huấn luyện một mô hình khác.

DeepSeek – "nhân vật chính" trong chiến dịch hút dữ liệu

Báo cáo nêu chi tiết rằng trong khoảng thời gian từ cuối năm 2024 đến giữa năm 2025, DeepSeek đã thực hiện chưng cất dữ liệu huấn luyện và năng lực từ các mô hình như Claude, Gemini, GPT-4, GPT-5 và Grok 4 để phát triển các mô hình R1 và V3 của mình.

Kiến thức bị trích xuất bao gồm nhưng không giới hạn:

  • Các tác vụ điều khiển dựa trên quy tắc API
  • Chức năng agentic (tác tử AI)
  • Tối ưu hóa hỏi đáp (Q&A)
  • Tối ưu hóa tinh chỉnh có giám sát
  • Tối ưu hóa viết sáng tạo và viết chuyên nghiệp

Trong khi đó, Moonshot AI cũng được cho là đã có các cuộc chưng cất quy mô lớn tương tự, bao gồm việc trích xuất dữ liệu đáng kể từ Claude Fable 5 để cải thiện mô hình Kimi-K3 và dữ liệu từ GPT-4o để nâng cấp Kimi-K2.

Chiến thuật tinh vi, có kế hoạch và được đầu tư bài bản

Điểm đáng chú ý là báo cáo đã ánh xạ các chiến thuật, kỹ thuật và quy trình (TTPs) của các tổ chức Trung Quốc sang khung MITRE ATLAS – một khung kiến thức chuyên về các mối đe dọa đối với hệ thống AI. Các nhà phân tích mô tả toàn bộ quy trình từ phát triển tài nguyên, truy cập, thực thi, phát hiện, giai đoạn tấn công AI, thu thập, trích xuất cho đến tác động cuối cùng.

Tác động lên các nhà phát triển mô hình hàng đầu của Mỹ được mô tả là tổn hại tài chính, phá hoại lợi thế cạnh tranh, và được xem là "mối đe dọa kinh tế chiến lược đối với cạnh tranh công nghệ công bằng và vị thế dẫn đầu công nghệ của Mỹ".

Tuy nhiên, các cơ quan Mỹ cũng lưu ý rằng các công ty Trung Quốc đã sử dụng thêm các kỹ thuật bổ sung không có trong MITRE ATLAS, cho thấy đây không phải là hành vi khai thác cơ hội thông thường mà là một hành động cấp quốc gia có kế hoạch và được đầu tư nguồn lực kỹ lưỡng. Các TTPs mới này bao gồm:

  • Né tránh hạn chế khu vực và khai thác đăng ký
  • Hạ tầng định tuyến yêu cầu tập trung
  • Tự động hóa làm sạch siêu dữ liệu yêu cầu
  • Tối ưu hóa hạn mức (quota) và chi phí có hệ thống

Các biện pháp khuyến nghị dành cho hệ sinh thái AI Mỹ

Báo cáo đề xuất các biện pháp khắc phục cần được phối hợp trên toàn bộ hệ sinh thái AI rộng lớn của Mỹ, bao gồm các nhà cung cấp cloud, bên tổng hợp API và nhà cung cấp hạ tầng. Các khuyến nghị này trải dài từ các hành động phòng thủ thuần túy cho đến các phản ứng mang tính chủ động hơn.

Về phòng thủ, các cơ quan khuyến nghị áp dụng các biện pháp:

  • Phát hiện và giám sát hành vi
  • Chia sẻ thông tin về các chiến dịch chưng cất trên diện rộng
  • Áp dụng nguyên tắc differential privacy (quyền riêng tư khác biệt) bằng cách "thêm nhiễu đã hiệu chỉnh vào đầu ra mô hình, ngăn chặn các tác nhân độc hại trích xuất thông tin thành viên dữ liệu huấn luyện và các thông tin nhạy cảm khác như ranh giới quyết định hoặc tín hiệu có thể hỗ trợ tái tạo dữ liệu riêng tư"

Với các phản ứng mạnh hơn, các cơ quan còn gợi ý rằng việc "áp dụng các thay đổi có mục tiêu để đối phó với các yêu cầu chưng cất độc hại có độ tin cậy cao có thể tạo ra chi phí đáng kể cho các chiến dịch chưng cất tri thức" – một dạng phản đòn kỹ thuật nhằm gây thiệt hại cho đối phương.

Mối đe dọa không chỉ đơn thuần về công nghệ

Theo báo cáo, mục đích của tài liệu là cảnh báo tất cả các bên liên quan rằng các công ty AI Trung Quốc đang đánh cắp vị thế dẫn đầu công nghệ của Mỹ một cách có hệ thống và ở quy mô công nghiệp. Mối đe dọa không trực tiếp nhắm vào việc sử dụng AI của doanh nghiệp, mặc dù kiến thức tình báo về cách phòng thủ AI có thể phản ứng có khả năng giúp các cuộc tấn công tinh vi hơn và lẩn tránh tốt hơn trong tương lai.

Thay vào đó, mối đe dọa mang tính trực diện hơn đối với vị thế dẫn đầu công nghệ của Mỹ, kéo theo đó là nền kinh tế Mỹ và tiềm ẩn trở thành vấn đề an ninh quốc gia trong dài hạn.

Bối cảnh này cũng đặt ra câu hỏi lớn cho cộng đồng AI toàn cầu, đặc biệt là tại các quốc gia đang phát triển hệ sinh thái AI của riêng mình, về việc cần xây dựng các chiến lược bảo vệ tài sản trí tuệ và dữ liệu huấn luyện ngay từ đầu.

Các cơ quan an ninh Mỹ hợp tác điều tra về chiến dịch trích xuất AICác cơ quan an ninh Mỹ hợp tác điều tra về chiến dịch trích xuất AI

Chia sẻ:FacebookX
Nội dung tổng hợp bằng AI, mang tính tham khảo. Xem bài gốc ↗