ASCII smuggling không chỉ là rủi ro bảo mật AI: Thủ đoạn mới trong lừa đảo qua email
Microsoft phát hiện chiến dịch phishing quy mô lớn sử dụng ký tự Unicode vô hình để né tránh bộ lọc nội dung, đạt đỉnh 2,37 triệu email/ngày. Thủ đoạn ASCII smuggling vốn dùng để tấn công AI nay đã được kẻ gian chuyển hướng sang lừa đảo truyền thống, đặt ra thách thức mới cho các nhà bảo mật.

Các chuyên gia bảo mật của Microsoft vừa công bố phát hiện một chiến dịch lừa đảo qua email quy mô lớn sử dụng kỹ thuật ASCII smuggling — vốn nổi tiếng trong giới tấn công AI — để né tránh các bộ lọc nội dung truyền thống. Thủ đoạn này cho thấy các kỹ thuật tấn công mới trong nghiên cứu AI có thể nhanh chóng lan sang các hệ sinh thái tội phạm mạng lâu đời.
ASCII smuggling là gì?
ASCII smuggling là kỹ thuật sử dụng các ký tự Unicode vô hình hoặc không hiển thị để giấu nội dung bên trong văn bản trông hoàn toàn bình thường với con người. Trong lĩnh vực AI, kỹ thuật này thường được dùng cho tấn công prompt injection gián tiếp — kẻ tấn công giấu các chỉ dẫn độc hại vào trong các ký tự vô hình trên trang web hoặc tài liệu, khiến mô hình AI đọc được nhưng con người không hề hay biết.
Tuy nhiên, điều bất ngờ trong chiến dịch lần này là không có bất kỳ chỉ dẫn ẩn nào dành cho trợ lý AI.
Chiến dịch lừa đảo sử dụng ký tự Unicode tag
Theo các nhà nghiên cứu Noam Kochavi và Sarah Wolstencroft của Microsoft, tội phạm mạng đã dùng các ký tự tag Unicode vô hình (ví dụ U+E0020) chèn vào giữa các chữ cái trong các từ khóa tài chính như "funding", biến chúng thành "fun⟨U+E0020⟩ding". Mục đích là đánh lừa các hệ thống lọc nội dung dựa trên từ khóa hoặc so khớp chính xác (keyword matching).
"Khi chúng tôi kiểm tra mẫu các email bị đánh dấu, điều ngạc nhiên là không có chỉ dẫn ẩn nào cho trợ lý AI — thay vào đó, các ký tự tag vô hình được chèn vào bên trong các từ khóa tài chính phổ biến", hai chuyên gia viết trong blog ngày thứ Năm.
Quy mô và đặc điểm hoạt động
- Chiến dịch bắt đầu được phát hiện vào đầu tháng 2, chỉ với khoảng 21.000 email
- Con số tăng vọt lên hơn 1,3 triệu email chỉ sau một ngày
- Đạt đỉnh 2,37 triệu tin nhắn vào ngày 26 tháng 2
- Hoạt động mạnh vào các ngày trong tuần, im lặng hoàn toàn vào cuối tuần
- Phần lớn email đến từ khoảng 150 tên miền giả mạo chủ đề tài chính
- Giảm dần sau ngày 15 tháng 5, tiếp tục hoạt động nhỏ lẻ đến giữa tháng 6
Khuyến nghị cho các nhà bảo vệ
Microsoft nhấn mạnh việc chuẩn hóa và xử lý tokenization (tách token) phải được kiểm tra kỹ lưỡng để хử lý nhất quán các khối ký tự tag Unicode. Cụ thể:
- Loại bỏ hoặc làm phẳng các ký tự Unicode vô hình trước khi nội dung được đánh giá bằng logic từ khóa, chữ ký hoặc regex
- Quét các chỉ số hành vi: khối lượng lớn từ các tên miền tài chính luân phiên, hoạt động theo lịch tuần làm/ngày nghỉ rõ rệt là dấu hiệu nhận biết có độ tin cậy cao
Đáng chú ý, biện pháp kiểm soát này cũng giúp giảm thiểu rủi ro ASCII smuggling nhắm vào các trợ lý AI khi chúng xử lý nội dung email.
Bài học cho người dùng Việt Nam
Tại Việt Nam, nơi email vẫn là kênh giao dịch phổ biến trong doanh nghiệp và các tổ chức tài chính, người dùng cần đặc biệt thận trọng với các email có chủ đề tài chính, ngân hàng. Không nên chỉ dựa vào cảm quan để phát hiện lừa đảo — hãy luôn kiểm tra kỹ địa chỉ người gửi, tránh nhấp vào đường dẫn lạ và cập nhật hệ thống email doanh nghiệp với các bộ lọc bảo mật hiện đại có khả năng phát hiện ký tự Unicode bất thường.
Sự kiện này một lần nữa cho thấy không có ranh giới rõ ràng giữa an ninh AI và an ninh mạng truyền thống — các kỹ thuật mới nhất luôn có thể bị khai thác theo những cách không ngờ tới.