Meta triển khai AI mới để phát hiện quảng cáo dẫn tới nội dung lạm dụng trẻ em

07 tháng 10, 2026·4 phút đọc

Meta ra mắt các công cụ AI mới nhằm phát hiện những quảng cáo trông có vẻ bình thường nhưng lại dẫn người dùng tới nội dung lạm dụng trẻ em ở nơi khác trên mạng. Trong nửa đầu năm 2026, công ty đã xử lý 33,2 triệu nội dung lạm dụng tình dục trẻ em trên Facebook và Instagram, với hơn 97% được phát hiện tự động trước khi người dùng báo cáo.

Meta triển khai AI mới để phát hiện quảng cáo dẫn tới nội dung lạm dụng trẻ em

Meta vừa công bố một loạt công cụ trí tuệ nhân tạo mới nhằm ngăn chặn các quảng cáo trông có vẻ vô hại nhưng thực chất lại dẫn người dùng tới nội dung lạm dụng tình dục trẻ em ở những nơi khác trên mạng. Động thái này diễn ra trong bối cảnh công ty tiếp tục chịu áp lực lớn về vấn đề an toàn cho trẻ em trên các nền tảng của mình.

Xử lý hàng chục triệu nội dung vi phạm

Theo thông báo ngày thứ Tư, Meta cho biết đã xử lý 33,2 triệu nội dung lạm dụng tình dục trẻ em trên Facebook và Instagram trong nửa đầu năm 2026. Đáng chú ý, hơn 97% trong số này được hệ thống của công ty phát hiện trước khi người dùng báo cáo.

Tại Ấn Độ — một trong những thị trường lớn nhất của Meta — con số này là 5,3 triệu nội dung, với tỷ lệ phát hiện tự động lên tới hơn 98%. Những con số này cho thấy các hệ thống kiểm duyệt tự động đang đóng vai trò ngày càng quan trọng trong việc xử lý nội dung độc hại ở quy mô lớn.

"Signposting" — chiêu trò mới của kẻ xấu

Trọng tâm của các công cụ AI mới là phát hiện hiện tượng mà Meta gọi là "signposting" (đặt biển chỉ dẫn). Đây là thủ đoạn sử dụng những quảng cáo trông hoàn toàn bình thường nhưng thực chất lại ngầm dẫn người dùng tới nội dung bất hợp pháp hoặc các hoạt động gây hại ở nơi khác trên mạng.

Bản thân quảng cáo có thể không chứa tài liệu bất hợp pháp, nhưng chúng vẫn có thể hoạt động như một cửa ngõ dẫn tới các website lưu trữ tài liệu lạm dụng tình dục trẻ em.

Để đối phó, Meta cho biết đã phát triển một hệ thống mô hình ngôn ngữ lớn (LLM) chuyên phân tích điểm đến của quảng cáo. Thay vì chỉ kiểm tra nội dung quảng cáo, công ty giờ đây còn xem xét nơi quảng cáo dẫn người dùng tới. Từ đó, Meta có thể chặn các website hoặc điểm đến vi phạm quy định, đồng thời xử lý cả những tài khoản đứng sau.

Các lớp bảo vệ bổ sung

Bên cạnh hệ thống phát hiện signposting, Meta còn triển khai thêm nhiều biện pháp khác:

  • Quét nội dung bằng AI nhằm tìm ra tài liệu bóc lột trẻ em mà các hệ thống trước đây có thể đã bỏ sót. Công ty cho biết sẽ liên tục bổ sung tín hiệu nhận diện mới khi hiểu rõ hơn cách các mạng lưới này vận hành.
  • "Red-teaming AI agent" — một công cụ AI chuyên kiểm thử chính các biện pháp an toàn của Meta, tìm ra lỗ hổng mà kẻ xấu có thể lợi dụng để lách qua hệ thống bảo vệ. Meta kỳ vọng công cụ này giúp phát hiện các phương thức lạm dụng mới trước khi chúng trở nên phổ biến.
  • Cải thiện hệ thống phát hiện những người quay lại nền tảng bằng tài khoản mới sau khi tài khoản cũ đã bị xóa.

Áp lực ngày càng lớn về an toàn trẻ em

Các biện pháp mới ra đời trong bối cảnh Meta liên tục đối mặt với chỉ trích và các vụ kiện về an toàn của trẻ em trên nền tảng. Hồi tháng 8, công ty đã đạt thỏa thuận chi trả tới 18 tỷ USD để dàn xếp một vụ kiện liên quan tới an toàn trẻ em với 29 bang của Mỹ.

Trong năm nay, Meta cũng đã giới thiệu nhiều tính năng bảo vệ trẻ em, bao gồm:

  • Kiểm soát của phụ huynh đối với Meta AI
  • Tài khoản dành cho trẻ vị thành niên trên WhatsApp
  • Cảnh báo cho phụ huynh khi trẻ tìm kiếm nội dung tự hại trên Instagram
  • Thêm quyền kiểm soát trên WhatsApp vào tháng 9, cho phép cha mẹ giới hạn cách thanh thiếu niên dùng Channels, kiểm soát ai xem được trạng thái, quyết định ai có thể thêm con vào nhóm và nhận thông báo về một số hoạt động nhóm nhất định.

Góc nhìn cho người dùng Việt Nam

Với hàng chục triệu người dùng Facebook, Instagram và WhatsApp tại Việt Nam, các biện pháp này có ý nghĩa thực tiễn đáng kể. Việc Meta chuyển từ kiểm tra nội dung quảng cáo sang phân tích cả điểm đến cho thấy cuộc chiến chống nội dung độc hại đang ngày càng phức tạp, khi kẻ xấu liên tục thay đổi phương thức để né tránh phát hiện.

Đối với phụ huynh Việt Nam, việc chủ động sử dụng các công cụ kiểm soát của phụ huynh và theo dõi hoạt động của con trên mạng xã hội vẫn là lớp bảo vệ quan trọng, song hành cùng các biện pháp tự động từ phía nền tảng.

Chia sẻ:FacebookX
Nội dung tổng hợp bằng AI, mang tính tham khảo. Xem bài gốc ↗