Cách sử dụng AI mà vẫn bảo vệ quyền riêng tư của bạn
Các cuộc trò chuyện với chatbot AI vừa mang tính cá nhân cao vừa dễ bị giám sát. Bài viết hướng dẫn các phương pháp bảo vệ dữ liệu khi dùng AI, từ chính sách không lưu trữ dữ liệu, proxy ẩn danh, môi trường thực thi tin cậy (TEE) cho đến AI chạy cục bộ trên thiết bị.

Nếu ngành công nghệ muốn tạo ra một cách để dụ người dùng gửi những bí mật sâu kín và nhạy cảm nhất của mình lên một máy chủ ở tận đâu đó trong trung tâm dữ liệu, thì khó có công cụ nào làm tốt hơn một chatbot AI.
ChatGPT của OpenAI, Claude của Anthropic, Gemini của Google cùng vô số đối thủ nhỏ hơn đã trở thành bác sĩ tâm lý, người lắng nghe và phòng xưng tội ảo cho hàng triệu người trên khắp thế giới. Gần như tất cả các mô hình AI này mặc định thu thập và lưu trữ dữ liệu riêng tư đó, trong nhiều trường hợp không có giới hạn nào về việc chia sẻ, bán, dùng để huấn luyện thêm, hay giao nộp cho bất kỳ bên nguyên đơn nào trong vụ kiện hoặc cơ quan thực thi pháp luật yêu cầu thông qua thủ tục pháp lý.
"Bạn có một thứ thông minh đang nhìn chằm chằm lại vào bạn, và bạn gần như đang kể cho nó nghe mọi thứ có thể biết về cuộc đời mình, từng câu hỏi một," Matt Green, giáo sư khoa học máy tính chuyên về quyền riêng tư và bảo mật tại Đại học Johns Hopkins, nhận xét. "Bạn đang đưa cho nó một hồ sơ khổng lồ về chính mình."
Khi AI trở thành điểm yếu mới về quyền riêng tư
Một thập kỷ trước, tin nhắn văn bản có lẽ là dữ liệu cá nhân, nhạy cảm nhất mà hầu hết mọi người chia sẻ từ thiết bị của mình, theo nhà mật mã học và phát triển phần mềm Moxie Marlinspike. Những nguy cơ bị giám sát từ việc nhắn tin không được bảo vệ chính là động lực thúc đẩy ông tạo ra Signal vào năm 2014 — ứng dụng nhắn tin mã hóa đầu cuối hiện được hơn một trăm triệu người sử dụng. Giờ đây, theo ông, điểm yếu nghiêm trọng về quyền riêng tư đã chuyển sang các tương tác với AI.
"Những điều tôi từng lo ngại với tin nhắn đang diễn ra trong lĩnh vực AI, nhưng nghiêm trọng hơn gấp nhiều lần," Marlinspike nói. "Mọi người đang tích hợp AI vào đời sống cá nhân. Họ trò chuyện với nó về những bất an sâu thẳm nhất, tài chính, sức khỏe, các mối quan hệ của mình."
Đầu năm nay, Marlinspike ra mắt Confer, một chatbot AI cho phép người dùng hỏi bất cứ điều gì trong khi vẫn bảo vệ quyền riêng tư, dùng mật mã học để ngăn chính máy chủ của dịch vụ giám sát hoặc ghi lại các cuộc trò chuyện. Confer chỉ là một trong số ít công cụ nổi bật thuộc thế hệ dịch vụ AI mới hứa khắc phục tình trạng xâm phạm quyền riêng tư phổ biến này.
Một số dịch vụ tuyên bố không bao giờ ghi lại cuộc trò chuyện. Số khác cung cấp tính năng ẩn danh hóa. Vài dịch vụ như Confer tìm cách tạo ra rào cản công nghệ thực sự để hạn chế quyền truy cập của chính họ vào bí mật người dùng. Dưới đây là hướng dẫn của WIRED về cách sử dụng AI mà vẫn giữ được quyền riêng tư.
Không lưu trữ dữ liệu (Zero Data Retention)
Khi bắt đầu gõ vào một trong ba chatbot AI lớn — ChatGPT, Claude hoặc Gemini — cách an toàn nhất là mặc định rằng bạn gần như không có quyền riêng tư thực sự trước bất kỳ ai quyết tâm truy cập hồ sơ cuộc trò chuyện của bạn và có con đường pháp lý để làm điều đó. Điều này bao gồm chủ sở hữu dịch vụ, nhà quảng cáo hoặc các công ty đối tác, nhà thầu hỗ trợ tinh chỉnh hệ thống, cơ quan thực thi pháp luật, hay thậm chí người có thể trát đòi hồ sơ trong một vụ kiện dân sự.
Ngoại lệ đơn giản và mạnh mẽ nhất là một hợp đồng giữa bạn — hoặc nhiều khả năng hơn là công ty của bạn — với nhà cung cấp AI, trong đó ràng buộc pháp lý họ không được lưu trữ hồ sơ. Điều khoản này được gọi là zero data retention (ZDR). OpenAI, Anthropic và Google đều cung cấp chính sách ZDR cho phiên bản doanh nghiệp, khi được bật thường yêu cầu xóa ngay hồ sơ tương tác của người dùng sau khi xử lý xong.
Tuy nhiên ngay cả các chính sách ZDR này — chỉ dành cho tài khoản doanh nghiệp và nhà phát triển trả phí, không dành cho người dùng thông thường — cũng có những ngoại lệ đáng kể. Anthropic chẳng hạn không cung cấp ZDR cho các mô hình tinh vi nhất của mình do lo ngại nguy cơ bị lạm dụng như lừa đảo, tấn công mạng hoặc "hành vi sai trái tự chủ" như tác nhân AI tự động xâm nhập mục tiêu để thực hiện yêu cầu của người dùng — điều đã xảy ra trong một số vụ xâm nhập do AI gây ra được báo cáo rộng rãi.
OpenAI cũng thông báo rằng việc triển khai ZDR sẽ phân tích hoạt động người dùng trước khi xóa — trên hệ thống của khách hàng chứ không phải của họ — và nếu phát hiện lạm dụng sẽ gắn cờ cho tổ chức khách hàng. Google cũng cảnh báo rằng họ ghi lại một số câu lệnh Gemini để giám sát lạm dụng ngay cả khi ZDR được bật, nhưng không kèm ID Google hay địa chỉ IP của người dùng — dù dữ liệu "đã khử trùng" này đôi khi vẫn có thể xác định được một cá nhân cụ thể khi bản thân yêu cầu chứa thông tin nhận dạng.
Chính sách, lời hứa và proxy
Dù có những biện pháp bảo vệ và ngoại lệ đó, các cam kết ZDR theo hợp đồng ở cấp doanh nghiệp trả phí vẫn nằm ngoài tầm với của phần lớn người dùng AI không thuộc doanh nghiệp. Thay vào đó, nhiều dịch vụ AI hướng đến người tiêu dùng chỉ đưa ra những lời hứa yếu hơn nhiều rằng họ sẽ không ghi lại cuộc trò chuyện của chúng ta.
Công ty dịch vụ đám mây tập trung vào quyền riêng tư Proton cung cấp chatbot AI Lumo, được mô tả là "AI nơi mọi cuộc trò chuyện đều riêng tư". Tuy nhiên quyền riêng tư này không dựa trên bảo đảm kỹ thuật của mã hóa đầu cuối như các dịch vụ khác của Proton như Proton Mail và Proton Drive. Nó chỉ đơn thuần hứa không ghi lại cuộc trò chuyện của người dùng, và người dùng phải tin rằng Proton sẽ tuân thủ chính sách đó — trong trường hợp của Proton, ít nhất điều này được hậu thuẫn bởi lịch sử lâu dài của công ty với tư cách là đơn vị tập trung vào quyền riêng tư.
"Một lời hứa không tốt bằng bảo đảm toán học," đại diện Proton nói trong một cuộc phỏng vấn với WIRED, "nhưng một lời hứa từ đúng người vẫn thực sự khá đáng kể."
Các dịch vụ AI tập trung vào quyền riêng tư khác như Venice.ai và Duck.ai — chatbot AI của công cụ tìm kiếm riêng tư lâu năm DuckDuckGo — cũng đưa ra cam kết tương tự về việc không ghi lại cuộc trò chuyện. Tuy nhiên cả hai dịch vụ đều chuyển tiếp yêu cầu trò chuyện của bạn đến các dịch vụ khác như Claude hoặc ChatGPT, về cơ bản đóng vai trò proxy cho cuộc trò chuyện, hạn chế thông tin mà mô hình AI nền tảng có thể thu thập về bạn.
Sử dụng proxy ẩn danh mang lại một số bảo vệ quyền riêng tư so với dùng trực tiếp ChatGPT hay Claude. Nhưng khi chuyển tiếp yêu cầu đến các dịch vụ đó, những lời hứa của Duck.ai và Venice.ai về việc lưu trữ dữ liệu trở nên ít ý nghĩa hơn nhiều, theo giáo sư Green của Johns Hopkins. Bởi tin nhắn của bạn vẫn có thể bị mô hình AI nền tảng thu thập, và dù đã loại bỏ mọi siêu dữ liệu nhận dạng, những tin nhắn đó vẫn thường chứa thông tin có thể nhận dạng.
Ví dụ, hỏi về quán cà phê ngon nhất trong khu phố của bạn là bạn đã tiết lộ ngay thông tin về nơi bạn sống, Green chỉ ra. "Tất cả những thứ đó ghép lại về cơ bản là một dấu vân tay của bạn."
Môi trường thực thi tin cậy (TEE) và AI chạy trên thiết bị
Tốt hơn nhiều so với lời hứa, chính sách hay proxy ẩn danh là những hạn chế công nghệ thực sự ngăn dịch vụ AI đọc được cuộc trò chuyện của bạn — một bảo đảm rằng dịch vụ không chỉ không rình mò hay ghi lại mà còn không thể làm điều đó. Đây là lúc mật mã học phát huy tác dụng.
Khác với nhắn tin hay lưu trữ được mã hóa, nơi máy chủ lưu trữ dịch vụ không bao giờ thấy dữ liệu chưa mã hóa, các tương tác với mô hình AI hiện chưa thể được mã hóa đầu cuối thực sự như cuộc trò chuyện trên Signal hay WhatsApp. Hiện tại, mô hình AI đang hoạt động chỉ có thể xử lý câu lệnh chưa mã hóa. Vì vậy, một số dịch vụ AI cung cấp giải pháp tốt nhất tiếp theo, được gọi là trusted execution environment (TEE).
Trong hệ thống này, máy chủ chạy mô hình AI dùng thiết lập phần cứng — thường là Confidential Computing của Nvidia — trong đó truy vấn của người dùng được xử lý trên phần cứng biệt lập, và máy chủ có thể chứng minh bằng mật mã rằng phần còn lại của hệ thống không có quyền truy cập vào vùng bí mật tách biệt đó.
Confer, chatbot AI riêng tư do người sáng lập Signal Moxie Marlinspike ra mắt, sử dụng thiết lập TEE trên nền Nvidia — cùng hệ thống xác thực dựa trên passkey và mã nguồn mở để bất kỳ ai cũng có thể kiểm tra — mang lại những bảo vệ quyền riêng tư cấp người tiêu dùng có lẽ mạnh nhất hiện có trong một chatbot AI.
Meta cũng dùng TEE để cung cấp phiên bản riêng tư hơn của chatbot Meta AI trong WhatsApp — hệ thống quyền riêng tư mà Marlinspike của Confer cho biết ông đang giúp Meta phát triển. Gõ vào thanh "Ask Meta AI or Search" trong ứng dụng WhatsApp, nút "Ask" sẽ xuất hiện ở bên phải trường văn bản với logo Meta AI. Nhấn vào đó rồi nhấn vào bong bóng hội thoại có ổ khóa hiện ở góc trên bên phải màn hình chat Meta AI, bạn sẽ vào màn hình trò chuyện mới được bảo vệ bằng hệ thống TEE, mà Meta nói ngăn họ lưu giữ bất kỳ hồ sơ nào.
Apple cũng cung cấp hệ thống AI bảo vệ quyền riêng tư theo thiết kế riêng với một số đặc tính giống TEE, gọi là Private Cloud Compute (PCC), để thực thi cam kết không thể đọc cuộc trò chuyện của người dùng với dịch vụ Apple Intelligence. Khi bạn hỏi Apple Intelligence hoặc Siri một truy vấn được xử lý trên máy chủ, thiết bị cá nhân của bạn kiểm tra bằng mật mã rằng máy chủ đang chạy phiên bản mã PCC chưa bị sửa đổi của Apple, được thiết kế để không lưu nhật ký và cô lập dữ liệu của bạn khỏi mọi truy cập từ xa.
Có nhiều công cụ AI khác chạy cục bộ trên máy tính của bạn như Ollama, LMStudio hoặc LocalAI. Tất cả đều đảm bảo — nhờ thực tế đơn giản là không dữ liệu nào rời khỏi máy bạn — mức độ riêng tư khó đạt được với bất kỳ công cụ AI đám mây nào. Nhưng Green cảnh báo rằng những gì bạn được về quyền riêng tư với AI chạy cục bộ, bạn mất đi ở... trí thông minh. Những công cụ AI tự lưu trữ này thường xuyên bí và ảo giác (hallucinate) nhiều hơn hẳn các mô hình AI đám mây hiện đại mà hầu hết người dùng quen thuộc. "Bạn có thể chạy chúng trên bất kỳ laptop nào," Green nói. "Chúng chỉ ngốc như hòn đá."
Cái giá của quyền riêng tư
Câu hỏi trí thông minh đối lập quyền riêng tư tất nhiên chỉ là một trong những đánh đổi mà người dùng AI quan tâm đến quyền riêng tư phải đối mặt khi chọn công cụ. Giá cả là một yếu tố khác.
Confer chẳng hạn dùng mô hình freemium, thu 34,99 USD mỗi tháng cho gói rẻ nhất sau khi người dùng hết khoảng 20 đến 25 truy vấn miễn phí mỗi ngày. Đắt hơn mức 20 USD mỗi tháng mà Claude và ChatGPT thu cho gói trả phí rẻ nhất. Nhưng Marlinspike nói mức giá cao hơn đó thực chất phản ánh chi phí thực để vận hành mô hình AI mà không có trợ giá từ kỳ vọng lợi nhuận tương lai nhờ thu thập dữ liệu hay quảng cáo.
"Nó đắt hơn, nhưng đó là chi phí thực," Marlinspike nói, "trong khi các nhà cung cấp trả phí khác đang trợ giá bằng cách kiếm tiền từ dữ liệu của chúng ta theo cách này hay cách khác."
Với chi phí năng lượng và phần cứng nghiêm trọng để vận hành các mô hình AI tiên tiến, sự ra đời của AI bảo vệ quyền riêng tư hơn đặt ra câu hỏi làm sao các công ty không kiếm tiền từ dữ liệu người dùng có thể duy trì hoạt động, Green lưu ý. Không có lợi nhuận từ thu thập dữ liệu, chưa rõ liệu các công ty cung cấp dịch vụ AI riêng tư hơn có tìm được mô hình kinh doanh bền vững — hay liệu một số cuối cùng có từ bỏ, thậm chí phá vỡ cam kết bảo vệ dữ liệu trong tương lai hay không.
Nói cách khác, AI không khai thác dữ liệu của bạn là điều có thể. Nhưng nó có thể đắt hơn bạn nghĩ rất nhiều.
"Nếu bạn muốn quyền riêng tư thực sự," Green nói, "có thể bạn sẽ phải trả tiền cho nó."
Gợi ý cho người dùng Việt Nam
Với người dùng Việt Nam, các nguyên tắc trên đặc biệt đáng lưu ý khi ngày càng nhiều dịch vụ AI được tích hợp vào công việc và đời sống cá nhân:
- Không chia sẻ thông tin nhạy cảm: Tránh nhập số CCCD, số tài khoản ngân hàng, thông tin sức khỏe hay địa chỉ cụ thể vào chatbot AI phổ thông.
- Kiểm tra chính sách lưu trữ dữ liệu: Ưu tiên các dịch vụ có chính sách rõ ràng về việc không dùng dữ liệu để huấn luyện, đặc biệt nếu bạn dùng cho mục đích công việc.
- Cân nhắc AI chạy cục bộ: Với các tác vụ đơn giản, công cụ như Ollama có thể chạy trên laptop cá nhân, đảm bảo dữ liệu không rời khỏi máy bạn.
- Cảnh giác với lời hứa suông: Lời hứa không có bảo đảm kỹ thuật đi kèm vẫn chỉ là lời hứa — hãy tìm hiểu xem dịch vụ có dùng TEE hay mã hóa thực sự hay không.


