OpenAI triển khai đánh dấu thủy văn yếu ớt cho văn bản AI

Công nghệ06 tháng 10, 2026·4 phút đọc

OpenAI đã giới thiệu tính năng đánh dấu thủy văn cho văn bản do AI tạo ra nhằm tuân thủ Đạo luật AI của châu Âu. Tuy nhiên, phương pháp này bị đánh giá là dễ bị phá vỡ và có tỷ lệ phát hiện thấp, đặc biệt với các đoạn văn bản ngắn.

OpenAI triển khai đánh dấu thủy văn yếu ớt cho văn bản AI

OpenAI vừa công bố một phương pháp đánh dấu thủy văn (watermarking) cho văn bản do AI tạo ra, động thái được xem là nhằm đáp ứng các yêu cầu của Đạo luật AI châu Âu. Tuy nhiên, giới phân tích cho rằng công nghệ này còn nhiều lỗ hổng và có thể dễ dàng bị vượt qua.

Theo Đạo luật AI của Liên minh châu Âu (EU AI Act), các nhà cung cấp dịch vụ AI tạo sinh có nghĩa vụ phải đảm bảo đầu ra của mô hình có thể nhận diện được bằng máy. Để tuân thủ quy định này, OpenAI đã giới thiệu một kỹ thuật mang tên textGrain, hoạt động bằng cách thêm một tín hiệu thống kê vô hình vào cách lựa chọn từ ngữ của mô hình.

Cách thức hoạt động của textGrain

Các mô hình ngôn ngữ lớn dự đoán từng token dựa trên phân phối xác suất của các từ tiềm năng. Bằng cách định kỳ chọn một từ khác – lý tưởng là từ đồng nghĩa – văn bản tạo ra sẽ lệch khỏi mẫu thống kê mà một mô hình không thiên lệch thường tạo ra. Công cụ phát hiện thủy văn, hiện chỉ được cung cấp cho các nhà nghiên cứu và tổ chức được phê duyệt, sẽ tìm kiếm sự sai lệch về từ vựng đó.

"Chúng tôi thêm một tín hiệu thống kê vô hình vào lựa chọn từ ngữ của mô hình. Công cụ phát hiện của chúng tôi tìm kiếm tín hiệu đó để đánh giá liệu một đoạn văn có chứa thủy văn của OpenAI hay không."

Về lý thuyết là vậy, nhưng thực tế kết quả lại khá khiêm tốn. Tỷ lệ lỗi mục tiêu là 1%, nhưng với các đoạn văn ngắn khoảng 200 từ, công cụ phát hiện chỉ có thể nhận diện được 80% thủy văn, so với 95% ở các đoạn văn dài 400 từ. Kết quả còn tệ hơn với các văn bản mang tính chức năng như nội dung về toán học hoặc mã nguồn, do việc thay thế từ dễ gây ra lỗi.

Rủi ro thay đổi ý nghĩa và dễ bị phá vỡ

Một vấn đề đáng lo ngại là bài báo về textGrain không đề cập đến khả năng việc thay đổi từ ngữ theo thống kê có thể làm sai lệch ý nghĩa của đoạn văn. Điều này hoàn toàn có thể xảy ra nếu thuật toán vô tình thay đổi một dữ kiện hoặc con số quan trọng. Phương pháp của Anthropic – cũng thay thế một số từ đầu ra nhưng bằng thuật toán khác – cũng tiềm ẩn rủi ro tương tự.

Đáng chú ý hơn, thủy văn của OpenAI có thể bị vô hiệu hóa dễ dàng chỉ bằng cách thay thế từ ngữ. Trong các thử nghiệm trên đoạn văn 400 token, việc thay 10% từ bằng từ đồng nghĩa đã làm giảm khả năng phát hiện thủy văn từ 92% xuống còn 66%. Khi thay thế 25% số từ, tín hiệu thủy văn chỉ còn được phát hiện trong 17% trường hợp.

So sánh với các ông lớn công nghệ khác

Anthropic là công ty AI lớn đầu tiên công bố cách tiếp cận của mình để tuân thủ Đạo luật AI, sử dụng thuật toán SynthID-Text của Google và áp dụng trên phạm vi toàn cầu. Trong khi đó, Microsoft và Meta cũng đang nghiên cứu công nghệ tương tự cho nội dung hình ảnh do AI tạo ra, bởi lo ngại về nguồn gốc nội dung và nguy cơ tin giả không chỉ giới hạn ở châu Âu.

OpenAI hiện đã áp dụng các tín hiệu nguồn gốc nội dung khác cho hình ảnh, âm thanh và video do AI tạo ra. Điểm khác biệt là OpenAI không áp dụng thủy văn cho nội dung được tạo bên ngoài châu Âu, dù khách hàng API có thể chọn áp dụng cho nội dung tạo ở bất kỳ đâu. Trong khi đó, Anthropic thực hiện điều này trên toàn cầu.

Ý nghĩa đối với người dùng và doanh nghiệp

Đối với người dùng và doanh nghiệp tại Việt Nam, động thái này cho thấy áp lực ngày càng tăng trong việc minh bạch hóa nội dung do AI tạo ra. Tuy nhiên, việc thủy văn có thể bị vô hiệu hóa dễ dàng đặt ra câu hỏi về hiệu quả thực tế của các quy định như vậy. Các tổ chức sử dụng API của OpenAI cần cân nhắc giữa việc tuân thủ quy định và nguy cơ làm giảm chất lượng hoặc thay đổi ý nghĩa nội dung đầu ra.

Việc đánh dấu thủy văn vẫn là một lĩnh vực đang phát triển, và textGrain của OpenAI có thể được xem là một bước đi đầu tiên đầy thận trọng. Song song đó, các nhà phát triển và chuyên gia bảo mật tại Việt Nam nên theo dõi sát sao những phát triển này, bởi nó ảnh hưởng trực tiếp đến cách xác minh nguồn gốc thông tin trong kỷ nguyên AI.

Chia sẻ:FacebookX
Nội dung tổng hợp bằng AI, mang tính tham khảo. Xem bài gốc ↗