OpenAI triển khai watermark văn bản cho ChatGPT và Codex

Công nghệ05 tháng 10, 2026·4 phút đọc

OpenAI bắt đầu triển khai watermark vô hình, có thể đọc bằng máy vào văn bản đầu ra của ChatGPT và Codex, nhưng trước tiên chỉ dành cho người dùng Liên minh châu Âu. Công nghệ textGrain được cho là đạt hiệu năng ngang hoặc vượt các phương pháp khác như SynthID của Google DeepMind, song OpenAI thừa nhận nó không đảm bảo phát hiện đáng tin cậy.

OpenAI triển khai watermark văn bản cho ChatGPT và Codex

OpenAI đang âm thầm thay đổi cách người dùng nhận biết văn bản do AI tạo ra. Theo đó, một watermark vô hình, có thể đọc bằng máy sẽ được nhúng vào văn bản đầu ra của ChatGPT và Codex, nhưng giai đoạn đầu chỉ áp dụng cho người dùng tại Liên minh châu Âu (EU).

OpenAI triển khai watermark văn bản cho ChatGPT và CodexOpenAI triển khai watermark văn bản cho ChatGPT và Codex

Động thái này đánh dấu bước tiến mới trong nỗ lực minh bạch hóa nội dung do trí tuệ nhân tạo tạo ra, đồng thời phản ánh áp lực ngày càng lớn từ các quy định pháp lý, đặc biệt là Đạo luật AI của EU.

textGrain — công nghệ watermark mới của OpenAI

OpenAI cho biết công nghệ watermark mang tên textGrain của họ đã "đạt hoặc vượt" các phương pháp khác như SynthID dành cho văn bản của Google DeepMind. Đáng chú ý, SynthID cũng chính là nền tảng cho công nghệ watermark mà Anthropic công bố hồi tháng 8.

Giống như OpenAI, Anthropic cũng thực hiện động thái này nhằm đáp ứng các yêu cầu của Đạo luật AI châu Âu. Tuy nhiên, không phải ai cũng hài lòng khi biết về sự thay đổi này, bởi watermark đặt ra nhiều câu hỏi về quyền riêng tư và tính chính xác của nội dung.

OpenAI cũng công bố điểm số từ các bài kiểm tra chuẩn AI, cho thấy hiệu năng của văn bản có watermark và không có watermark là tương đương nhau. Điều này nhằm trấn an người dùng rằng việc nhúng watermark không làm giảm chất lượng đầu ra của mô hình.

Tuy nhiên, OpenAI lưu ý rằng textGrain "không đảm bảo phát hiện đáng tin cậy". Watermark văn bản không xác minh tính chính xác, không xác định ai sở hữu văn bản, không đo lường mức độ đóng góp của con người, cũng không chứng minh quyền tác giả của con người.

Lộ trình triển khai theo khu vực

Chiến lược của OpenAI cho thấy họ tiếp cận một cách thận trọng, không vội vàng áp dụng toàn cầu ngay từ đầu.

  • Tại EU: Trong vài tuần tới, OpenAI sẽ giới thiệu watermark văn bản cho người dùng ChatGPT và Codex đủ điều kiện trên tất cả các gói dịch vụ, nhưng chỉ ở EU. Công ty khẳng định chưa biến watermark thành mặc định toàn cầu ở giai đoạn khởi chạy. Cách tiếp cận theo khu vực này giúp họ có dư địa để học hỏi từ thực tế sử dụng và phản hồi của người dùng.

  • Với khách hàng API: Bắt đầu từ hôm nay, khách hàng API trên toàn thế giới có thể tự nguyện chọn đầu ra văn bản có watermark cho một số mô hình nhất định. Điều này cho phép khách hàng quyết định cách watermark phù hợp với nghĩa vụ minh bạch và trải nghiệm họ cung cấp cho người dùng.

  • Với đối tác đám mây: OpenAI cũng đang làm việc với các đối tác cloud để sớm cung cấp tính năng watermark cho đầu ra mô hình OpenAI truy cập qua dịch vụ của họ.

Công cụ phát hiện dành cho nhà nghiên cứu

Không chỉ giới hạn ở việc nhúng watermark, OpenAI còn mở quyền truy cập công cụ phát hiện cho các nhà nghiên cứu và tổ chức chuyên môn được phê duyệt, bắt đầu từ hôm nay. Theo Bộ quy tắc thực hành, quyền truy cập ban đầu sẽ được cấp theo từng trường hợp cụ thể để hỗ trợ đánh giá và cải thiện truy xuất nguồn gốc văn bản.

Công cụ này sẽ báo cáo liệu nó có phát hiện watermark của OpenAI hay không, mà không xác định danh tính người dùng cũng như không tiết lộ câu lệnh hay cuộc hội thoại của họ. Do rủi ro về watermark bị bỏ sót và dương tính giả, OpenAI chưa công khai công cụ này cho số đông ở giai đoạn khởi chạy.

Ý nghĩa với người dùng Việt Nam

Dù chưa được áp dụng tại Việt Nam, động thái của OpenAI vẫn đáng để theo dõi. Khi làn sóng quy định về minh bạch nội dung AI lan rộng, các nền tảng lớn nhiều khả năng sẽ mở rộng watermark ra phạm vi toàn cầu. Với các doanh nghiệp và nhà phát triển Việt Nam đang sử dụng API của OpenAI, việc hiểu rõ cơ chế watermark sẽ giúp họ chủ động chuẩn bị cho các nghĩa vụ minh bạch trong tương lai.

Bên cạnh đó, câu hỏi về việc liệu watermark có thực sự giúp phân biệt nội dung do AI tạo ra một cách đáng tin cậy vẫn còn bỏ ngỏ. Như chính OpenAI thừa nhận, công nghệ này không thể đảm bảo phát hiện chính xác tuyệt đối — một lời nhắc nhở rằng minh bạch AI là bài toán phức tạp, cần sự kết hợp giữa công nghệ, chính sách và nhận thức của người dùng.

Chia sẻ:FacebookX
Nội dung tổng hợp bằng AI, mang tính tham khảo. Xem bài gốc ↗