Anthropic 'đánh dấu' văn bản Claude: Sự xâm phạm đến nghệ thuật viết lách
Anthropic tuyên bố sẽ áp dụng kỹ thuật watermark ẩn trong toàn bộ văn bản do Claude tạo ra để tuân thủ quy định của EU. Tuy nhiên, phương pháp mới này không chỉ chèn ký tự ẩn mà còn can thiệp vào việc lựa chọn từ ngữ trong quá trình sinh văn bản, làm giảm chất lượng và độ chính xác của câu chữ. Bài viết phân tích sâu về cơ chế hoạt động, chỉ trích cách tiếp cận này là 'xâm phạm' đến quyền được sử dụng công cụ AI một cách trung thực và đặt câu hỏi về tác động đến người dùng toàn cầu.

Anthropic 'đánh dấu' văn bản Claude: Sự xâm phạm đến nghệ thuật viết lách
Trong một động thái gây nhiều tranh cãi, Anthropic xác nhận sẽ áp dụng kỹ thuật đánh dấu (watermark) ẩn lên toàn bộ văn bản do Claude tạo ra trên phạm vi toàn cầu. Thay vì chỉ chèn ký tự vô hình, phương pháp mới can thiệp trực tiếp vào việc lựa chọn từ ngữ, khiến văn bản có thể bị giảm chất lượng mà người dùng khó nhận ra. Điều này vấp phải sự chỉ trích mạnh mẽ từ giới công nghệ và những người xem trọng sự chính xác trong ngôn từ.
Mô tả về sự can thiệp vào lựa chọn từ ngữ trong văn bản AI
Cơ chế hoạt động của watermark ẩn trong Claude
Ban đầu, nhiều người (bao gồm cả tác giả bài viết) dự đoán Anthropic sẽ sử dụng các ký tự Unicode vô hình để đánh dấu, bởi hãng này khẳng định hệ thống "không thay đổi ý nghĩa, chất lượng hay khả năng đọc" của văn bản. Tuy nhiên, tài liệu kỹ thuật công bố ngay sau đó đã làm rõ cách tiếp cận thực sự: một dạng steganography (kỹ thuật giấu tin) dựa trên ngữ nghĩa.
Theo giải thích từ Anthropic, tại mỗi điểm quyết định chọn token tiếp theo, mô hình sẽ có xu hướng chọn từ trong danh sách "xanh" và hạn chế từ trong danh sách "đỏ". Danh sách này được tạo động dựa trên một khóa bí mật mà chỉ nhà cung cấp nắm giữ. Điều này có nghĩa là văn bản càng dài, khả năng phát hiện dấu hiệu AI tạo ra càng cao, nhưng cũng đồng nghĩa với việc Claude có thể lựa chọn từ kém chính xác hơn so với lựa chọn tối ưu ban đầu.
Kỹ thuật này khiến mọi lựa chọn từ ngữ trở nên đáng ngờ. Không ai biết liệu từ được chọn là vì nó hay nhất, hay vì nó nằm trong danh sách "xanh" của thuật toán watermark.
"Sự xâm phạm" đến quyền lợi người dùng và nghệ thuật viết
Điểm mấu chốt trong chỉ trích là việc can thiệp vào lựa chọn từ ngữ, dù chỉ ở mức độ nhỏ, cũng vi phạm nguyên tắc tối thượng trong việc sử dụng công cụ hỗ trợ: luôn chọn từ ngữ chính xác và hay nhất. Một văn bản "anh nhảy vào cơ hội" và "anh lao vào cơ hội" có thể cùng ý, nhưng sắc thái hoàn toàn khác nhau.
Đáng lo ngại hơn, watermark sẽ được áp dụng cho mọi văn bản dài hơn 200 token Claude tạo ra hoặc xử lý, bao gồm cả việc rà soát (proofreading) văn bản của con người. Điều này có thể khiến tác phẩm gốc bị gắn cờ là do AI tạo ra, gây ra những cáo buộc sai trái cho học sinh, nhân viên hay nhà báo sử dụng công cụ này để chỉnh sửa.
Sự vô nghĩa của quy định và rào cản về khóa bí mật
Quy định EU về "minh bạch nội dung AI" bị đánh giá là chủ nghĩa hành chính viển vông, vì kỹ thuật watermark trên văn bản có thể bị vô hiệu hóa dễ dàng bằng các công cụ diễn giải lại. Ngược lại, nó lại gây khó khăn cho người dùng trung thực. James Padolsey, tác giả của công cụ Declaude, nhận định:
Việc quy định này khiến việc hỗ trợ bằng AI bị nghi ngờ là không công bằng. Đây là việc đặt ra một "mức phí đạo đức" cho sự khó khăn của việc viết lách.
Bên cạnh đó, toàn bộ hệ thống dựa trên khóa bí mật chỉ Anthropic nắm giữ, đồng nghĩa không ai khác có thể kiểm tra nguồn gốc văn bản. Người dùng buộc phải tin tưởng hãng này một cách mù quáng, trong khi các công ty khác như OpenAI vẫn chưa có cam kết rõ ràng về việc áp dụng công nghệ tương tự.
Kết luận
Việc Anthropic áp dụng watermark ẩn dựa trên lựa chọn từ ngữ là một quyết định "thù địch với người viết", vi phạm nguyên tắc về quyền kiểm soát tác phẩm của chính mình. Trong khi mục tiêu tuân thủ pháp luật là đáng khen, phương pháp triển khai hiện tại không chỉ làm giảm chất lượng văn bản mà còn tạo ra một thế giới đầy nghi ngờ về nguồn gốc nội dung. Người viết cần cân nhắc kỹ lưỡng việc sử dụng các công cụ có cơ chế như vậy, thay vào đó lựa chọn các giải pháp minh bạch và tôn trọng sự sáng tạo của con người.