Lập trình viên tìm ra cách vượt qua 'hình mờ' ẩn của Claude chỉ trong vài giờ
Chỉ vài giờ sau khi Anthropic công bố áp dụng hình mờ vô hình cho mọi nội dung do Claude tạo ra nhằm tuân thủ quy định AI của EU, các lập trình viên đã nhanh chóng phát hành công cụ gỡ bỏ và chia sẻ rộng rãi trên GitHub. Điều này làm dấy lên cuộc tranh luận về hiệu quả của công nghệ đánh dấu AI và tác động tiềm ẩn đối với người dùng.

Lập trình viên tìm ra cách vượt qua 'hình mờ' ẩn của Claude chỉ trong vài giờ
Chỉ vài giờ sau khi Anthropic xác nhận áp dụng hình mờ vô hình, có thể đọc bằng máy, vào mọi nội dung do mô hình Claude tạo ra, lập trình viên Guillaume Meyer đã công bố công cụ gỡ bỏ của mình. Mã nguồn của anh nhanh chóng lan truyền trên GitHub với hơn 100 người đóng góp, được lưu lại hơn 20.000 lần trên X, cho thấy sự quan tâm lớn của cộng đồng đối với vấn đề này.
Bối cảnh ra đời luật mới của EU
Quy định mới của Liên minh Châu Âu (EU), có hiệu lực từ đầu tháng này, yêu cầu các nhà cung cấp mô hình AI như Anthropic và OpenAI phải gắn nhãn cho nội dung tổng hợp (âm thanh, hình ảnh, video hoặc văn bản) để máy móc có thể nhận diện chúng là do AI tạo ra. Nếu không tuân thủ, họ có thể bị phạt tới 3% doanh thu hàng năm.
Anthropic cho biết họ sẽ sử dụng công nghệ SynthID do Google phát triển, chèn hình mờ vô hình vào lựa chọn từ ngữ của Claude. Kỹ thuật này tạo ra một "dấu vân tay" mà con người không thể nhìn thấy nhưng máy móc có thể phát hiện nếu biết cách tìm kiếm.
Công cụ gỡ bỏ hình mờ xuất hiện nhanh chóng
Guillaume Meyer, lập trình viên người Pháp, là một trong những người đầu tiên công bố giải pháp. Mã nguồn của anh sử dụng các mô hình ngôn ngữ lớn không chèn hình mờ để viết lại nhiều phiên bản khác nhau, thay thế từ đồng nghĩa và sắp xếp lại nội dung một cách tinh tế.
Phản ứng của Meyer về việc này:
"Tôi không phản đối sự minh bạch, và tôi ủng hộ việc ghi nhận nguồn gốc nội dung. Tôi chỉ nghĩ rằng hình mờ là một giải pháp tồi vì nó có nhiều hạn chế và rủi ro lớn."
Anh lo ngại về nguy cơ kết quả dương tính giả và việc hệ thống không thể phân biệt giữa việc sử dụng AI nhẹ hay nặng. Là người nói tiếng Pháp bản địa, Meyer thường dùng Claude và Grammarly để chỉnh sửa văn bản tiếng Anh - một tình huống mà hình mờ có thể tạo ra kết luận sai lệch.
Các giải pháp khác từ cộng đồng
Không chỉ Meyer, nhiều lập trình viên khác cũng nhanh chóng phát triển công cụ riêng:
- Erik Hughes, kỹ sư phần mềm, chỉ mất 15 phút để tạo công cụ với Claude - loại bỏ ký tự vô hình, sắp xếp lại câu và thay thế từ đồng nghĩa.
- Leon Chlon, nghiên cứu viên tại Đại học Oxford, đề xuất phương pháp nén chuỗi phản hồi, dịch sang phương ngữ tiếng Ả Rập (có cấu trúc ngữ nghĩa khác biệt) rồi dịch ngược lại.
Bản thân Anthropic cũng thừa nhận rằng nội dung được chỉnh sửa kỹ, diễn giải lại hoặc dịch thuật có thể không còn giữ được hình mờ.
Tranh cãi về hiệu quả và tác động
Wayne Pan, CTO kiêm đồng sáng lập startup AI Haimaker tại Thung lũng Silicon, đã tích hợp công cụ mã nguồn mở của Meyer vào nền tảng của mình. Anh không đồng tình với việc Claude đánh dấu nội dung ngay cả khi chỉ được chỉnh sửa nhẹ, và việc hình mờ ẩn không cho người dùng biết.
Về độ tin cậy của công cụ gỡ bỏ, Pan nhận định:
"Tôi nghĩ họ muốn thể hiện thiện chí tuân thủ, nhưng tôi tin rằng không có hình mờ nào có thể chống chọi được mọi thứ."
Trong khi đó, các nhà văn tự do và nhà sáng tạo nội dung trên mạng xã hội cũng đã liên hệ với Meyer để xin hỗ trợ sử dụng mã nguồn.
Phản hồi từ Anthropic
Trong tuyên bố gửi tới WIRED, người phát ngôn của Anthropic cho biết:
"Chúng tôi thêm hình mờ vào đầu ra của Claude để tuân thủ EU AI Act, và các phòng thí nghiệm khác cũng đang làm tương tự. Việc nhận diện văn bản do AI tạo ra là một thách thức, và điều này cung cấp cho mọi người công cụ nhận diện tốt hơn. Văn bản từ các mô hình Claude được hỗ trợ, bao gồm đầu ra từ Claude Code, sẽ mang hình mờ vô hình và không làm thay đổi ý nghĩa, chất lượng hoặc khả năng đọc phản hồi của Claude. Chúng tôi cũng có kế hoạch cung cấp API phát hiện văn bản để người dùng tự thực hiện thêm."
Quan ngại về chất lượng và quyền riêng tư
Nhiều người dùng lo ngại hình mờ có thể làm giảm chất lượng phản hồi của Claude vì nó ảnh hưởng đến cách mô hình lựa chọn từ ngữ. Tuy nhiên, Anthropic khẳng định điều này sẽ không xảy ra.
Về mặt pháp lý, quy định EU cấm các nhà cung cấp mô hình quảng bá công cụ vượt qua hình mờ, nhưng không có hạn chế pháp lý nào đối với các công cụ độc lập do bên thứ ba phát triển - đó là lý do vì sao các giải pháp như của Meyer được phép tồn tại.
Điều đáng chú ý là 190 tổ chức, bao gồm OpenAI, Microsoft và Meta, đã ký vào bộ quy tắc thực hành minh bạch của EU. Tuy nhiên, vẫn chưa rõ bao nhiêu phòng thí nghiệm trong số này sẽ triển khai hình mờ - yêu cầu này phải được áp dụng cho mọi mô hình mới từ tháng 8 và tích hợp vào mô hình hiện tại trước tháng 12.
Tương lai của cuộc đua hình mờ
Các nhà phát triển sẽ chỉ thực sự kiểm chứng được phương pháp của mình khi Anthropic phát hành công cụ phát hiện hình mờ văn bản - dự kiến sẽ sớm được công bố. Cho đến lúc đó, mọi thứ vẫn chỉ là dự đoán dựa trên hiểu biết về SynthID.
Cuộc đua giữa "khóa và chìa khóa" này phản ánh một thực tế: bất kỳ công nghệ bảo vệ nội dung nào cũng có thể bị vượt qua, và điều quan trọng là cần có sự cân bằng giữa minh bạch thông tin, quyền lợi người dùng và khả năng thực thi pháp luật - một bài toán mà không chỉ Việt Nam mà các quốc gia đang phát triển AI cần quan tâm.