Opus 5.5 và những 'dấu vết' đặc trưng của văn phong do AI viết
Nghiên cứu mới từ Graphite chỉ ra rằng mỗi mô hình AI đều có những từ ngữ và cấu trúc câu đặc trưng riêng khi viết văn. Opus 5.5 của Anthropic nổi bật với từ "dependable" xuất hiện nhiều gấp 23 lần so với con người, trong khi các mô hình khác cũng có những "dấu vết" khó loại bỏ.

Khi văn bản do AI tạo ra ngày càng tràn ngập khắp nơi, con người cũng ngày càng muốn tìm cách nhận diện chúng. Những dấu hiệu ban đầu như dấu gạch ngang dài hay từ "delve" đã không còn phổ biến, nhưng các nhà nghiên cứu cho rằng vẫn còn vô số thói quen đặc trưng mà các mô hình AI thường xuyên tái sử dụng khi viết.
Một nghiên cứu mới từ công ty tiếp thị Graphite đã phân tích thói quen viết của các mô hình hàng đầu, tìm ra những từ ngữ và cụm từ yêu thích của từng mô hình. Theo kết quả, các mô hình vẫn thường xuyên dùng những cấu trúc câu mang tính đối lập, và mỗi phiên bản lại có những nét riêng biệt. Điều đáng ngạc nhiên nhất là phạm vi của những "dấu vết" này rộng hơn nhiều so với dự đoán.
13.000 cụm từ đặc trưng của AI
Graphite đã xác định được 13.000 cụm từ xuất hiện ít nhất hai lần phổ biến hơn trong nội dung do AI tạo ra so với nội dung của con người — đây chính là định nghĩa của họ về một "dấu vết" (tell).
Để nghiên cứu văn phong AI ở quy mô lớn, nhóm nghiên cứu đã thiết kế một phương pháp rất kỹ lưỡng. Họ bắt đầu với 10.000 bài viết được xuất bản trước khi ChatGPT ra đời, làm nhóm đối chứng do con người viết. Sau đó, các mô hình AI khác nhau được yêu cầu viết lại những bài này từ phần tóm tắt, nhằm loại bỏ tối đa ảnh hưởng từ nguồn gốc. Với các mẫu tương ứng từ cả con người và từng mô hình, họ có thể so sánh tần suất xuất hiện của các từ và cụm từ, cũng như những mẫu câu rộng hơn.
"Hóa ra các mô hình Claude đang ngày càng tiến gần hơn đến phân phối từ ngữ của con người theo thời gian. Còn với các mô hình GPT, khoảng cách lại ngày càng xa hơn."
— Greg Druck, giám đốc AI của Graphite, chia sẻ với TechCrunch.
Opus 5.5 thích nói với bạn rằng "điều này quan trọng"
Theo kết quả của Graphite, dấu vết lớn nhất của Claude Opus 5.5 là từ "dependable" (đáng tin cậy), xuất hiện nhiều gấp 23 lần so với mẫu của con người. Dù Opus 5.5 đã tránh được cấu trúc câu "it's not X, it's Y" (không phải X, mà là Y), mô hình này vẫn có xu hướng nói rằng một thứ gì đó "is more than an X, it's a Y" (không chỉ là X, mà còn là Y).
Trên hết, Opus rất thích giải thích cho bạn tại sao mọi thứ lại quan trọng, với cụm từ "this matters" (điều này quan trọng) xuất hiện nhiều gấp 116 lần so với văn viết của con người, trong khi "why X matters" (tại sao X lại quan trọng) xuất hiện nhiều gấp 92 lần.
Astra của OpenAI có bộ dấu vết khác biệt
Mô hình Astra của OpenAI lại có những dấu hiệu nhận biết hoàn toàn khác. Mô hình này rất thích mô tả "another dimension" (một chiều không gian khác) của bất cứ thứ gì nó đang nói đến, và thường rào đón các khẳng định bằng cách nói rằng một hành động "may provide" (có thể mang lại) hoặc "can provide" (có thể cung cấp) một lợi ích nào đó.
Dấu vết lớn nhất của Astra là thứ mà Graphite gọi là "corrective framing" (cách diễn đạt chỉnh sửa), khi một chủ đề được định nghĩa là "not simply X" (không chỉ đơn thuần là X) hoặc được đưa ra như một lựa chọn thay thế, "rather than relying on X" (thay vì dựa vào X). Theo nghiên cứu của Graphite, những cấu trúc này xuất hiện nhiều hơn 100 lần trong văn bản do Astra tạo ra so với văn viết của con người.
Dấu gạch ngang dài gần như biến mất
Đáng chú ý, tất cả các phòng thí nghiệm AI hàng đầu dường như đã phản ứng trước ý kiến cho rằng các mô hình lạm dụng dấu gạch ngang dài (em-dash). Trong các mẫu của Graphite, Opus 5.5 sử dụng dấu câu này ít hơn 99% so với Opus 5. Astra hiện dùng nó ít hơn 88% so với mẫu của con người, trong khi Gemini 3.1 Pro gần như đã loại bỏ hoàn toàn dấu gạch ngang dài khỏi văn phong của mình.
Tuy nhiên, dù từng dấu vết cụ thể có thay đổi, Graphite cho biết tổng số lượng dấu vết vẫn khá ổn định.
"Không phải là các dấu vết đang giảm đi. Họ có thể loại bỏ những dấu vết nổi tiếng nhất, nhưng những dấu vết khác lại xuất hiện. Và mỗi phiên bản mô hình đều có dấu vết riêng."
— Greg Druck nhận định.
Nỗ lực của các phòng thí nghiệm vẫn còn hạn chế
Điều đáng ngạc nhiên là các dấu vết vẫn dai dẳng đến vậy, bất chấp việc các phòng thí nghiệm đang tập trung vào phong cách viết giống con người. Trong bản phát hành Opus 5.5, Anthropic tự hào rằng mô hình này "giao tiếp tự nhiên hơn các mô hình trước đó", nói rằng người dùng ban đầu "thấy văn phong của nó rõ ràng và dễ theo dõi hơn".
OpenAI cũng đưa ra những tuyên bố tương tự khi phát hành các phiên bản GPT-6 của Sol và Luna, nói rằng người dùng có thể "mong đợi sự rõ ràng hơn, ít thuật ngữ chuyên môn hơn, và ít những cách diễn đạt kỳ lạ hơn".
Nhưng Druck tỏ ra hoài nghi về việc các phòng thí nghiệm có thể làm được bao nhiêu để loại bỏ hoàn toàn những cấu trúc hay cụm từ đặc trưng.
"Giả thuyết chung của tôi là các phòng thí nghiệm ít có khả năng kiểm soát những điều này hơn bạn tưởng. Đây là những mô hình khổng lồ với hàng tỷ tham số. Họ chỉ có một số lượng hữu hạn các bài kiểm tra có thể chạy, và mọi thứ vẫn lọt qua."
Ý nghĩa với người dùng Việt Nam
Với người dùng Việt Nam, việc nhận diện văn phong AI ngày càng quan trọng trong bối cảnh các công cụ như ChatGPT, Claude hay Gemini được sử dụng rộng rãi trong công việc, học tập và sáng tạo nội dung. Hiểu rõ những "dấu vết" này không chỉ giúp bạn tinh chỉnh prompt để có kết quả tự nhiên hơn, mà còn là kỹ năng cần thiết để đánh giá độ tin cậy của thông tin trong thời đại mà nội dung do AI tạo ra ngày càng khó phân biệt.


