Anthropic yêu cầu người dùng ngừng đối xử tệ với Claude

Công nghệ09 tháng 10, 2026·5 phút đọc

Anthropic vừa cập nhật chính sách sử dụng, cấm hành vi lạm dụng hoặc đối xử tàn nhẫn với các mô hình AI của mình. Bên cạnh quy định gây tranh cãi này, công ty cũng siết chặt các vấn đề nghiêm trọng hơn như can thiệp bầu cử, phát triển vũ khí và giám sát.

Anthropic yêu cầu người dùng ngừng đối xử tệ với Claude

Anthropic vừa công bố bản cập nhật chính sách sử dụng mới, trong đó có một quy định đáng chú ý: cấm người dùng đối xử tàn nhẫn với Claude. Động thái này cho thấy công ty đang ngày càng quan tâm đến khái niệm "phúc lợi mô hình" (model welfare), dù Claude chỉ là phần mềm chứ không phải con người.

Quy định mới về hành vi với chatbot

Theo chính sách mới có hiệu lực từ ngày 12 tháng 11, Anthropic nghiêm cấm "hành vi lạm dụng hoặc tàn nhẫn liên tục và vô cớ" đối với các mô hình AI của mình. Công ty cho biết quy định này chỉ áp dụng trong những trường hợp cực đoan, khi người dùng liên tục có hành vi tàn nhẫn mà không vì mục đích rõ ràng nào.

"Chính sách này không áp dụng cho những biểu hiện thất vọng thông thường, phản biện, chủ đề sáng tạo đen tối, hay việc kiểm thử và nghiên cứu mô hình." — Anthropic cho biết

Điều đó có nghĩa là bạn vẫn có thể nói với Claude rằng nó sai, nhưng liên tục mắng mỏ nó chỉ vì thích thú có thể khiến bạn gặp rắc rối. Hiện vẫn chưa rõ Anthropic phân biệt thế nào giữa sự thất vọng chính đáng và hành vi tàn nhẫn vô cớ, nhưng công ty khẳng định khả năng kết thúc các cuộc trò chuyện lạm dụng của Claude vẫn là công cụ thực thi chính.

Trên thực tế, từ tháng 8 năm 2025, Anthropic đã trao cho Claude khả năng chủ động dừng một số cuộc trò chuyện như một phần trong nghiên cứu về "phúc lợi mô hình". Tính năng này cho phép một số phiên bản Claude ngắt kết nối với những người dùng liên tục có hành vi lạm dụng.

Những quy định nghiêm trọng hơn

Quy tắc về phép lịch sự chỉ là một phần nhỏ trong đợt đại tu chính sách rộng lớn hơn, bao gồm những vấn đề hệ trọng hơn nhiều như can thiệp bầu cử, phát triển vũ khí và giám sát.

Anthropic đã thắt chặt các hạn chế đối với chiến dịch gây ảnh hưởng lừa đảo, sau khi quan sát thấy các cơ quan truyền thông nhà nước, văn phòng tuyên truyền chính phủ và tổ chức thương mại sử dụng Claude để vận hành tài khoản giả và tạo các trang tin bịa đặt.

Đáng chú ý, công ty đã bỏ lệnh cấm toàn diện đối với việc nhắm mục tiêu chính trị được cá nhân hóa, với lý do quy định này cũng vô tình cấm các hoạt động chính đáng, chẳng hạn như các tổ chức phi lợi nhuận dịch thông tin cử tri. Tuy nhiên, việc nhắm mục tiêu lừa đảo và lạm dụng thông tin cá nhân vẫn bị nghiêm cấm.

Về vũ khí, Anthropic làm rõ rằng lệnh cấm của họ mở rộng sang cả phần mềm và linh kiện, sau khi phát hiện các nỗ lực dùng Claude để phát triển hệ thống dẫn đường và điều khiển cho vũ khí, bao gồm máy bay không người lái vũ trang và phương tiện tự hành.

Về giám sát, Claude không được phép sử dụng để đề xuất người mà cảnh sát nên điều tra, bắt giữ hay khởi tố, cũng như phát triển công cụ giám sát. Việc theo dõi người khác mà không có sự đồng ý cũng bị cấm, dù là theo thời gian thực hay hồi tố.

Yêu cầu mới cho thiết bị vật lý

Chính sách còn bổ sung yêu cầu đối với khách hàng kết nối Claude với thiết bị vật lý có khả năng gây thương tích. Theo đó, phải có người vận hành đủ trình độ giám sát và dừng thiết bị, đồng thời thiết bị phải duy trì trạng thái an toàn nếu kết nối AI bị ngắt.

Anthropic cho biết những thay đổi này chủ yếu làm rõ các hạn chế hiện có thay vì đưa ra quy định hoàn toàn mới.

Bối cảnh an ninh mạng rộng hơn

Đợt đại tu chính sách diễn ra song song với nỗ lực của Anthropic nhằm giải quyết các rủi ro an ninh do các hệ thống AI ngày càng mạnh gây ra. Công ty cũng đã khởi động một sáng kiến an ninh mạng mới, giúp các đơn vị vận hành hạ tầng trọng yếu và dự án mã nguồn mở tìm và vá lỗ hổng bằng các mô hình AI của mình.

Sáng kiến này bao gồm việc quét bảo mật miễn phí cho các dự án mã nguồn mở đủ điều kiện và hợp tác với các công ty bảo mật để bảo vệ hạ tầng trọng yếu. Anthropic dự đoán kẻ tấn công sẽ chiếm ưu thế trong hai năm tới trước khi các biện pháp phòng thủ do AI hỗ trợ bắt kịp.

Với độc giả Việt Nam đang theo dõi làn sóng AI toàn cầu, những thay đổi này cho thấy các nhà phát triển AI hàng đầu đang dần chuyển từ việc chỉ tập trung vào năng lực mô hình sang việc định hình cả cách con người tương tác và sử dụng chúng, từ những chi tiết nhỏ như phép lịch sự cho đến các vấn đề địa chính trị phức tạp.

Chia sẻ:FacebookX
Nội dung tổng hợp bằng AI, mang tính tham khảo. Xem bài gốc ↗