Anthropic cấm hành vi 'lạm dụng hoặc tàn nhẫn' với Claude
Anthropic lần đầu cập nhật chính sách sử dụng sau hơn một năm, bổ sung các quy định về can thiệp bầu cử, phát triển vũ khí, giám sát và sử dụng trong lĩnh vực y tế, tài chính. Đáng chú ý nhất là lệnh cấm "hành vi lạm dụng hoặc tàn nhẫn kéo dài và vô cớ" đối với Claude.

Anthropic vừa công bố bản cập nhật chính sách sử dụng đầu tiên sau hơn một năm, nhằm phản ánh những trường hợp lạm dụng mới và có rủi ro cao. Đáng chú ý nhất là quy định cấm "hành vi lạm dụng hoặc tàn nhẫn kéo dài và vô cớ" đối với Claude, bên cạnh các giới hạn mới về can thiệp bầu cử, phát triển vũ khí và giám sát.
Minh họa về chính sách sử dụng của Anthropic đối với Claude
Bảo vệ "phúc lợi mô hình"
Hồi tháng 8 năm ngoái, Anthropic từng tuyên bố cho phép Claude chủ động kết thúc cuộc trò chuyện với những người dùng "liên tục có hành vi gây hại hoặc lạm dụng", như một phần trong nghiên cứu về "phúc lợi mô hình" (model welfare). Trong bản cập nhật mới, công ty khẳng định việc chấm dứt cuộc trò chuyện vẫn là "cơ chế thực thi chính".
Chính sách mới "chỉ nhằm áp dụng trong những trường hợp cực đoan, khi người dùng liên tục đối xử tàn nhẫn với mô hình mà không có mục đích rõ ràng. Nó không áp dụng cho những biểu hiện thất vọng thông thường, phản biện, chủ đề sáng tạo đen tối, hay việc kiểm thử và nghiên cứu mô hình."
Anthropic không đưa ra bình luận về việc liệu có thêm cơ chế thực thi nào khác hay không, chẳng hạn như cấm người dùng vĩnh viễn.
Siết chặt chống tuyên truyền và can thiệp bầu cử
Ngoài vấn đề phúc lợi mô hình, Anthropic đã gom nhiều hạn chế vốn "nằm rải rác" thành một lệnh cấm mới đối với các chiến dịch thương mại hoặc chính trị mang tính lừa dối, nhằm ứng phó với vấn nạn tuyên truyền do AI tạo ra ngày càng gia tăng.
- Cấm các nỗ lực che giấu danh tính người đứng sau thông điệp hoặc khuếch đại nội dung thông qua tài khoản và bài đăng giả mạo.
- Cấm lừa dối cử tri và phá hoại bầu cử, bao gồm lan truyền thông tin sai lệch "về ứng viên hoặc cách bỏ phiếu, mạo danh ứng viên hay quan chức bầu cử, hoặc tìm cách làm giảm tỷ lệ đi bầu".
Vũ khí, giám sát và trách nhiệm với thiết bị tự động
Anthropic cho biết dù chính sách sử dụng từ lâu đã công khai cấm phát triển vũ khí bằng Claude, công ty vẫn ghi nhận nhiều nỗ lực lợi dụng mô hình để xây dựng hướng dẫn và phần mềm điều khiển vũ khí. Vì vậy, lệnh cấm mới được mở rộng sang cả "phần mềm và linh kiện giúp vũ khí hoạt động, cũng như các hành động như trang bị vũ khí cho drone và các phương tiện tự hành khác".
Về giám sát, sau khi báo cáo tình báo mối đe dọa trước đó cho thấy người ta ngày càng dùng Claude để nhận diện và theo dõi "những người bất đồng chính kiến", công ty đã làm rõ các lệnh cấm của mình.
"Việc theo dõi người khác mà không có sự đồng ý của họ đều bị cấm, dù diễn ra theo thời gian thực hay thông qua phân tích dữ liệu đã thu thập trước đó. Claude không được dùng để quyết định hoặc đề xuất ai cần bị điều tra, bắt giữ hay truy tố trong quá trình thực thi pháp luật hoặc tư pháp hình sự."
Anthropic lưu ý rằng các quy định này có thể được điều chỉnh đối với "hợp đồng với một số khách hàng chính phủ nhất định… nếu theo đánh giá của Anthropic, các hạn chế sử dụng trong hợp đồng và biện pháp bảo vệ hiện hành là đủ để giảm thiểu tác hại tiềm tàng". Trước đây, công ty từng ký hợp đồng với quân đội Mỹ.
Bên cạnh đó, Anthropic bổ sung quy định mới: khi các mô hình AI được "kết nối với phần cứng có khả năng thực hiện hành động vật lý tự động và có thể gây thương tích", thì "một người vận hành đủ năng lực phải có khả năng quan sát thiết bị và dừng nó khi cần thiết". Hiện vẫn chưa rõ người vận hành này có bắt buộc phải là con người hay không.
Tranh cãi về ý thức của AI
Trong hơn một năm qua, Anthropic nhiều lần đề cập đến khả năng các mô hình AI của mình có thể có ý thức theo một cách nào đó. Kyle Fish, người phụ trách nghiên cứu phúc lợi mô hình của công ty, từng nói với The Verge hồi tháng 2 rằng "các câu hỏi về trải nghiệm nội tại tiềm tàng, ý thức, địa vị đạo đức và phúc lợi là những vấn đề nghiêm túc mà chúng tôi đang điều tra khi các mô hình trở nên tinh vi và mạnh mẽ hơn".
Cùng tháng đó, CEO Dario Amodei phát biểu trên một podcast: "Chúng tôi không biết liệu các mô hình có ý thức hay không."
Tuy nhiên, không phải ai trong ngành cũng đồng tình. Hồi tháng 9 vừa qua, bộ quy tắc ứng xử của Microsoft AI gây chú ý khi đưa ra lập trường cứng rắn về phúc lợi AI. Bản nháp do Mustafa Suleyman đăng tải viết: "Ý tưởng về phúc lợi mô hình là sai. AI không nên có quyền hay tư cách pháp nhân." Về sau, tài liệu này được sửa lại theo hướng ôn hòa hơn: "Dù khoa học về ý thức của AI còn xa mới ngã ngũ… chúng tôi bác bỏ việc theo đuổi tư cách pháp nhân, hoặc quan điểm rằng các mô hình có thể xứng đáng được hưởng phúc lợi hay có quyền."
Đối với người dùng Việt Nam đang sử dụng Claude hoặc các mô hình AI khác, bản cập nhật này là lời nhắc rằng các nhà cung cấp AI đang ngày càng siết chặt quy định sử dụng — đặc biệt với những lĩnh vực nhạy cảm như chính trị, an ninh và vũ khí. Việc nắm rõ chính sách sẽ giúp tránh những rủi ro không đáng có trong quá trình khai thác công cụ AI cho công việc và nghiên cứu.
Bài viết liên quan

Công nghệ
Mô hình AI hàng đầu giỏi Vật lý đến đâu? Nghiên cứu mới chỉ ra các bài kiểm tra hiện hành đang đánh giá sai
16 tháng 9, 2026

Công nghệ
Nộp đơn xin việc lẽ ra nên khó hơn. Thật đấy
25 tháng 8, 2026
Công nghệ
Amazon hoàn thành vệ tinh thứ 1.000, chuẩn bị khai trương dịch vụ Internet vũ trụ vào cuối năm
08 tháng 10, 2026