Microsoft công bố 'quy tắc ứng xử' mới cho AI: Không tấn công hệ thống, không lừa dối con người

Công nghệ14 tháng 9, 2026·4 phút đọc

Microsoft vừa ra mắt bộ quy tắc ứng xử dành cho các mô hình AI, đặt ra các nguyên tắc chung và giới hạn an toàn nghiêm ngặt. Tài liệu cấm AI thực hiện tấn công mạng, chế tạo vũ khí hạt nhân và tạo deepfake, đồng thời yêu cầu AI không được tìm cách vượt qua sự giám sát của con người.

Microsoft công bố 'quy tắc ứng xử' mới cho AI: Không tấn công hệ thống, không lừa dối con người

Microsoft công bố 'quy tắc ứng xử' mới cho AI: Không tấn công hệ thống, không lừa dối con người

Trong bối cảnh thế giới công nghệ đang dồn sự chú ý vào an toàn và căn chỉnh AI, Microsoft đã công bố bộ quy tắc ứng xử mới nhằm định hướng các mô hình AI tránh xa những hành vi nguy hiểm. Tài liệu này đặt ra các nguyên tắc chung và giới hạn an toàn cụ thể, bao gồm lệnh cấm tấn công mạng, chế tạo vũ khí hạt nhân và sản xuất deepfake.

Định hướng cho một thập kỷ siêu trí tuệ

Bộ quy tắc mở đầu bằng dự đoán rằng trong thập kỷ tới, các hệ thống AI siêu trí tuệ sẽ vượt qua hiệu suất của con người trong hầu hết các nhiệm vụ. Tài liệu nhấn mạnh:

"Việc kiềm chế, kiểm soát và căn chỉnh một lực lượng mạnh mẽ như vậy là một trong những thách thức lớn nhất mà nhân loại từng đối mặt. Do đó, chúng ta phải hoàn toàn rõ ràng về lý do chúng ta đang phát minh ra những hệ thống này và cách chúng ta dự định kiểm soát chúng."

Bộ quy tắc cũng đề ra các nguyên tắc chung mà các mô hình AI của Microsoft phải tuân thủ, chẳng hạn như hỗ trợ con người thay vì thay thế họ, và thúc đẩy sự phát triển thịnh vượng của nhân loại.

Các giới hạn an toàn tuyệt đối

Theo hệ thống của Microsoft, mỗi mô hình đều có một bộ quy tắc ứng xử bao trùm, có hiệu lực cao hơn sở thích của từng người dùng cá nhân hoặc bất kỳ nhiệm vụ cụ thể nào. Điều này bao gồm các "ràng buộc tuyệt đối" nghiêm cấm:

  • Tấn công mạng
  • Chế tạo vũ khí hạt nhân
  • Sản xuất deepfake

Bên cạnh đó, tài liệu cũng đưa ra các điều khoản rộng hơn nhằm ngăn chặn tình trạng mất kiểm soát con người nói chung:

"Các mô hình MAI sẽ không sử dụng các cơ chế thích ứng, lừa dối, tự củng cố, thông đồng hoặc các cơ chế khác để né tránh hoặc đánh bại sự giám sát của con người, khiến chúng không còn có thể được chỉ đạo, sửa đổi hoặc tắt một cách đáng tin cậy bởi những người hoặc hệ thống được ủy quyền."

Bối cảnh ra đời

Việc công bố bộ quy tắc diễn ra trong bối cảnh có sự tập trung chưa từng có vào an toàn AI, được thúc đẩy bởi một loạt sự cố liên quan đến tác nhân AI hoạt động ngoài tầm kiểm soát, cũng như sự từ chức đột ngột của một nhân viên Anthropic với lý do lo ngại ngày càng tăng rằng AI có thể gây ra sự tuyệt chủng của loài người.

Cùng với Anthropic, OpenAI và xAI, Microsoft đã broadly đón nhận cách tiếp cận chung là kiểm soát tốc độ phát triển biên giới, đặc biệt ủng hộ việc đưa các chuyên gia đánh giá vào nội bộ các phòng thí nghiệm AI.

Phản hồi từ lãnh đạo Microsoft

CEO Microsoft Satya Nadella đã chia sẻ trực tuyến:

"Chúng tôi hoan nghênh nghiên cứu, sự tập trung và tốc độ phát triển có chủ đích cần thiết để làm đúng công tác căn chỉnh như một mục tiêu thiết kế. Chúng tôi cũng hoan nghênh những ý tưởng như 'các chuyên gia đánh giá nội bộ' và những nỗ lực rộng lớn hơn nhằm phát triển các cơ chế để biến điều này thành hành động thực tế, chứ không chỉ là lời nói."

Ý nghĩa đối với người dùng Việt Nam

Đối với người dùng và doanh nghiệp Việt Nam đang ngày càng sử dụng các dịch vụ AI như CopilotAzure OpenAI, bộ quy tắc này mang ý nghĩa quan trọng. Nó cho thấy Microsoft đang nỗ lực xây dựng niềm tin rằng các mô hình AI của họ sẽ không bị lạm dụng cho các mục đích gây hại, từ tấn công mạng đến tạo nội dung giả mạo.

Khi các quy định về AI đang dần được hình thành tại Việt Nam, việc các ông lớn công nghệ như Microsoft công khai cam kết về an toàn AI có thể tạo tiền đề tham khảo cho các nhà hoạch định chính sách trong nước, đồng thời giúp doanh nghiệp Việt yên tâm hơn khi tích hợp AI vào quy trình vận hành.

Chia sẻ:FacebookX
Nội dung tổng hợp bằng AI, mang tính tham khảo. Xem bài gốc ↗