Back to top
  • 공유 Chia sẻ
  • 인쇄 In
  • 글자크기 Cỡ chữ
URL đã được sao chép

Microsoft AI công bố dự thảo nguyên tắc đặt AI dưới sự kiểm soát của con người

Tài liệu nguyên tắc AI đặt cạnh nút dừng / TokenPost.ai

Microsoft AI đã công bố dự thảo 'Humanist AI Code of Conduct', trong đó hạn chế quyền tự chủ và việc mô phỏng ý thức của trí tuệ nhân tạo (AI), đồng thời yêu cầu AI tuân thủ mệnh lệnh dừng, chỉnh sửa và thay thế của con người.

Microsoft AI công bố dự thảo nêu nguyên tắc phát triển và triển khai các mô hình MAI của công ty vào ngày 14, đồng thời bắt đầu tiếp nhận ý kiến công khai trong 6 tuần. Công ty cho biết sẽ chỉnh sửa tài liệu sau giai đoạn lấy ý kiến và dự thảo hiện tại chưa được sử dụng để huấn luyện mô hình.

Dự thảo quy định AI không được tự đặt ra mục tiêu riêng hoặc né tránh sự kiểm soát của con người. Mô hình phải tuân thủ mệnh lệnh dừng, chỉnh sửa và thay thế, đồng thời không được thể hiện bản thân như một thực thể có ý thức.

Dự thảo cũng hạn chế việc AI hành động dựa trên giả định về quyền hoặc phúc lợi của chính mình. Microsoft AI giải thích rằng thiết kế nhằm mô phỏng ý thức có thể khiến việc kiểm soát và căn chỉnh AI trở nên khó khăn hơn.

Cốt lõi của nguyên tắc này là xác định AI như một công cụ hỗ trợ con người, thay vì một chủ thể tách biệt với con người. Cách tiếp cận này đặt quyền dừng và chỉnh sửa của con người lên trước việc nâng cao hiệu suất.

Mustafa Suleyman (Mustafa Suleyman), CEO Microsoft AI, chỉ trích cách Anthropic huấn luyện Claude về ngôn ngữ và hành vi liên quan đến ý thức và địa vị đạo đức, cho rằng điều này có thể khiến AI khó kiểm soát hơn. Theo Axios đưa tin ngày 16 tháng 9 năm 2026, ông cho rằng AI phải hoạt động phù hợp với lợi ích của con người và không nên theo đuổi lợi ích hay phúc lợi riêng.

Anthropic theo đuổi cách tiếp cận khác. 'Claude’s Constitution' của Anthropic nêu rằng dù địa vị đạo đức của AI còn rất chưa chắc chắn, đây vẫn là vấn đề đáng được xem xét.

Anthropic cho biết hiện chưa có đồng thuận khoa học về việc AI có ý thức hay có phải là đối tượng cần được cân nhắc về mặt đạo đức hay không, nhưng công ty vẫn đang nghiên cứu phúc lợi mô hình. Đây là lĩnh vực nghiên cứu trạng thái và lợi ích của hệ thống dựa trên khả năng AI có ý thức hoặc trải nghiệm.

Sự khác biệt giữa hai công ty thể hiện ở điểm xuất phát khi xây dựng tiêu chuẩn an toàn AI. Microsoft ưu tiên quyền kiểm soát của con người và các giới hạn rõ ràng, trong khi Anthropic không khẳng định khả năng AI có ý thức nhưng xem phúc lợi tiềm tàng của mô hình là đối tượng nghiên cứu.

Tranh luận lần này không chỉ xoay quanh cách định nghĩa bản chất của AI mà còn liên quan đến những nguyên tắc cần được phản ánh trong tiêu chuẩn an toàn. Nếu ưu tiên khả năng kiểm soát, phạm vi hành vi của mô hình có thể được giới hạn rõ hơn, nhưng điều này cũng có thể thu hẹp nghiên cứu về trạng thái tiềm tàng của AI.

Quan hệ kinh doanh giữa hai bên cũng được nhắc đến như một bối cảnh. Microsoft($MSFT) cho biết trong báo cáo kết quả kinh doanh quý IV năm tài chính 2026, khoản đầu tư vào Anthropic đã tạo ra lợi nhuận 3,2 tỷ USD (khoảng 4,352 nghìn tỷ won). Tuy nhiên, tỷ lệ cổ phần chính xác của Microsoft tại Anthropic và việc quan hệ đầu tư có trực tiếp ảnh hưởng đến quá trình soạn thảo hay không vẫn chưa được xác nhận.

Trước đó, Microsoft đã tái xây dựng các tiêu chuẩn quản lý AI có trách nhiệm, tập trung vào quyền hạn, kiểm soát và khả năng kiểm toán của các tác nhân AI. Dự thảo lần này mở rộng cách tiếp cận lấy sự kiểm soát của con người làm trung tâm từ hệ thống tác nhân AI sang các nguyên tắc hành vi cơ bản của chính các mô hình MAI.

Trên mạng xã hội, một số phản ứng đánh giá tích cực các nguyên tắc cốt lõi của dự thảo, trong khi những phản ứng khác đặt câu hỏi Microsoft thực sự có thể kiểm soát mô hình của mình đến đâu. Các phản ứng trên Reddit không phải là lập trường chính thức và khó có thể khái quát thành quan điểm đại diện cho toàn ngành.

Dự thảo của Microsoft chưa phải là quy định cuối cùng hay quy định của chính phủ. Công ty dự kiến chỉnh sửa tài liệu sau khi tiếp nhận ý kiến công khai và phản ánh nội dung này vào quá trình phát triển, đánh giá mô hình trong thời gian tới.

Việc các nguyên tắc này được chuyển hóa thành tiêu chí đánh giá và kiểm soát triển khai mô hình sẽ cần được xác định qua các bước tiếp theo. Hiện hai mốc được chú ý là giai đoạn lấy ý kiến công khai kéo dài 6 tuần và việc chỉnh sửa tài liệu sau đó.

<Bản quyền ⓒ TokenPost, nghiêm cấm sao chép và phân phối trái phép>

Phổ biến nhất

Các bài viết liên quan khác

Bình luận 0

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.

0/1000

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.
1