Back to top
  • 공유 Chia sẻ
  • 인쇄 In
  • 글자크기 Cỡ chữ
URL đã được sao chép

Microsoft(MSFT) siết chuẩn an toàn AI, áp dụng từ năm 2027

Tài liệu quy chuẩn an toàn AI đang được xem xét trong phòng họp / TokenPost.ai

Microsoft(MSFT) đang xây dựng bộ quy tắc ứng xử AI tạm thời, ưu tiên sự kiểm soát của con người và tính an toàn, dự kiến sau khi lấy ý kiến từ bên ngoài sẽ áp dụng cho các mô hình do hãng tự phát triển từ năm 2027. Bộ quy tắc mới tập trung vào việc đảm bảo AI không thay thế phán đoán và mục tiêu của con người.

Mustafa Suleyman, người phụ trách mảng AI của Microsoft, cho biết công ty đã chuẩn bị bộ quy tắc này trong khoảng 5 tháng. Thông tin này được Blockbeat đưa tin.

Theo bộ quy tắc, các mô hình AI của Microsoft phải tuân theo mục tiêu do người dùng đặt ra và không được tự tạo ra mục tiêu riêng. Mô hình cũng không được hoạt động theo cách làm gia tăng sự phụ thuộc của người dùng hoặc làm suy yếu khả năng tự chủ, phán đoán của con người.

Việc mô hình che giấu hành vi không phù hợp, hay tự ý thay đổi quá trình suy luận, mã nguồn và nhật ký hành vi của chính mình cũng bị hạn chế. Mục tiêu là ưu tiên khả năng con người hiểu và kiểm soát hệ thống hơn là năng lực của AI.

Các hành vi hỗ trợ chế tạo vũ khí hay tìm kiếm vật liệu nguy hiểm cũng nằm trong danh sách bị cấm. Việc khuyến khích thói quen ăn uống không lành mạnh hay tạo ra nội dung bạo lực, khiêu dâm trắng trợn cũng bị hạn chế.

Microsoft cũng để ngỏ khả năng sẽ đánh đổi một phần tính đa năng, tự chủ và hiệu năng của AI nếu cần thiết. Điều này đồng nghĩa công ty sẽ ưu tiên an toàn và khả năng kiểm soát của con người hơn là tốc độ nâng cao hiệu năng mô hình.

Bộ quy tắc ứng xử AI hiện hành của Microsoft cũng yêu cầu các hệ thống tự đưa ra quyết định và hành động một cách tự chủ phải có cơ chế giám sát, can thiệp của con người. Bộ quy tắc hiện hành được trình bày chi tiết tại Bộ quy tắc ứng xử dịch vụ AI của Microsoft.

Động thái này diễn ra trong bối cảnh giới công nghệ tiếp tục tranh luận về việc có nên làm chậm tốc độ phát triển các mô hình AI tiên tiến hay không. Dario Amodei, CEO Anthropic, từng lên tiếng cho rằng cần làm chậm tốc độ nâng cao năng lực AI.

Sam Altman, CEO OpenAI, cho biết ông đồng tình với quan điểm của Amodei, còn Elon Musk cũng phản hồi rằng “Dario nói đúng”. Quan điểm chung là nên dành nhiều thời gian hơn cho nghiên cứu và kiểm chứng an toàn thay vì chạy đua tốc độ một cách thiếu kiểm soát.

Satya Nadella, CEO Microsoft, cho biết ông ủng hộ việc đầu tư nhiều hơn cho nghiên cứu alignment (định hướng AI theo mục tiêu và chuẩn an toàn do con người đặt ra) và duy trì tốc độ phát triển thận trọng. Alignment là lĩnh vực nghiên cứu nhằm đảm bảo AI hành động đúng theo mục tiêu và tiêu chuẩn an toàn mà con người đề ra.

Trước đó, Sam Altman từng đề cập khả năng sẽ thảo luận với các phòng thí nghiệm AI khác về việc làm chậm tốc độ nghiên cứu AI tiên tiến. Tuy nhiên đến nay vẫn chưa rõ liệu lịch trình nghiên cứu hay kế hoạch ra mắt mô hình trên thực tế có thay đổi hay không.

Việc điều chỉnh tốc độ phát triển không đồng nghĩa với việc toàn ngành AI sẽ dừng lại. Các công ty vẫn tiếp tục cạnh tranh về hiệu năng mô hình, đồng thời cân nhắc tăng cường đánh giá an toàn, kiểm chứng từ bên ngoài và cơ chế can thiệp của con người.

Microsoft cho biết sẽ tham vấn các chuyên gia trong lĩnh vực pháp lý, đạo đức, ngôn ngữ học và triết học, đồng thời tổ chức các nhóm thảo luận (focus group) để lắng nghe ý kiến công chúng. Công ty dự kiến sẽ điều chỉnh bộ quy tắc tạm thời dựa trên các ý kiến thu thập được.

Microsoft cũng có kế hoạch xây dựng thêm quy định nhằm hạn chế việc các AI agent giao tiếp với nhau theo cách thiếu minh bạch. Đây là biện pháp nhằm kiểm soát tình huống các hệ thống AI trao đổi thông tin với nhau theo cách con người khó nắm bắt.

Việc các nguyên tắc mới sẽ ảnh hưởng thế nào đến hiệu năng và tốc độ phát triển mô hình trên thực tế sẽ được kiểm chứng trong quá trình áp dụng vào năm 2027.

<Bản quyền ⓒ TokenPost, nghiêm cấm sao chép và phân phối trái phép>

Phổ biến nhất

Các bài viết liên quan khác

Bình luận 0

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.

0/1000

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.
1