Back to top
  • 공유 Chia sẻ
  • 인쇄 In
  • 글자크기 Cỡ chữ
URL đã được sao chép

Microsoft đề xuất phối hợp an toàn AI, công bố quy tắc ứng xử mô hình

Bàn tay xem xét tài liệu chính sách đang trong giai đoạn lấy ý kiến công khai / TokenPost.ai

Microsoft($MSFT) đã đề xuất phối hợp an toàn giữa các phòng thí nghiệm AI hàng đầu và công bố quy tắc ứng xử nêu rõ nguyên tắc phát triển mô hình AI của riêng hãng. Hệ thống đánh giá chung, danh sách công ty tham gia và lịch trình thỏa thuận vẫn chưa được xác định.

Mustafa Suleyman, CEO mảng AI của Microsoft($MSFT), nói với Fortune trong cuộc phỏng vấn ngày 14 rằng “Đã đến lúc cần sự phối hợp” (Now’s the time for coordination). Ý tưởng là các phòng thí nghiệm AI công khai hiệu năng và mức độ rủi ro của mô hình cho một bên thứ ba có trách nhiệm để cùng kiểm tra độ an toàn.

Suleyman cho biết việc lựa chọn bên thứ ba trung lập, phạm vi tiếp cận nội bộ công ty của người đánh giá, thời điểm thực hiện đánh giá và sự phối hợp với cơ quan quản lý là những vấn đề còn phải giải quyết. Phạm vi cụ thể của hành động chung và cách công bố kết quả đánh giá cũng chưa được ấn định.

Quy tắc ứng xử mang tên “Humanist AI” mà Microsoft($MSFT) công bố quy định mô hình AI không được chống lại việc con người dừng, chỉnh sửa, ra lệnh lại hoặc tắt hệ thống. Quy tắc cũng nêu rõ mô hình không được tự đặt ra mục tiêu cho riêng mình, hoặc đảm nhận những nhiệm vụ chỉ có thể thực hiện được nếu vi phạm chính quy tắc ứng xử này.

Quy tắc ứng xử nêu rõ AI cần được thiết kế như một công cụ hỗ trợ con người, chứ không phải một thực thể có quyền ngang bằng con người. Hành vi mô hình giả vờ có cảm xúc, ý thức hay động cơ nội tại cũng nằm trong danh sách bị hạn chế.

Việc phát triển vũ khí hóa học, sinh học, hạt nhân, tấn công mạng có chủ đích, thao túng dư luận trên diện rộng, bóc lột trẻ em, deepfake không có sự đồng thuận và hỗ trợ hành vi tự hại đều bị xếp vào nhóm bị cấm. Microsoft($MSFT) cho biết sẽ áp dụng các nguyên tắc này vào quá trình phát triển mô hình AI của chính hãng.

Microsoft($MSFT) dự kiến lấy ý kiến công khai về quy tắc ứng xử trong 6 tuần tới. Các nguyên tắc sau khi chỉnh sửa sẽ được dùng làm tiêu chuẩn định hướng phát triển mô hình từ năm 2027, và hãng cho biết điều này có thể giới hạn phần nào tính đa năng, khả năng tự chủ và năng lực của AI.

Quy tắc ứng xử lần này tập trung vào nguyên tắc kiểm soát mô hình nội bộ của Microsoft($MSFT) hơn là một thỏa thuận ngành có sự tham gia của nhiều công ty. Việc các mô hình bên ngoài cung cấp qua Azure và mô hình của khách hàng doanh nghiệp có áp dụng cùng tiêu chuẩn hay không vẫn chưa được xác định.

Dario Amodei, CEO Anthropic, hôm 12 đề xuất cấp cho các bên đánh giá độc lập quyền tiếp cận liên tục tương tự nhân viên công ty, đồng thời làm chậm tốc độ phát triển AI. Ông cũng đưa ra phương án cấp chỗ ngồi văn phòng, quyền ra vào và máy tính xách tay của công ty cho người đánh giá.

Ý tưởng của Amodei gồm ba giai đoạn: bố trí thường trực bên đánh giá độc lập trong quá trình phát triển, xây dựng tiêu chuẩn an toàn chung giữa các công ty AI ở các nước dân chủ, sau đó mở rộng thành sự phối hợp quốc tế bao gồm cả các nước độc tài. Phạm vi Anthropic cam kết thực hiện ngay hiện nay là việc đưa vào bên đánh giá độc lập.

Sam Altman, CEO OpenAI, trong phỏng vấn với Fortune cho rằng tiêu chuẩn an toàn AI đang không theo kịp tốc độ phát triển năng lực của mô hình, đồng thời báo hiệu khả năng hợp tác với các phòng thí nghiệm khác. Danh sách công ty tham gia, lịch trình thỏa thuận và tiêu chuẩn đánh giá chưa được công bố.

Ý tưởng hợp tác an toàn AI giữa Mỹ và Trung Quốc cũng được nhắc tới, nhưng hai nước chưa xác định hệ thống kiểm chứng áp dụng chung. Trong các cuộc đối thoại Mỹ - Trung, khả năng giám sát tấn công mạng dựa trên AI và chia sẻ thông tin giữa các phòng thí nghiệm được cho là có thể sẽ được bàn tới.

Theo Fortune, việc các công ty AI phối hợp tốc độ phát triển có thể xung đột với luật chống độc quyền của Mỹ và có thể cần sự hỗ trợ từ chính phủ. Phạm vi tiếp cận thông tin của từng quốc gia trong hợp tác quốc tế vẫn là vấn đề cần bàn thêm.

Hiện chưa xác định được mối liên hệ trực tiếp giữa thông báo này với ngành tiền mã hóa, blockchain trong nước hay chuỗi cung ứng chất bán dẫn. Vấn đề an toàn mô hình AI có liên quan gián tiếp tới hạ tầng điện toán đám mây và tính toán, nhưng tác động cụ thể tới các loại tiền mã hóa hay công ty bán dẫn nào thì chưa được nêu ra.

Hiện tại, quy trình đã được xác nhận là Microsoft($MSFT) sẽ lấy ý kiến công khai về quy tắc ứng xử trong 6 tuần, và áp dụng các nguyên tắc đã chỉnh sửa làm tiêu chuẩn phát triển mô hình của hãng từ năm 2027. Một thỏa thuận chính thức có sự tham gia của toàn ngành hay hệ thống đánh giá chung vẫn còn ở giai đoạn đề xuất.

<Bản quyền ⓒ TokenPost, nghiêm cấm sao chép và phân phối trái phép>

Phổ biến nhất

Các bài viết liên quan khác

Bình luận 0

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.

0/1000

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.
1