Các chính phủ nên trực tiếp tham gia đánh giá trước khi các mô hình trí tuệ nhân tạo (AI) tiên tiến được công bố, theo đề xuất nhằm ngăn doanh nghiệp tự quyết định giới hạn rủi ro của AI.
Mustafa Suleyman (Mustafa Suleyman), người đứng đầu bộ phận AI của Microsoft($MSFT), ngày 24 cho biết trong bản tin của Bloomberg rằng các mô hình AI tiên tiến cần có 'lằn ranh đỏ' rõ ràng và hệ thống đánh giá không nên được giao hoàn toàn cho doanh nghiệp. Ông không đưa ra tiêu chuẩn kỹ thuật hay lịch triển khai cụ thể.
Đề xuất này gắn với cuộc thảo luận về việc mở rộng quản lý AI từ giám sát sau khi mô hình ra mắt sang đánh giá trước khi phát hành. Theo hướng này, chính phủ có thể kiểm tra mức độ rủi ro trước khi mô hình được công bố, qua đó bổ sung cho các tiêu chuẩn an toàn do nhà phát triển tự xây dựng.
Microsoft đã công bố cơ chế hợp tác với Trung tâm Tiêu chuẩn và Đổi mới AI của Mỹ (CAISI) và Viện An toàn AI Anh (AISI) để kiểm tra độ an toàn cũng như các năng lực rủi ro cao của mô hình tiên phong. Hai cơ chế này khác với制度 chính phủ phê duyệt trước việc phát hành mô hình.
Trong tài liệu công bố hồi tháng 5, Microsoft cho biết sẽ cùng Viện Tiêu chuẩn và Công nghệ Quốc gia Mỹ (NIST) phát triển phương pháp đánh giá đối kháng. Đây là cách cố ý kiểm tra những hành vi ngoài dự kiến, đường dẫn lạm dụng và khả năng thất bại của mô hình AI.
Đối tượng phát triển còn bao gồm khung chung, bộ dữ liệu và quy trình tác nghiệp nhằm nâng cao khả năng tái lập của hệ thống đánh giá. Mục tiêu là tiêu chuẩn hóa phương pháp thử để có thể so sánh kết quả khi kiểm tra cùng một mô hình trong các điều kiện tương tự.
Hợp tác với AISI của Anh tập trung vào việc xác minh các năng lực rủi ro cao và hiệu quả của các biện pháp bảo vệ. Phạm vi hợp tác cũng bao gồm nghiên cứu khả năng chống chịu xã hội, xem xét cách AI hội thoại tương tác với người dùng trong các tình huống nhạy cảm.
CAISI hoạt động như đầu mối trong chính phủ Mỹ cho việc thử nghiệm các hệ thống AI thương mại và nghiên cứu chung. Tháng 5 vừa qua, cơ quan này đã công bố kết quả đánh giá mô hình DeepSeek V4 Pro của Trung Quốc trong các lĩnh vực an ninh mạng, kỹ thuật phần mềm, khoa học tự nhiên, suy luận trừu tượng và toán học.
AISI của Anh cũng đang đánh giá các mô hình tiên phong trong các lĩnh vực mạng, sinh học, hóa học, tính tự chủ và biện pháp bảo vệ. AISI cho biết một số năng lực AI đã tăng gấp đôi khoảng mỗi 8 tháng, đồng thời cảnh báo kết quả thử nghiệm có kiểm soát có thể không phản ánh đầy đủ hiệu suất và rủi ro trong môi trường sử dụng thực tế.
Khung quản trị mô hình tiên phong của Microsoft bao gồm đánh giá năng lực rủi ro cao, xác minh bên ngoài, phân loại rủi ro mô hình và nguyên tắc công khai thông tin đánh giá. Tuy nhiên, phạm vi công khai có thể bị giới hạn đối với thông tin nhạy cảm về thương mại hoặc có nguy cơ bị lạm dụng.
Để đánh giá của chính phủ hoạt động hiệu quả, cần bảo đảm tính độc lập của cơ quan đánh giá cùng quyền tiếp cận dữ liệu nội bộ của doanh nghiệp. Mức độ công khai kết quả cũng sẽ là vấn đề cần được doanh nghiệp phát triển mô hình và chính phủ phối hợp xác định.
Một hướng khác đang được thảo luận là kết hợp đánh giá nội bộ của doanh nghiệp với đánh giá bên ngoài. TokenPost trước đó từng đưa tin Anthropic hợp tác với một cơ quan đánh giá AI đặt nhân sự thường trú bên trong công ty; khi đó, phạm vi tiếp cận và tính độc lập tài chính của bên đánh giá cũng được xem là các vấn đề then chốt.
Trên mạng, một số ý kiến ủng hộ tăng cường giám sát của chính phủ, trong khi những ý kiến khác lo ngại các tập đoàn lớn có thể lợi dụng quy định để gây khó khăn cho doanh nghiệp cạnh tranh quy mô nhỏ. Tuy nhiên, đây chỉ là phản ứng của một bộ phận người dùng trực tuyến và khó có thể đại diện cho toàn ngành.
Đối với các doanh nghiệp AI và người dùng trong nước, tiêu chuẩn đánh giá và phạm vi công khai có thể trở thành những yếu tố cần kiểm tra khi đưa mô hình vào sử dụng. Tuy vậy, đề xuất lần này chưa nêu việc áp dụng trực tiếp vào quy định trong nước hay quy trình phát hành của doanh nghiệp trong nước.
Chưa rõ phát biểu của Suleyman có dẫn tới việc ban hành quy định thực tế hay không, cũng như việc đánh giá của chính phủ có trở thành thủ tục bắt buộc trước khi phát hành mô hình AI hay không. Các vấn đề như định nghĩa kỹ thuật của 'lằn ranh đỏ', hiệu lực pháp lý của kết quả đánh giá và phạm vi công khai dự kiến sẽ tiếp tục được thảo luận.
Bình luận 0