Back to top
  • 공유 Chia sẻ
  • 인쇄 In
  • 글자크기 Cỡ chữ
URL đã được sao chép

Fei-Fei Li yêu cầu chuẩn đánh giá AI độc lập

Các tài liệu đánh giá AI được so sánh trong không gian phỏng vấn / TokenPost.ai

Fei-Fei Li, CEO World Labs, cho rằng không nên giao việc đánh giá trí tuệ nhân tạo (AI) tiên tiến hoàn toàn cho các công ty phát triển, đồng thời kêu gọi xây dựng cơ chế giám sát độc lập với sự tham gia của giới học thuật, chính phủ và ngành công nghiệp.

Bloomberg cho biết trong cuộc phỏng vấn công bố ngày 22 rằng bà Li nhận định cần có các chuẩn đánh giá độc lập và mô hình đánh giá đa bên. Nếu doanh nghiệp AI tự xây dựng tiêu chí rồi dùng chính các tiêu chí đó để đánh giá mô hình của mình, tính khách quan và trách nhiệm giải trình của kết quả sẽ khó được bảo đảm.

Chuẩn đánh giá độc lập không đồng nghĩa với việc cơ quan đánh giá phải độc lập. Chuẩn đánh giá là hệ thống kiểm thử quy định tiêu chí dùng để so sánh các mô hình AI. Ngay cả khi cơ quan đánh giá ở bên ngoài, kết quả vẫn có thể trở thành công cụ quảng bá hiệu suất nếu công ty phát triển quyết định tiêu chí kiểm thử và phạm vi đánh giá.

Bối cảnh trực tiếp của tranh luận là đề xuất đưa các nhà đánh giá bên ngoài vào làm việc thường trực trong các công ty AI. Dario Amodei, CEO Anthropic, đề xuất trao cho các nhà đánh giá bên ngoài quyền tiếp cận hệ thống tương đương nhân viên công ty. Sam Altman, CEO OpenAI, cũng đồng tình với ý tưởng này.

Theo phương án trên, nhóm đánh giá sẽ sử dụng văn phòng, thẻ ra vào và thiết bị của doanh nghiệp để kiểm tra các hoạt động an toàn. AP cho biết cách để nhà đánh giá bên ngoài tiếp cận hệ thống nội bộ và môi trường làm việc của doanh nghiệp đã được nêu trong các cuộc thảo luận liên quan.

Ý kiến phản đối cho rằng tính độc lập có thể bị tổn hại nếu doanh nghiệp được đánh giá vừa lựa chọn cơ quan đánh giá vừa chi trả chi phí. Aidan Gomez, CEO Cohere, chỉ trích việc một số ít doanh nghiệp có lợi ích thương mại không nên tự đặt ra quy tắc AI. Elham Tabassi, nhà nghiên cứu tại Viện Brookings, cũng cho rằng chỉ dựa vào các cam kết tự nguyện của doanh nghiệp là chưa đủ.

Bà Tabassi cho rằng cần có phương pháp đánh giá có thể được kiểm chứng về mặt khoa học. Những phát biểu này đặt ra vấn đề rằng chỉ bổ sung nhà đánh giá bên ngoài chưa đủ để bảo đảm tính khách quan và trách nhiệm giải trình của hoạt động đánh giá.

Các nhà đánh giá AI cũng tiếp tục đưa ra yêu cầu công khai. AI Evaluator Forum cho biết trong thư ngỏ ngày 18 với sự tham gia của hơn 100 nhà nghiên cứu và nhà đánh giá rằng các tổ chức đánh giá bên thứ ba phải được bảo đảm quyền phán đoán và biên tập độc lập, cùng quyền tiếp cận hệ thống và đủ thời gian cần thiết cho hoạt động đánh giá.

Thư ngỏ cũng yêu cầu có cơ chế ngăn doanh nghiệp trả đũa. Mục tiêu là bảo vệ các tổ chức đánh giá để họ không phải thay đổi kết luận vì nguy cơ chấm dứt hợp đồng hoặc bị đe dọa kiện tụng, ngay cả khi đưa ra kết quả bất lợi cho doanh nghiệp.

Các nguyên tắc minh bạch đánh giá do AI Evaluator Forum công bố năm 2025 cũng nêu quyền kiểm soát phương pháp đánh giá, quyền biên tập kết quả, mức độ tiếp cận hệ thống và việc công khai xung đột lợi ích giữa tổ chức đánh giá với bên phát triển là những điều kiện cốt lõi. Chưa xác định được các nguyên tắc này đã trở thành điều khoản trong hợp đồng doanh nghiệp hoặc nghĩa vụ pháp lý trên thực tế hay chưa.

Trước đó, bà Li cũng đề xuất cách tiếp cận thể chế có bao gồm kiểm chứng của bên thứ ba. Nhóm công tác chính sách chung về các mô hình AI tiên phong của California đã đề xuất trong báo cáo năm 2025 việc gắn đánh giá rủi ro với kiểm toán bên thứ ba và mở rộng tính minh bạch. Bà Li là một trong những đồng tác giả của báo cáo.

Cuộc tranh luận lần này tiếp nối yêu cầu công khai trước đó về việc bảo đảm quyền tiếp cận hệ thống và quyền biên tập kết quả cho nhóm đánh giá an toàn AI. Vấn đề cốt lõi không chỉ là sự tồn tại của nhà đánh giá bên ngoài, mà còn là ai có quyền đặt ra tiêu chí đánh giá và công khai hoặc sửa đổi kết quả.

Đối với các doanh nghiệp AI và nhà hoạch định chính sách tại Việt Nam, tranh luận này đưa ra những tiêu chí cần xem xét, gồm chủ thể lựa chọn cơ quan đánh giá, cơ cấu chi phí, phạm vi tiếp cận hệ thống và cách thức công khai kết quả có được thiết kế độc lập hay không. Việc giao đánh giá cho một tổ chức bên ngoài tự nó chưa bảo đảm tính độc lập của kết quả.

Hiện chưa có quyết định thành lập cơ quan giám sát độc lập hoặc quy định có tính ràng buộc nào được xác nhận. Điều đã được xác nhận là các công ty AI và nhà nghiên cứu đang yêu cầu một hệ thống đánh giá có tính độc lập, quyền tiếp cận và tính minh bạch. Việc các đề xuất này có trở thành hợp đồng và thể chế thực tế hay không sẽ cần thêm thảo luận.

<Bản quyền ⓒ TokenPost, nghiêm cấm sao chép và phân phối trái phép>

Phổ biến nhất

Các bài viết liên quan khác

Bình luận 0

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.

0/1000

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.
1