Tranh luận về tính độc lập của đánh giá an toàn AI đã nóng trở lại khi các chuyên gia cho rằng quyền truy cập vào hệ thống doanh nghiệp không đủ để bảo đảm kết quả đánh giá độc lập nếu bên đánh giá vẫn phụ thuộc vào tổ chức và hợp đồng.
Diễn đàn Đánh giá AI (AI Evaluator Forum) cho biết trong thư ngỏ công bố ngày 18 rằng các tổ chức đánh giá bên ngoài cần có tính độc lập về cấu trúc, quyền biên tập đối với kết quả đánh giá, quyền truy cập đầy đủ vào hệ thống và dữ liệu được đánh giá, cơ chế công khai minh bạch và biện pháp chống trả đũa. Thư ngỏ của Diễn đàn Đánh giá AI nêu nguyên tắc phải công khai phương pháp, phạm vi tiếp cận và xung đột lợi ích trong hoạt động đánh giá bên thứ ba.
Có thông tin cho rằng hơn 100 nhà nghiên cứu và đánh giá viên AI đã tham gia thư ngỏ, nhưng bản danh sách chữ ký trước đó được xác nhận trên trang chính thức của diễn đàn chỉ có khoảng 40 người và được công bố ngày 4 tháng 12 năm 2025. Toàn bộ danh sách người ký thư ngỏ ngày 18 chưa được xác nhận.
Bối cảnh tranh luận là đề xuất bố trí đánh giá viên độc lập thường trực bên trong các công ty AI. Dario Amodei, CEO Anthropic, đề xuất trao cho đánh giá viên bên ngoài quyền truy cập liên tục ở mức tương đương nhân viên. Anthropic cho biết có thể cung cấp không gian làm việc, thẻ ra vào và máy tính xách tay của công ty.
Sam Altman, CEO OpenAI, cũng đồng ý với phương án này và cho biết OpenAI sẽ tham gia. AP đưa tin Anthropic và OpenAI ủng hộ mô hình vận hành bao gồm quyền truy cập thường xuyên cho đánh giá viên bên ngoài. AP đưa tin
Diễn đàn Đánh giá AI cho rằng quyền truy cập và tính độc lập không phải là một khái niệm. Dù đánh giá viên có thể xem hệ thống nội bộ và tài liệu không công khai, doanh nghiệp vẫn có thể kiểm soát việc lựa chọn, ký hợp đồng và phạm vi công bố của họ, từ đó khiến các kết quả bất lợi khó được công khai.
Tiêu chuẩn AEF-1 do diễn đàn đề xuất đưa ra các điều kiện của đánh giá độc lập, gồm quyền tiếp cận đầy đủ về kỹ thuật và thông tin, giảm thiểu xung đột lợi ích, quyền tự chủ trong phân tích, tính minh bạch của phương pháp và kết quả, cùng việc bảo vệ thông tin nhạy cảm. Tiêu chuẩn AEF-1 không nhằm thay thế hoạt động giám sát của cơ quan quản lý hoặc chính phủ, mà đưa ra các điều kiện vận hành tối thiểu để đánh giá bên ngoài có thể hoạt động.
Theo AEF-1, đánh giá viên phải công khai danh sách kiểm tra cùng với kết quả, qua đó giải thích phạm vi tiếp cận và tình trạng xung đột lợi ích tại thời điểm đánh giá. Nếu không đáp ứng một số điều kiện, lý do cũng phải được ghi nhận.
Cuộc thảo luận lần này cụ thể hóa các nguyên tắc độc lập trong đánh giá bên thứ ba thành vấn đề vận hành của mô hình đánh giá viên thường trực bên trong doanh nghiệp, tiếp nối cuộc thảo luận trước đó về yêu cầu độc lập giữa quyền truy cập và quyền biên tập trong đánh giá an toàn AI. Nếu tranh luận trước tập trung vào nguyên tắc độc lập của đánh giá bên thứ ba, vấn đề lần này là liệu đánh giá viên làm việc bên trong doanh nghiệp có thể đưa ra nhận định và công bố kết quả một cách độc lập hay không.
Các doanh nghiệp cho rằng kết hợp chuyên môn nội bộ với quyền truy cập của đánh giá viên bên ngoài là phương án thực tế. Cách tiếp cận này nhằm mở hệ thống cần bảo mật và bảo vệ bí mật kinh doanh cho đánh giá viên bên ngoài, đồng thời tận dụng hỗ trợ kỹ thuật từ nhân sự nội bộ.
Ngược lại, các tổ chức đánh giá và nhà nghiên cứu cho rằng ý nghĩa của đánh giá bên ngoài có thể suy yếu nếu doanh nghiệp được đánh giá kiểm soát việc lựa chọn đánh giá viên, điều kiện hợp đồng và phương thức công bố kết quả. Mối liên hệ về nhân sự và tài chính giữa tổ chức đánh giá, công ty AI và một số phong trào nghiên cứu cũng được nêu như một vấn đề xung đột lợi ích.
Axios đưa tin về tranh luận cho rằng một số đánh giá viên bên thứ ba có quan hệ gần gũi với doanh nghiệp được đánh giá hoặc một số phong trào nghiên cứu. Axios đưa tin cho rằng khi đánh giá tính độc lập của tổ chức đánh giá, cần xem xét cả các mối liên hệ về tài chính, nhân sự và cách thức công bố kết quả.
Trong các tranh luận trước đây về an toàn AI, tính độc lập của quyền đánh giá và hạ tầng xác minh cũng được xem là vấn đề cốt lõi. Lo ngại rằng một số ít doanh nghiệp có thể kiểm soát cả tiêu chuẩn an toàn và kết quả đánh giá đang chuyển thành câu hỏi về cách phân tách quyền hạn và nghĩa vụ công khai của đánh giá viên khi mô hình đánh giá thường trực bên trong doanh nghiệp được mở rộng.
Anthropic và OpenAI chưa cụ thể hóa mức quyền hạn sẽ trao cho đánh giá viên bên ngoài, cũng như bên nào quyết định việc lựa chọn đánh giá viên và công bố kết quả. Để hệ thống đánh giá độc lập hoạt động, cần tiếp tục xác định cách đưa quyền truy cập, quyền công khai và biện pháp chống trả đũa vào hợp đồng và quy trình vận hành.
Bình luận 0