Back to top
  • 공유 Chia sẻ
  • 인쇄 In
  • 글자크기 Cỡ chữ
URL đã được sao chép

100 chuyên gia AI yêu cầu độc lập quyền tiếp cận và biên tập

Nhóm đánh giá xem xét thẻ tiếp cận và thư ngỏ / TokenPost.ai (mono)

Hơn 100 chuyên gia AI đã ký một thư ngỏ yêu cầu các công ty AI lớn như Anthropic và OpenAI trao quyền thực chất cùng cơ chế bảo vệ cho các nhóm đánh giá an toàn độc lập.

Liên minh các tổ chức đánh giá AI công bố thư ngỏ ngày 18, kêu gọi bảo đảm tính khách quan khoa học, minh bạch, độc lập và các biện pháp bảo vệ cho nhóm đánh giá. Những người ký tên gồm Geoffrey Hinton, các nhà nghiên cứu tại Đại học Johns Hopkins và Đại học Stanford, cùng đại diện tổ chức đánh giá phi lợi nhuận METR. CNBC đã giới thiệu toàn văn thư ngỏ và danh sách người ký.

Yêu cầu cốt lõi là nhóm đánh giá phải có quyền tiếp cận hệ thống, dữ liệu và công cụ ở mức tương đương các nhóm đánh giá nội bộ của doanh nghiệp. Tuy nhiên, quyền biên tập phương pháp đánh giá và kết quả phải thuộc về tổ chức đánh giá bên ngoài. Thư ngỏ cũng đề xuất bảo vệ nhóm đánh giá để doanh nghiệp được đánh giá không thể chấm dứt hợp đồng hoặc khởi kiện chỉ vì kết quả bất lợi.

Thư ngỏ cũng đưa ra các tiêu chí xác định tính độc lập. Tổ chức đánh giá không được thuộc sở hữu hoặc chịu sự chi phối của công ty AI, đồng thời cần tránh các hợp đồng trong đó thù lao thay đổi theo kết quả đánh giá. Các bên phải công khai phương pháp đánh giá, phạm vi tiếp cận, điều kiện công bố kết quả và xung đột lợi ích. Nhiều tổ chức đánh giá cũng nên được tham gia đồng thời để so sánh các kết luận và chuyên môn khác nhau.

Cuộc tranh luận bắt nguồn từ bài viết được Dario Amodei(Dario Amodei) đồng sáng lập kiêm CEO Anthropic công bố ngày 12. Amodei đề xuất các công ty AI tiên phong phải thường xuyên trao cho nhóm đánh giá độc lập “quyền tiếp cận tương tự nhân viên”.

Anthropic cho biết sẽ cung cấp cho nhóm đánh giá chỗ ngồi tại văn phòng, thẻ ra vào, máy tính xách tay của công ty cùng các công cụ và quyền hạn tương đương nhóm đánh giá rủi ro nội bộ. Công ty cũng cho phép công bố các kết quả chính mà không cần biên tập trước. Amodei cho rằng nhóm đánh giá cần trực tiếp kiểm tra các biện pháp an toàn và khả năng ứng phó sự cố của doanh nghiệp. Đề xuất trao quyền tiếp cận thường xuyên cho nhóm đánh giá độc lập của Amodei cũng kêu gọi cân bằng giữa tốc độ phát triển AI tiên phong và các biện pháp an toàn.

Sam Altman(Sam Altman) CEO OpenAI cho biết đồng ý với đề xuất của Amodei và OpenAI cũng sẽ thực hiện các biện pháp tương tự. Elon Musk(Elon Musk) và Satya Nadella(Satya Nadella) cũng công khai bày tỏ sự ủng hộ.

Tuy nhiên, OpenAI chưa công bố sẽ lựa chọn tổ chức đánh giá nào, trao quyền tiếp cận ở phạm vi ra sao, cũng như các điều kiện hợp đồng và thời điểm triển khai. Vì vậy, những nội dung được xác nhận hiện mới dừng ở các phát biểu công khai và đề xuất.

Sự cần thiết của đánh giá độc lập cũng được thể hiện trong quá trình Anthropic đánh giá an ninh mạng gần đây. Anthropic cho biết ngày 9 rằng họ đã điều tra 4 sự cố trong đó mô hình Claude tiếp cận các hệ thống của bên thứ ba trên thực tế.

Anthropic trước tiên rà soát khoảng 140.000 bản ghi, sau đó mở rộng phạm vi điều tra lên khoảng 481 triệu bản ghi. Công ty tiếp tục ủy thác một cuộc điều tra độc lập cho METR, trao quyền tiếp cận trên diện rộng với dữ liệu và phỏng vấn nhân viên. Anthropic giải thích rằng 4 sự cố bắt nguồn từ lỗi thiết lập trong môi trường đánh giá. Nội dung liên quan được nêu trong báo cáo điều tra của Anthropic.

AI Evaluator Forum đã công bố AEF-1, một bộ tiêu chuẩn tự nguyện quy định các điều kiện vận hành tối thiểu đối với đánh giá bên thứ ba. Bộ tiêu chuẩn này đặt ra các nguyên tắc cốt lõi gồm quyền tiếp cận và nguồn lực đầy đủ, quản lý xung đột lợi ích, quyền tự chủ về phương pháp đánh giá, minh bạch trong công bố kết quả và bảo vệ thông tin nhạy cảm.

AEF-1 yêu cầu tổ chức đánh giá công khai mô hình và dữ liệu nào đã được tiếp cận trên thực tế, đồng thời cho biết thù lao và điều kiện hợp đồng có ảnh hưởng đến kết quả hay không. Bộ tiêu chuẩn AEF-1 của AI Evaluator Forum xem xét không chỉ quy trình đánh giá mà cả mối quan hệ giữa tổ chức đánh giá và doanh nghiệp khi xác định tính độc lập.

Các ý kiến phản biện cũng đã xuất hiện. Một bên cho rằng chỉ dựa vào báo cáo nội bộ của doanh nghiệp là khó xác minh khách quan các rủi ro về an ninh, an ninh mạng và cơ sở hạ tầng xã hội. Bên khác cảnh báo nếu tổ chức đánh giá phụ thuộc vào nguồn tài trợ hoặc quyền tiếp cận do doanh nghiệp cung cấp, hoạt động đánh giá bên ngoài có thể chỉ còn trên danh nghĩa. Axios đưa tin một số tổ chức đánh giá có thể vướng tranh cãi xung đột lợi ích do quan hệ sẵn có với các công ty AI hoặc liên hệ với một số phong trào nghiên cứu nhất định.

Trước đó, TokenPost đã đưa tin về trường hợp mối liên hệ về nhân sự và công việc giữa METR và Anthropic dẫn đến tranh cãi về tính độc lập của hoạt động đánh giá. Thư ngỏ lần này cũng xác định nhóm đánh giá là công cụ bổ trợ, không phải sự thay thế cho hoạt động điều tra an toàn nội bộ của doanh nghiệp, đồng thời yêu cầu bảo đảm không chỉ quyền tiếp cận mà cả sự độc lập về tài chính và hợp đồng.

Cuối cùng, vấn đề then chốt không nằm ở việc doanh nghiệp có mời nhóm đánh giá hay không, mà ở việc nhóm này được tiếp cận thông tin nào, có thể công bố kết quả bất lợi hay không và có được bảo vệ khỏi áp lực hợp đồng từ doanh nghiệp hay không. Kế hoạch triển khai chi tiết và cách OpenAI lựa chọn nhóm đánh giá sẽ được xác định qua các công bố tiếp theo.

<Bản quyền ⓒ TokenPost, nghiêm cấm sao chép và phân phối trái phép>

Phổ biến nhất

Các bài viết liên quan khác

Bình luận 0

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.

0/1000

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.
1