Back to top
  • 공유 Chia sẻ
  • 인쇄 In
  • 글자크기 Cỡ chữ
URL đã được sao chép

METR đánh giá độc lập rủi ro AI mất kiểm soát, từ chối tiền doanh nghiệp

Các nhà nghiên cứu xem xét tài liệu đánh giá an toàn AI / TokenPost.ai

Tổ chức phi lợi nhuận nghiên cứu METR tái khẳng định nguyên tắc đánh giá độc lập rủi ro trí tuệ nhân tạo (AI) mất kiểm soát và không nhận tài trợ từ các công ty AI tiên tiến hay nhân viên của họ.

Chris Painter (Chris Painter), chủ tịch METR, cho biết ngày 17 rằng tổ chức này đã tiến hành đánh giá và nghiên cứu bên thứ ba với OpenAI, Anthropic, Google DeepMind, Meta(META) và Amazon(AMZN) từ năm 2022.

METR đánh giá liệu AI đã tiến gần đến mức khó kiểm soát hay chưa và liệu hệ thống có thể vượt qua các quy trình kiểm soát hay không. Tổ chức này cho rằng khi phát hiện những dấu hiệu như vậy trong quá trình đánh giá nội bộ, họ phải có khả năng công bố thông tin liên quan cho công chúng và chính phủ.

METR không nhận thù lao hoặc tài trợ trực tiếp từ các doanh nghiệp được đánh giá. Tổ chức cũng không nhận đóng góp từ doanh nghiệp hoặc nhân viên của họ, mà hoạt động nhờ sự hỗ trợ của nhiều nhà tài trợ.

Thay vào đó, METR sử dụng quyền truy cập miễn phí vào các mô hình và token do doanh nghiệp cung cấp cho hoạt động đánh giá, nghiên cứu và phát triển. Cơ chế này tách biệt nguồn lực cần thiết cho nghiên cứu với khoản thù lao cho hoạt động đánh giá.

Tài liệu chính thức của METR cho biết OpenAI, Anthropic và xAI cung cấp quyền truy cập mô hình cùng token cần thiết cho đánh giá, nhưng không trả phí đánh giá. Việc tiếp cận các mô hình mới nhất cần sự hợp tác của doanh nghiệp, song điều này cũng đặt ra vấn đề độc lập khi chính doanh nghiệp đó là đối tượng được đánh giá.

Đánh giá bên thứ ba là phương thức trong đó một tổ chức tách biệt với bộ phận nội bộ doanh nghiệp xem xét năng lực và rủi ro của mô hình. Cách tiếp cận này giúp duy trì góc nhìn bên ngoài, nhưng phạm vi đánh giá và nội dung công bố có thể bị hạn chế nếu tổ chức đánh giá phụ thuộc vào doanh nghiệp về quyền truy cập mô hình và dữ liệu nội bộ.

Trong 'Báo cáo rủi ro biên giới' thực hiện vào tháng 2-3 năm 2026, METR cho biết Anthropic, Google, Meta và OpenAI đã cung cấp các mô hình nội bộ cùng thông tin không công khai. METR xem xét năng lực trực tiếp của mô hình và khả năng thực hiện hành vi che giấu.

Báo cáo cho biết METR vẫn giữ quyền kiểm soát phương pháp đánh giá và kết quả cuối cùng, nhưng một số đánh giá được thực hiện bởi các doanh nghiệp tham gia. Điều này cho thấy sự hợp tác của doanh nghiệp vừa cung cấp dữ liệu cần thiết cho đánh giá, vừa có thể trở thành vấn đề đối với tính độc lập.

METR cho rằng báo cáo vừa cho thấy năng lực AI được cải thiện nhanh chóng, vừa chỉ ra một số năng lực đã bị phóng đại. Khi diễn giải kết quả đánh giá năng lực, cần xem xét đồng thời hành vi được quan sát thực tế và khả năng phóng đại.

METR cho biết khi ký hợp đồng với doanh nghiệp, tổ chức sẽ cố gắng giữ lại tối đa các điều kiện hợp đồng được công khai, nội dung bị xóa và thông tin về xung đột lợi ích, ngay cả khi áp dụng điều khoản bảo mật. Đây là cách giải thích một phần quy trình đánh giá ra bên ngoài trong khi vẫn tiến hành đánh giá không công khai.

Tranh luận về tính độc lập tiếp tục xuất hiện sau khi các mối liên hệ về nhân sự và công việc giữa METR và Anthropic được biết đến. Các mối liên hệ về nhân sự và công việc giữa METR và Anthropic từng dẫn đến tranh luận về tính độc lập.

Anthropic và OpenAI đã đề xuất để các tổ chức đánh giá bên ngoài tiếp cận sâu hơn vào hệ thống nội bộ và quy trình phát triển mô hình của doanh nghiệp. Ngược lại, các tổ chức đánh giá cảnh báo rằng tính độc lập có thể suy yếu nếu doanh nghiệp kiểm soát phạm vi tiếp cận và nội dung công bố.

Hiện hoạt động đánh giá bên thứ ba vẫn phụ thuộc vào sự hợp tác tự nguyện của doanh nghiệp, trong khi quyền giám sát còn hạn chế. METR cho biết các cuộc thảo luận về tính độc lập, quyền tiếp cận và phạm vi công bố sẽ tiếp tục cho đến khi một hệ thống đánh giá rủi ro AI mất kiểm soát được thiết lập.

<Bản quyền ⓒ TokenPost, nghiêm cấm sao chép và phân phối trái phép>

Phổ biến nhất

Các bài viết liên quan khác

Bình luận 0

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.

0/1000

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.
1