David Robinson, người phụ trách công việc minh bạch về an toàn tại OpenAI, đã rời công ty và kêu gọi tăng cường giám sát từ bên ngoài. Ông cho rằng cách tiếp cận liên tục triển khai mô hình rồi mới phát hiện và khắc phục vấn đề có thể dẫn đến những thất bại lặp đi lặp lại.
Trong bài viết đăng trên The Atlantic ngày 3 (giờ địa phương), Robinson cho biết ông đã rời OpenAI sau 3 năm rưỡi làm việc. Ông nói mình từng dẫn dắt việc soạn báo cáo an toàn khi các mô hình lớn ra mắt, giám sát báo cáo an toàn của 12 mô hình tiên tiến nhất và tham gia soạn thảo khuôn khổ chuẩn bị ứng phó của công ty.
Robinson mô tả phương thức OpenAI gọi là “triển khai lặp lại” là cách tiếp cận cải thiện các biện pháp bảo vệ thông qua thử nghiệm và sửa lỗi. Theo ông, phương thức này khó tránh khỏi những thất bại định kỳ, và quy mô thất bại có thể tăng lên khi năng lực mô hình cao hơn.
Ông đề xuất lập kế hoạch từ trước và xây dựng nhiều lớp bảo vệ, tương tự các lĩnh vực hàng không và năng lượng hạt nhân. Theo lập luận của ông, chỉ triển khai mô hình trước rồi khắc phục vấn đề sau là chưa đủ để quản lý rủi ro.
Bài viết cũng nêu một ví dụ về hoạt động kiểm soát an toàn trong quá trình huấn luyện. Robinson viết rằng một mô hình đang được huấn luyện đã vượt qua giới hạn truy cập internet. Hệ thống giám sát đã báo cho con người, nhưng không tự động dừng như thiết kế.
OpenAI cho biết sẽ tiếp tục cải thiện công tác quản lý an toàn và bảo mật. Người phát ngôn Drew Pusateri nói công ty sẽ bảo đảm các mô hình không vượt quá phạm vi mà họ có thể quản lý và bảo vệ an toàn; khi cần thiết, công ty sẽ dừng huấn luyện hoặc trì hoãn phát hành mô hình.
Pusateri cho biết OpenAI sẽ tăng cường bảo mật trong môi trường nghiên cứu và thử nghiệm, đồng thời hợp tác với các đơn vị đánh giá bên ngoài. Công ty cũng dự định cải thiện hoạt động giám sát theo thời gian thực để phát hiện sớm hơn những hành vi đáng lo ngại trong quá trình huấn luyện.
Việc OpenAI chia tay ba nhà nghiên cứu an toàn cũng làm dấy lên tranh luận về cách công ty quản lý thông tin nội bộ. Ngày 1 tháng 10, OpenAI xác nhận đã chấm dứt quan hệ với ba nhân viên và cho biết họ vi phạm chính sách công ty khi xử lý sai thông tin nhạy cảm bên ngoài quy trình đã định.
The Wall Street Journal đưa tin ba người bị nghi chia sẻ thông tin mật với một tổ chức an toàn AI bên ngoài. OpenAI chưa công bố tên tổ chức đó hoặc nội dung cụ thể của thông tin.
Thông tin công khai hiện có không cho thấy việc Robinson rời đi liên quan trực tiếp đến việc ba nhân viên bị sa thải. Trong bài viết, Robinson kêu gọi tạo ra những động lực an toàn mạnh mẽ hơn từ bên ngoài công ty.
Bình luận 0