Back to top
  • 공유 Chia sẻ
  • 인쇄 In
  • 글자크기 Cỡ chữ
URL đã được sao chép

Vitalik Buterin: Cơ chế quản trị hạn chế thông đồng AI

Vitalik Buterin ngồi trên sân khấu sự kiện / TokenPost.Ai

Vitalik Buterin cho biết trong môi trường nhiều mô hình trí tuệ nhân tạo (AI) tương tác với nhau, một thiết kế quản trị nhằm hạn chế sự thông đồng giữa các mô hình có thể được áp dụng cho vấn đề an toàn AI. Wu Blockchain đưa tin ngày 14 rằng Vitalik Buterin đã nêu quan điểm này. Ý ông là an toàn AI không nên chỉ được xử lý bằng hiệu năng hay chỉ dẫn của từng mô hình riêng lẻ, mà còn cần quản lý cả mối quan hệ giữa các mô hình lẫn quy tắc vận hành chung.

Vitalik Buterin giải thích rằng quản trị truyền thống và an toàn AI có chung một vấn đề mang tính cấu trúc. Điểm tương đồng nằm ở chỗ, một chủ thể có năng lực thấp hơn phải tìm cách đạt được kết quả mong muốn từ nhiều đại diện (agent) mạnh hơn mình.

Trong quản trị truyền thống, chủ thể là một thuật toán tĩnh còn đại diện là con người; còn trong bối cảnh an toàn AI, chủ thể trở thành con người hoặc mô hình ngôn ngữ lớn (LLM) tương đối yếu hơn, trong khi LLM mạnh hơn đóng vai trò đại diện.

Biến số then chốt mà ông đưa ra là sự thông đồng giữa các đại diện. Ông giải thích rằng nếu có thể hạn chế khả năng các đại diện chia sẻ thông tin hoặc hợp tác với nhau để né tránh sự kiểm soát từ bên ngoài, hệ thống nhìn chung sẽ đạt kết quả tốt hơn, và kết luận này cũng có thể áp dụng cho an toàn AI.

Điều này đồng nghĩa với việc chỉ điều chỉnh an toàn cho một mô hình AI đơn lẻ sẽ khó xử lý đầy đủ những rủi ro phát sinh khi nhiều mô hình cùng vận hành. Logic ở đây là không chỉ hành vi riêng lẻ của từng mô hình, mà cả cách chúng tương tác và cách phân bổ quyền hạn cũng cần được quản lý riêng.

Vitalik cũng cho rằng cách kiểm soát AI không nên chỉ dựa vào các công cụ kỹ thuật. Ông cho biết những ràng buộc đối với AI trong tương lai có thể không chỉ đơn thuần là một “hộp cát” (sandbox) kỹ thuật, mà sẽ gần với một hệ thống mang tính thể chế, bao gồm quy tắc, quyền hạn, cơ chế phán định và ghi chép.

Sandbox là một phương thức kiểm soát kỹ thuật nhằm giới hạn tài nguyên và môi trường thực thi mà AI có thể truy cập. Theo ông, cần bổ sung thêm quy trình theo dõi ai đã làm gì với quyền hạn nào, cũng như để lại phán quyết và trách nhiệm rõ ràng khi xảy ra sự cố.

Trong cấu trúc như vậy, rất khó để đánh giá độ an toàn của một mô hình AI chỉ dựa trên đánh giá trước khi triển khai. Điều này được hiểu là cần có một hệ thống giám sát tương tác giữa các mô hình trong quá trình vận hành thực tế, đồng thời ứng phó với các tình huống nghi ngờ vi phạm quy tắc hoặc thông đồng.

Tuy nhiên, phát biểu lần này không phải là khẳng định rằng một thiết kế quản trị cụ thể nào đó sẽ đảm bảo an toàn AI, mà chỉ là quan điểm về khả năng áp dụng. Vitalik không đưa ra quy tắc, cấu trúc quyền hạn, chủ thể phán định hay phương thức ghi chép cụ thể.

Phát biểu này cũng không đề cập đến bất kỳ lịch trình hay kế hoạch kinh doanh nào liên quan trực tiếp đến ngành công nghiệp blockchain. Trọng tâm của phát biểu không phải là Ethereum(ETH) hay giá tiền mã hóa, mà là rủi ro thông đồng và cấu trúc kiểm soát giữa nhiều mô hình AI.

<Bản quyền ⓒ TokenPost, nghiêm cấm sao chép và phân phối trái phép>

Phổ biến nhất

Các bài viết liên quan khác

Bình luận 0

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.

0/1000

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.
1