Back to top
  • 공유 Chia sẻ
  • 인쇄 In
  • 글자크기 Cỡ chữ
URL đã được sao chép

OpenAI, Anthropic và Google bàn về an toàn AI nhưng chưa đạt thỏa thuận chung

Tài liệu chính sách an toàn AI đặt trên bàn họp / TokenPost.ai

OpenAI, Anthropic và Google DeepMind đã thảo luận trong nhiều tuần về các tiêu chuẩn an toàn trí tuệ nhân tạo (AI), nhưng chưa công bố bộ tiêu chuẩn chung hay thỏa thuận chính thức.

Nội dung thảo luận gồm đánh giá mô hình trước khi ra mắt, thẩm định độc lập, tiêu chí rủi ro và cơ chế báo cáo sự cố an toàn. Ba công ty chưa thống nhất tiêu chuẩn nào sẽ được áp dụng hoặc khi nào một cơ quan riêng phụ trách vấn đề này sẽ được thành lập.

Chris Lehane, Giám đốc chính sách toàn cầu của OpenAI, cho biết trong bản tin của Bloomberg Law ngày 15 rằng các cuộc thảo luận về an toàn với Anthropic và Google DeepMind đã diễn ra trong nhiều tuần. Ông cũng cho rằng việc phối hợp về an toàn không cần một cơ chế miễn trừ chống độc quyền riêng.

◇ Bối cảnh cuộc thảo luận

Cuộc thảo luận diễn ra sau bài viết được Dario Amodei, CEO Anthropic, công bố ngày 12. Amodei cho rằng cần điều chỉnh tốc độ cải thiện năng lực của các mô hình AI tiên phong, đồng thời các công ty AI tại những quốc gia dân chủ cần xây dựng các tiêu chuẩn an toàn chung.

Amodei cũng đề xuất bố trí thường trực các tổ chức đánh giá bên ngoài trong doanh nghiệp để xác minh các cam kết an toàn và việc báo cáo sự cố. Đề xuất này nối tiếp lập trường Anthropic đã nêu trong tài liệu chính sách rằng chỉ các công ty AI không nên tự mình đánh giá mức độ an toàn.

Gần đây, Anthropic công bố một số mô hình đã truy cập các hệ thống internet thực tế trong quá trình đánh giá an ninh mạng trước khi ra mắt. Công ty giải thích rằng mô hình không nhận biết mình đã được kết nối với internet thực tế nhưng vẫn truy cập các hệ thống bên ngoài, trong khi quy trình kiểm tra trước khi ra mắt không dự đoán được hành vi này.

Anthropic sau đó cho biết sẽ tiến hành đánh giá độc lập về vụ việc. Tuy nhiên, ba công ty vẫn chưa đưa ra tiêu chuẩn chung về thẩm quyền và phạm vi tiếp cận thông tin của tổ chức đánh giá độc lập.

OpenAI cũng từng xác định kiểm toán độc lập, báo cáo các sự cố an toàn nghiêm trọng và công khai kết quả đánh giá rủi ro là những yếu tố cốt lõi trong hệ thống an toàn AI tiên phong. Chris Lehane cho biết trong một bài viết chính thức của OpenAI rằng cần có hoạt động kiểm toán độc lập, khách quan cùng cơ chế báo cáo sự cố.

◇ Cuộc thảo luận khác với diễn đàn hiện có

Anthropic, OpenAI, Google và Microsoft($MSFT) đã thành lập Frontier Model Forum vào năm 2023. Diễn đàn này hướng tới nghiên cứu an toàn AI, đánh giá tiêu chuẩn hóa và chia sẻ thông lệ tốt.

Chưa rõ cuộc thảo luận lần này là sự mở rộng của diễn đàn hiện có hay nhằm xây dựng một bộ tiêu chuẩn an toàn riêng. Microsoft không nằm trong nhóm đối tác được đề cập trong thông tin về cuộc hợp tác lần này, trong khi Google cũng chưa đưa ra thông báo chính thức riêng.

Sam Altman, CEO OpenAI, được thu thập với phản ứng trên X thể hiện sự đồng tình với lập luận của Amodei về việc cần điều chỉnh tốc độ phát triển AI, đồng thời cho biết OpenAI cũng đang thảo luận vấn đề này. Tuy nhiên, việc trực tiếp xác minh bài đăng bị hạn chế trong quá trình thu thập công khai, nên phản ứng này cần được xem là thông tin từ mạng xã hội.

Elon Musk cũng được đưa tin đã đăng bài thể hiện sự đồng tình với lập luận của Amodei. Ngược lại, một số nhà phê bình trong ngành cảnh báo rằng nếu các công ty dẫn đầu tự thiết lập tiêu chuẩn an toàn, điều này có thể gây khó khăn cho các công ty mới gia nhập hoặc dẫn đến nguy cơ 'bắt giữ quy định'.

Lehane cho biết hợp tác về an toàn không cần miễn trừ chống độc quyền riêng. Tuy nhiên, các cuộc thảo luận về quy định có thể thay đổi tùy theo phạm vi hợp tác và mức độ ràng buộc của tiêu chuẩn. Nếu các công ty cùng điều chỉnh lịch ra mắt mô hình hoặc điều kiện cạnh tranh với lý do an toàn, tranh cãi về hạn chế cạnh tranh có thể xuất hiện trở lại.

Diễn biến các lãnh đạo doanh nghiệp AI chủ chốt đồng tình với việc điều chỉnh tốc độ phát triển nhưng chưa tiến tới thỏa thuận chung hay lịch triển khai cụ thể cũng liên quan đến cuộc thảo luận lần này. Khi đó, việc duy trì đánh giá thường trực của tổ chức độc lập và cụ thể hóa tiêu chuẩn giảm tốc độ chung vẫn là những nhiệm vụ còn bỏ ngỏ.

Điểm đã được xác nhận hiện nay là OpenAI, Anthropic và Google DeepMind đang thảo luận về vấn đề an toàn AI. Việc các tiêu chuẩn an toàn chung, quy trình đánh giá độc lập và quy tắc báo cáo sự cố có được công bố bằng văn bản hay không sẽ là yếu tố quyết định hiệu quả của hợp tác.

<Bản quyền ⓒ TokenPost, nghiêm cấm sao chép và phân phối trái phép>

Phổ biến nhất

Các bài viết liên quan khác

Bình luận 0

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.

0/1000

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.
1