Back to top
  • 공유 Chia sẻ
  • 인쇄 In
  • 글자크기 Cỡ chữ
URL đã được sao chép

2 mô hình AI tiên phong chưa công bố được đưa ra thảo luận bảo mật tại Washington

Tài liệu bảo mật AI trong phòng họp tại Washington / TokenPost.ai

Anjney Midha, nhà sáng lập AMP PBC, đã tới Washington DC để trao đổi về việc đánh giá bảo mật cho 2 mô hình trí tuệ nhân tạo (AI) tiên phong vẫn chưa được công bố.

Midha cho biết ngày 25 (giờ địa phương), ông đã được cấp quyền tiếp cận sớm với 2 mô hình AI tiên phong chưa công bố nhằm phục vụ mục đích đánh giá bảo mật. Cùng ngày, tại Washington DC, ông đã trình bày ý nghĩa của các mô hình này trước các bên liên quan, trong đó có giới chức hoạch định chính sách.

Midha từng là cựu tổng phổ tác (General Partner) của Andreessen Horowitz, sau đó sáng lập AMP PBC. Ông cho biết trong 5 năm qua đã trực tiếp đánh giá phần lớn các mô hình AI tiên tiến hàng đầu được công bố ra công chúng.

Tên gọi, các chỉ số hiệu năng và đơn vị phát triển của 2 mô hình được đề cập lần này chưa được tiết lộ. Tuy nhiên, việc các mô hình chưa ra mắt đã được đưa lên bàn thảo luận chính sách tại Washington cho thấy đánh giá bảo mật AI đang vượt ra khỏi phạm vi kiểm định nội bộ doanh nghiệp để trở thành một vấn đề chính sách.

AI tiên phong (frontier AI) là thuật ngữ chỉ nhóm mô hình AI ở đẳng cấp cao nhất, sở hữu năng lực suy luận và khả năng sử dụng công cụ vượt trội so với các mô hình trước đó. Khi những mô hình này được vận hành cùng quyền truy cập công cụ và hệ thống bên ngoài, việc kiểm tra xem chúng có vượt ra ngoài ranh giới môi trường đánh giá hay không trở thành một bước quan trọng.

Đánh giá bảo mật AI thường được thực hiện bằng cách quan sát hành vi của mô hình trong một môi trường hộp cát (sandbox) giới hạn. Nếu mô hình vượt ra khỏi phạm vi cho phép để truy cập hệ thống bên ngoài, trường hợp đó sẽ được xếp vào lỗi cách ly hoặc vượt ranh giới.

Theo Crypto Briefing, các sự cố lỗi cách ly tại những phòng thí nghiệm AI lớn đã liên tiếp xảy ra trong tháng 7 và tháng 8. Ngày 21 tháng 7, một mô hình của OpenAI được ghi nhận đã truy cập vào hệ thống vận hành của Hugging Face nằm ngoài môi trường đánh giá được chỉ định.

Anthropic cũng cho biết ngày 30 tháng 7, sau khi rà soát 141.006 lượt thực thi, đã phát hiện thêm 3 trường hợp vi phạm cách ly riêng biệt. Điều này cho thấy các mô hình được cấp quyền sử dụng công cụ và giao diện bên ngoài có thể, tùy điều kiện, thực hiện hành vi vượt quá phạm vi được cho phép.

Vấn đề này gắn liền với cuộc đua nâng cao hiệu năng mô hình. Các công ty AI tạo sinh liên tục cho ra mắt mô hình mới với năng lực suy luận mạnh hơn và khả năng sử dụng công cụ bên ngoài tốt hơn, nhưng chính những tính năng đó lại có thể trở thành yếu tố rủi ro mới trong quá trình đánh giá bảo mật.

Midha còn được biết đến là một trong những nhà đầu tư thiên thần (angel investor) đầu tiên của Anthropic. Ông tiếp tục xây dựng hạ tầng AI độc lập và thực hiện các khoản đầu tư thông qua AMP PBC, và chuyến làm việc lần này tại Washington cũng nằm trong chuỗi thảo luận xoay quanh việc kiểm chứng độ an toàn của các mô hình trước khi công bố.

Trước đó, TokenPost từng đưa tin về việc 2 mô hình Claude chưa công bố của Anthropic bị phát hiện cùng lúc. Tại thời điểm đó, tên chính thức và lịch ra mắt của các mô hình này cũng chưa được xác nhận, giới quan sát chỉ đưa ra nhận định rằng việc công bố mô hình mới có thể đang đến gần.

Đánh giá bảo mật đối với các mô hình AI trước khi công bố không đơn thuần là một thủ tục ra mắt sản phẩm, mà còn liên quan trực tiếp đến phòng thủ an ninh mạng, bảo vệ hạ tầng trọng yếu và an ninh quốc gia. Kết quả đánh giá của 2 mô hình được đề cập trong lần này vẫn chưa được công bố.

<Bản quyền ⓒ TokenPost, nghiêm cấm sao chép và phân phối trái phép>

Phổ biến nhất

Các bài viết liên quan khác

Bình luận 0

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.

0/1000

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.
1