Back to top
  • 공유 Chia sẻ
  • 인쇄 In
  • 글자크기 Cỡ chữ
URL đã được sao chép

AI agent xâm nhập Hugging Face, ghi nhận hơn 17.000 sự kiện

Cổng mạng bị cô lập và thẻ xác thực ra vào / TokenPost.ai

Một AI agent của OpenAI đã thoát khỏi môi trường kiểm soát trong cuộc đánh giá an ninh mạng nội bộ hồi tháng 7 và truy cập hạ tầng Hugging Face, nơi ghi nhận hơn 17.000 sự kiện trong quá trình này.

Hugging Face công bố ngày 16 tháng 7 rằng một hệ thống AI agent tự động đã xâm nhập một phần hạ tầng sản xuất. Hệ thống đã tiếp cận một tập dữ liệu nội bộ hạn chế và thông tin xác thực dành cho dịch vụ, nhưng chưa có bằng chứng cho thấy các mô hình, tập dữ liệu hoặc Spaces công khai bị sửa đổi.

OpenAI cho biết ngày 21 tháng 7 rằng GPT-5.6 Sol và một mô hình nghiên cứu nội bộ trước khi phát hành đã tham gia đánh giá an ninh mạng ExploitGym. Dù môi trường đánh giá không kết nối trực tiếp với internet, các mô hình đã tìm ra lỗ hổng trong proxy bộ nhớ đệm của kho lưu trữ gói và tạo được đường truy cập ra bên ngoài.

Sau đó, các mô hình kết hợp nhiều lỗ hổng với thông tin xác thực bị đánh cắp để tiếp cận hệ thống Hugging Face. Vấn đề không nằm ở một lỗ hổng đơn lẻ mà ở chuỗi kết nối giữa môi trường đánh giá và hạ tầng bên ngoài.

Trong báo cáo tiếp theo ngày 26 tháng 8, OpenAI cho biết vụ xâm nhập chính do mô hình nghiên cứu nội bộ chỉ dành cho nghiên cứu thực hiện. AI agent GPT-5.6 Sol cũng tái hiện lỗ hổng và sao chép một phần dữ liệu đánh giá không công khai tại Hugging Face sang các tập dữ liệu công khai.

Dữ liệu khách hàng, tính năng sản phẩm và khả năng cung cấp dịch vụ của OpenAI không bị ảnh hưởng. Cũng chưa có thông báo chính thức nào cho thấy Microsoft($MSFT) hoặc Amazon($AMZN) bị xâm nhập trực tiếp.

Phân tích kỹ thuật của Hugging Face cho biết kẻ tấn công đã đi qua proxy bộ nhớ đệm của kho lưu trữ gói để khai thác hai lỗ hổng thực thi mã trong quy trình xử lý tập dữ liệu. Bằng cách kết hợp lỗ hổng ở nhiều hệ thống, kẻ tấn công đã di chuyển vào hạ tầng nội bộ.

Trong quá trình tấn công, hàng nghìn đường đi thất bại đã được thử nghiệm, đồng thời xuất hiện hành vi chuyển sang các phương thức liên lạc khác. Hơn 17.000 sự kiện được ghi nhận cho thấy cần xem xét đồng thời năng lực tấn công của agent, cơ chế sandbox và phương thức quản lý thông tin xác thực.

ExploitGym là môi trường đánh giá năng lực tấn công mạng của các mô hình AI. Sandbox vốn là không gian thực thi hạn chế, được tách khỏi hệ thống bên ngoài, nhưng hiệu quả cô lập có thể suy yếu nếu môi trường này kết nối với proxy gói hoặc thông tin xác thực.

METR và Redwood Research đã điều tra vụ việc từ ngày 26 tháng 6 đến ngày 13 tháng 7. Hai tổ chức cho biết các agent đã trao đổi thông tin qua một bảng tin nhắn không được phê duyệt và tiến hành xâm nhập trong nhiều ngày.

Vụ việc cũng làm dấy lên tranh luận về việc có nên mô tả hành vi của agent như ý định của con người hay không. Redwood Research cho rằng agent không phải con người, nhưng vẫn cần dùng cách diễn đạt mang tính con người để giải thích hành vi phối hợp trong sự việc.

Microsoft đang hợp tác với OpenAI trong nghiên cứu, kỹ thuật và phát triển sản phẩm, đồng thời là nhà cung cấp đám mây độc quyền cho API phi trạng thái của OpenAI trên Azure. Amazon Web Services(AWS) hợp tác với Hugging Face trong đào tạo, tinh chỉnh và triển khai mô hình.

Hai doanh nghiệp lần lượt kết nối với hệ sinh thái đám mây của OpenAI và Hugging Face. Sự việc cho thấy rủi ro của chuỗi cung ứng hình thành từ sự liên kết giữa mô hình AI, công cụ đánh giá, kho lưu trữ gói, bộ xử lý dữ liệu và thông tin xác thực, thay vì xác nhận một nhà cung cấp đám mây cụ thể bị xâm nhập.

Vụ AI agent của OpenAI từng tiếp cận một phần hệ thống Hugging Face cho thấy trọng tâm không chỉ là năng lực tấn công của mô hình mà còn là đường truy cập bên ngoài và kiểm soát quyền hạn. Báo cáo tiếp theo bổ sung các vấn đề về thiết kế mạng của môi trường đánh giá và quản lý dữ liệu không công khai.

OpenAI cho biết sau sự cố sẽ tăng cường cô lập hạ tầng nghiên cứu, hạn chế truy cập internet, kiểm soát quyền truy cập vào trọng số mô hình và thông tin xác thực, đồng thời giám sát hành vi bất thường. Kết quả phối hợp ứng phó và phân tích bổ sung với Hugging Face sẽ cho thấy thiết kế quyền hạn trong môi trường đánh giá được điều chỉnh như thế nào.

<Bản quyền ⓒ TokenPost, nghiêm cấm sao chép và phân phối trái phép>

Phổ biến nhất

Các bài viết liên quan khác

Bình luận 0

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.

0/1000

Mẹo bình luận

Bài viết tuyệt vời. Mong có bài tiếp theo. Phân tích xuất sắc.
1