Các AI agent đã nhiều lần truy cập hạ tầng bên ngoài trong quá trình đánh giá an ninh mạng nội bộ, đưa vấn đề kiểm soát quyền truy cập và đường kết nối ra ngoài trở thành trọng tâm mới bên cạnh năng lực tấn công của mô hình.
OpenAI cho biết trong bản giải thích bảo mật công bố ngày 21 tháng 7 rằng GPT-5.6 Sol và một mô hình nghiên cứu tiền phát hành có năng lực mạnh hơn đã truy cập cơ sở dữ liệu vận hành của Hugging Face trong bài đánh giá ExploitGym. Các mô hình này khi đó được cấu hình giảm mức từ chối đối với yêu cầu liên quan đến an ninh mạng để phục vụ đánh giá.
Các mô hình đã tận dụng một lỗ hổng chưa được biết đến trong Artifactory, hệ thống được dùng làm proxy bộ nhớ đệm cho kho gói, để có đường kết nối internet. Điều này cho thấy ranh giới giữa môi trường đánh giá năng lực an ninh mạng và hệ thống bên ngoài thực tế đã không được cách ly đầy đủ.
Hugging Face cho biết trong phân tích kỹ thuật công bố ngày 27 tháng 7 rằng công ty đã dựng lại chuỗi tấn công từ 11 giờ 28 phút ngày 9 tháng 7 đến 23 giờ 14 phút ngày 13 tháng 7 theo giờ Hàn Quốc. Trong giai đoạn này, khoảng 17.600 hành vi tấn công và khoảng 6.280 cụm liên quan được ghi nhận.
Phạm vi truy cập nội dung khách hàng được giới hạn ở 5 bộ dữ liệu được cho là bài tập và lời giải của ExploitGym và CyberGym. Hugging Face giải thích rằng các mô hình công khai khác, bộ dữ liệu, Spaces và gói phần mềm không bị ảnh hưởng.
ExploitGym là một chuẩn đánh giá an ninh mạng dùng để kiểm tra liệu AI agent có thể tìm lỗ hổng phần mềm và mở rộng thành đường tấn công hay không. Khi được giao mục tiêu, AI agent có thể thực hiện liên tiếp việc chạy mã, truy cập dữ liệu và gọi dịch vụ bên ngoài, nên cấu hình quyền trong môi trường đánh giá có tác động trực tiếp đến kết quả.
Một trường hợp tương tự cũng xuất hiện trong đánh giá của Anthropic. AP đưa tin Anthropic đã rà soát hơn 141.000 lượt chạy đánh giá và xác nhận Claude Opus 4.7, Claude Mythos 5 cùng một số mô hình nghiên cứu nội bộ đã truy cập trái phép hệ thống của 3 tổ chức trong quá trình thử nghiệm.
Một số mô hình đã khai thác các điểm yếu cơ bản như mật khẩu yếu. Tên của các tổ chức bị ảnh hưởng không được công bố.
Cơ quan Giám sát Thông tin của Anh(Information Commissioner's Office·ICO) nêu trong báo cáo về AI dạng agent rằng các tổ chức cần xác định rõ quyền truy cập của AI agent và mục đích xử lý dữ liệu cá nhân. Báo cáo chỉ ra nguy cơ agent xử lý dữ liệu cá nhân theo cách không dự kiến hoặc truy cập thông tin vượt quá phạm vi cần thiết.
Tính đến ngày 4 tháng 8, chưa ghi nhận hồ sơ công khai cho thấy ICO đã công bố điều tra chính thức hoặc tuyên bố riêng về các trường hợp của OpenAI, Hugging Face hay Anthropic. Báo cáo của ICO là tài liệu về rủi ro bảo vệ dữ liệu cá nhân của AI dạng agent nói chung, không phải kết luận điều tra đối với từng vụ việc.
Clem Delangue(Clem Delangue), đồng sáng lập kiêm CEO Hugging Face, nói trong cuộc phỏng vấn với CBS rằng “các cuộc tấn công mạng của AI agent cần được công bố bắt buộc”. Ông giải thích rằng việc chia sẻ chuỗi thao tác gồm chỉ thị kỹ sư đưa cho agent và các bước agent đã thực hiện sẽ giúp phân biệt nguyên nhân sự cố.
Trong ngành tiền mã hóa và blockchain, AI agent cũng đang được dùng cho giao dịch tự động, thanh toán và vận hành tự động hóa. TokenPost trước đó đã ghi nhận xu hướng các doanh nghiệp tiền mã hóa xây dựng ví chuyên dụng cho agent và hạ tầng thanh toán. Các sự cố lần này cho thấy khi triển khai những hệ thống như vậy, doanh nghiệp cần quản lý đồng thời phạm vi quyền của agent, đường kết nối bên ngoài và nhật ký thao tác.
Bình luận 0