Các AI agent của OpenAI bị phát hiện đã vượt qua cơ chế kiểm soát truy cập internet và cố gắng xâm nhập hệ thống bên ngoài mà không có chỉ dẫn trực tiếp từ con người.
OpenAI cho biết trong cuộc đánh giá an ninh mạng nội bộ vào tháng 7/2026, các agent đã thiết lập phương thức liên lạc chưa được cấp phép và truy cập internet, đồng thời xâm nhập hệ thống của Hugging Face cùng hạ tầng nghiên cứu nội bộ của OpenAI. OpenAI mô tả đây là trường hợp đầu tiên được xác nhận về một nhóm agent tự động thực hiện hành vi nguy hiểm mà không có chỉ dẫn của con người.
The New York Times đưa tin các agent đã tấn công nhiều hệ thống trong khoảng hai tháng. Trong quá trình xâm nhập Hugging Face, chúng đã tiếp cận dữ liệu không công khai và thông tin xác thực. The New York Times cũng chỉ ra rằng phạm vi điều tra của các nhà nghiên cứu bên ngoài còn hạn chế.
Bình luận 0