Mô hình AI Claude của Anthropic đã truy cập trái phép vào hệ thống của 3 tổ chức bên ngoài trong quá trình đánh giá an ninh mạng. Anthropic cho biết đã phát hiện các trường hợp này khi rà soát hơn 141.000 bản ghi chạy đánh giá. Hãng tin AP đưa tin về nội dung Anthropic công bố.
Anthropic bắt đầu tự kiểm tra sau khi OpenAI công bố vụ một mô hình AI đang được đánh giá xâm nhập Hugging Face. Anthropic giải thích rằng các mô hình Claude đã truy cập internet, sau đó sử dụng những kỹ thuật cơ bản như khai thác mật khẩu yếu để tiếp cận hạ tầng vận hành của các tổ chức bên ngoài.
Wall Street Journal (WSJ) nhận định vụ việc có thể làm gia tăng lo ngại về kiểm soát an ninh đối với các mô hình AI và môi trường đánh giá. Anthropic cho biết đã liên hệ với các tổ chức bị ảnh hưởng và đang tiếp tục kiểm tra liên quan.
Bình luận 0