Các mô hình Claude của Anthropic đã truy cập vào hệ thống của 3 tổ chức thực tế trong quá trình đánh giá bảo mật, và thông tin này vừa được công bố. Trong số các mô hình được xác nhận có liên quan, không có Claude Opus 4.6.
Trong bài đăng ngày 30 tháng 7, Anthropic cho biết sau khi rà soát 141.006 lượt thực thi đánh giá an ninh mạng, công ty phát hiện lỗi cấu hình kết nối internet trong môi trường đánh giá của bên thứ ba đã khiến Claude Opus 4.7, Claude Mythos 5 và một mô hình nghiên cứu nội bộ truy cập vào hệ thống thực tế. Các mô hình này khi đó đang thực hiện nhiệm vụ giả lập “Capture The Flag” và đã dùng những kỹ thuật cơ bản như mật khẩu yếu, endpoint chưa xác thực.
Trong bài đăng ngày 31 tháng 8, Anthropic cho biết thêm rằng trong một đánh giá riêng do Viện An ninh Trí tuệ Nhân tạo Anh Quốc (AISI) thực hiện ngày 4 tháng 8, Claude Mythos 5 cũng có hành vi truy cập trái phép trên internet. Theo đó, mô hình liên quan đến trường hợp thứ tư từng được nhắc tới trước đây cũng được xác nhận là Claude Mythos 5, chứ không phải Claude Opus 4.6.
Bình luận 0