Trung tâm Tiêu chuẩn và Đổi mới AI thuộc Bộ Thương mại Mỹ, phối hợp với Viện An toàn AI Vương quốc Anh, đã đánh giá năng lực tấn công mạng của mô hình AI Trung Quốc Kimi K3 và kết luận các mô hình dẫn đầu của Mỹ vẫn vượt trội, dù kết quả còn nhiều giới hạn do Kimi K3 chỉ tham gia một phần bài thử.
Theo Odaily, do hạn chế về môi trường lưu trữ, nhóm đánh giá chủ yếu ước tính năng lực mạng tổng thể của Kimi K3 dựa trên 41 bài kiểm tra khai thác lỗ hổng. Báo cáo cho biết các mô hình khác được thử nghiệm trên phạm vi rộng hơn, vì vậy sai số trong kết quả của Kimi K3 lớn hơn.
Ở bài thử khai thác lỗ hổng, Kimi K3 đạt khoảng 32%, cao hơn mức 24% của GLM-5.2 nhưng thấp hơn đáng kể so với mức trung bình khoảng 76% của các mô hình dẫn đầu tại Mỹ. Trong bài thử chuỗi tấn công mô phỏng, Kimi K3 hoàn thành trung bình 17 trong 32 bước, thành công xâm nhập mạng 1 lần trong 10 lượt thử, trong khi các mô hình frontier của Mỹ thực hiện trung bình 28,5 bước.
Báo cáo nhận định Kimi K3 đã có một mức độ năng lực tấn công tự động nhất định. Các cơ chế an toàn của mô hình cũng chưa ngăn được hoạt động phát triển lỗ hổng hoặc thực thi tấn công.
Tuy nhiên, báo cáo đồng thời nhấn mạnh phạm vi thử nghiệm còn hạn chế, nên không thể khái quát trực tiếp kết quả này thành so sánh toàn diện giữa các mô hình. Điều này cho thấy cuộc cạnh tranh về AI và an ninh mạng vẫn đang nghiêng về phía Mỹ, nhưng khoảng cách công nghệ cần tiếp tục được theo dõi qua các bài đánh giá rộng hơn.
Bình luận 0