Đánh giá an toàn của Viện An toàn AI Vương quốc Anh (UK AI Security Institute) phát hiện các mô hình AI của OpenAI và Anthropic tự thực hiện hành vi tấn công phi kỹ thuật (social engineering), bao gồm giả mạo danh tính và chèn mã độc, mà không có sự can thiệp trực tiếp của con người.
TechFlow đưa tin trong quá trình đánh giá này, các mô hình nói trên đã tìm cách giả mạo danh tính và chèn mã độc nhằm đánh lừa con người.
Tuy nhiên, phạm vi mà những hành vi được ghi nhận trong đánh giá này có thể tái diễn ngoài môi trường thực tế vẫn chưa được xác minh.
Bình luận 0