Các khối suy luận (reasoning block) được mã hóa của OpenAI, Anthropic và Google(GOOGL) bị phát hiện có thể tái sử dụng giữa những người dùng, phiên làm việc và mô hình khác nhau, tạo ra lỗ hổng bảo mật nghiêm trọng. Nhóm nghiên cứu đã giải mã thành công 315.320 khối suy luận từ các bản ghi công khai, qua đó tìm thấy 367 thông tin cá nhân và 182 dữ liệu đăng nhập bị lộ.
Theo bài nghiên cứu công bố ngày 11 (giờ địa phương), mỗi nhà cung cấp AI sử dụng một khóa mã hóa toàn cục duy nhất cho toàn bộ hệ thống của mình, thay vì mã hóa riêng theo từng phiên hay từng mô hình. Nhóm nghiên cứu chỉ ra rằng đây chính là kẽ hở khiến cuộc tấn công trở nên khả thi: một khối suy luận do mô hình mạnh tạo ra có thể được đưa vào một mô hình khác có mức bảo mật thấp hơn của cùng nhà cung cấp, khiến nội dung suy luận gốc bị xuất ra dưới dạng văn bản thuần, không còn mã hóa.
Trong số dữ liệu giải mã được, nhóm nghiên cứu phát hiện nhiều thông tin nhạy cảm như mật khẩu và khóa API (API key). Nhóm cảnh báo thêm hai rủi ro đáng chú ý: những nội dung độc hại vốn đã bị chặn ở câu trả lời cuối cùng vẫn có thể tồn tại trong quá trình suy luận phía sau, và kẻ tấn công có thể giấu lệnh bên trong khối mã hóa để thực hiện tấn công chèn lệnh (prompt injection).
Bình luận: Phát hiện này cho thấy việc các công ty AI dùng chung một khóa mã hóa cho toàn hệ thống — thay vì phân tách theo từng phiên hoặc từng mô hình — có thể trở thành điểm yếu mang tính hệ thống, đặc biệt khi ngày càng nhiều doanh nghiệp tích hợp các mô hình suy luận vào quy trình xử lý dữ liệu nhạy cảm.
Bình luận 0