AI tìm kiếm *Perplexity* lộ file “컴퓨터” lên *Google*, *Bing*, nguy cơ rò rỉ *thông tin cá nhân* lại nóng lên
Một số file “컴퓨터” do dịch vụ tìm kiếm AI *Perplexity* tạo ra đã bị phát hiện xuất hiện trong kết quả tìm kiếm của *Google*, *Bing* và *DuckDuckGo*. Sự cố này diễn ra khi vụ rò rỉ đường dẫn chia sẻ của *Claude* vẫn chưa lắng xuống, khiến vấn đề *bảo vệ dữ liệu cá nhân* trên các nền tảng *AI tạo sinh* tiếp tục bị đặt dấu hỏi.
Theo Protos đưa tin ngày 27 (giờ địa phương), chỉ cần đoán đúng cấu trúc đường dẫn chia sẻ tiêu chuẩn, phóng viên đã có thể truy cập được hàng chục file “컴퓨터” của nhiều khách hàng *Perplexity*. Các file này tồn tại dưới dạng trang web đang hoạt động trên tên miền perplexity.ai. Ngay từ phần tiêu đề, có thể suy đoán chúng chứa nhiều nội dung liên quan đến đời sống cá nhân lẫn công việc của người dùng.
Vấn đề lần này được đánh giá là rất giống với sự cố rò rỉ liên kết chia sẻ của *Claude* thuộc *Anthropic* hồi tuần trước. Khi đó, người dùng tạo link chia sẻ nhưng không được cảnh báo rõ ràng rằng đường dẫn này có thể bị *công cụ tìm kiếm* lập chỉ mục. Các cơ chế chặn như “noindex” cũng không vận hành đúng, dẫn đến việc nội dung bị xuất hiện công khai trên kết quả tìm kiếm. Sau đó, nhiều *công cụ tìm kiếm* đã gỡ thư mục chia sẻ công khai của Claude, nhưng các trang liên quan đến *Perplexity* vẫn tiếp tục được tìm thấy.
*Perplexity* hiện chỉ thông báo ở mức chung chung “Anyone with the link can view” (Ai có liên kết đều xem được), mà không nói rõ rằng đường dẫn này nhiều khả năng sẽ bị *Google* hay *Bing* thu thập và hiển thị công khai. Điều này gây tranh cãi vì dịch vụ vốn có một tên miền chia sẻ riêng là pplx.app dành cho nội dung công khai, nhưng các file “컴퓨터” trên perplexity.ai – vốn không phải do khách hàng chủ đích xuất bản – lại bị lộ qua kênh tìm kiếm.
*bình luận*
Sự nhầm lẫn giữa “chia sẻ nội bộ qua link” và “xuất bản công khai trên Internet” đang lặp lại đúng “vết xe đổ” của mạng xã hội nhiều năm trước, nhưng lần này ở quy mô *AI tạo sinh*, nơi dữ liệu nhạy cảm như tài liệu công ty, ghi chú cá nhân, thậm chí dữ liệu khách hàng… thường được đưa thẳng vào mô hình để xử lý.
Giới chuyên gia nhận định nhiều dịch vụ *AI tạo sinh* đã ưu tiên tiện lợi của tính năng “chia sẻ” hơn là đặt trọng tâm vào *bảo vệ quyền riêng tư*. Trước đó, *OpenAI* cũng từng đối mặt sự cố tương tự với *ChatGPT*: vào tháng 7 năm 2025, một số đoạn hội thoại được chia sẻ đã bị *công cụ tìm kiếm* lập chỉ mục, buộc công ty phải loại bỏ tùy chọn cho phép các đường dẫn này có thể tìm kiếm công khai.
Việc những vụ việc giống nhau lần lượt diễn ra ở *Claude*, *ChatGPT* rồi đến *Perplexity* cho thấy xung đột giữa *tiện ích của AI* và *an toàn dữ liệu* đang trở thành bài toán trung tâm của ngành. Trong bối cảnh *AI tạo sinh* phát triển quá nhanh, việc thiết lập mặc định chặt chẽ cho nút “chia sẻ”, kèm cảnh báo rõ ràng về nguy cơ lên chỉ mục tìm kiếm và cấu hình chặn lập chỉ mục ở cấp hệ thống, đang được xem là yêu cầu bắt buộc chứ không còn là lựa chọn.
Bình luận 0