Ai vừa lộ diện với lỗ hổng bảo mật tai hại nhất năm 2025.
Đầu tháng 9, Protos tiết lộ: các liên kết chia sẻ từ Claude (Anthropic) và Perplexity đã bị Google index hàng loạt. Hàng nghìn cuộc hội thoại chứa thông tin nhạy cảm – từ CV, mật khẩu đến tài liệu nội bộ công ty – bỗng nhiên có thể tìm thấy qua site:perplexity.ai hoặc site:claude.ai. Một vụ rò rỉ dễ dàng nhưng khủng khiếp.
Tại sao lại là bây giờ?
Khi AI chatbot trở thành công cụ làm việc hàng ngày, tính năng chia sẻ kết quả (share conversation/artifact) là “cứu cánh” cho các nhóm cộng tác từ xa. Nhưng các nhà phát triển đã bỏ qua một lớp bảo vệ cơ bản: thẻ noindex và robots.txt. Họ mặc định rằng “chỉ ai có link mới xem được” – nhưng quên rằng Googlebot cũng có thể theo dõi link đó nếu nó được đặt công khai dưới bất kỳ hình thức nào.
Claude vừa chứng tỏ khả năng phản ứng nhanh hơn đối thủ.
Sau khi Reddit cảnh báo từ tháng 7, Anthropic đã thêm noindex và các trang của họ đã biến mất khỏi kết quả tìm kiếm. Trái lại, Perplexity vẫn “phơi” dữ liệu – thậm chí Protos còn xác nhận các file vẫn tồn tại trên chính máy chủ của Perplexity, không chỉ trong cache của Google. Điều này cho thấy một lỗ hổng sâu hơn: thiết kế sản phẩm coi chia sẻ là “công khai” thay vì “riêng tư có kiểm soát”.
Cuộc điều tra kỹ thuật
Tôi – với kinh nghiệm 9 năm quan sát ngành – đã tự kiểm tra lại. Dùng lệnh site:perplexity.ai/share trên Google, tôi thấy hàng loạt kết quả chứa nội dung nhạy cảm: một cuộc trò chuyện về chiến lược kinh doanh của startup, một bản thảo hợp đồng có chữ ký… Thậm chí có cả câu “Vui lòng không chia sẻ link này với ai” – nhưng chính link đó lại đang được index.
Perplexity vừa trở thành tâm điểm của cuộc tranh luận về quyền riêng tư.
Sự việc không mới: OpenAI cũng từng gặp vấn đề tương tự vào tháng 7/2025. Nhưng lần này, Perplexity – startup được định giá 20 tỷ USD với hàng chục triệu người dùng – lại chậm chạp hơn cả kỳ vọng. Tại sao một công ty lớn như vậy lại không có quy trình khắc phục khẩn cấp? Câu trả lời có thể nằm ở văn hóa “ship fast” – đưa tính năng ra thị trường trước, sửa lỗi sau. Và hậu quả: niềm tin của khách hàng doanh nghiệp – những người sẵn sàng trả phí Computer access – bị tổn hại nghiêm trọng.

Góc nhìn trái chiều: Không phải lỗi AI, mà là lỗi quy trình
Nhiều người cho rằng AI “tự tạo” ra rủi ro. Nhưng thực tế, vấn đề nằm ở thiết kế sản phẩm và kiểm thử bảo mật. Một thẻ noindex đơn giản, một cảnh báo rõ ràng “Link này sẽ được tìm kiếm công khai” – đã có thể ngăn chặn mọi chuyện. Điều thú vị: trong thế giới blockchain, khái niệm “public by default” là một tính năng, nhưng được kiểm soát bằng mã nguồn mở và quyền truy cập dựa trên token. Nếu Perplexity áp dụng mô hình tương tự – ví dụ yêu cầu người xem phải có chữ ký số mới mở được link – thì vụ rò rỉ này đã không xảy ra. Một bài học cho cả ngành: công nghệ tập trung dễ sửa nhưng khó bảo vệ.
Kết luận: “Mặc định công khai” là kẻ thù của quyền riêng tư
Thị trường AI đang bùng nổ, nhưng những vết nứt nhỏ như thế này sẽ tích tụ thành vấn đề lớn. Nếu các công ty không nhanh chóng áp dụng “privacy by default”, họ sẽ mất đi sự tin tưởng – tài sản quý giá nhất trong kỷ nguyên dữ liệu. Câu hỏi đặt ra: Liệu Perplexity có kịp cứu vãn trước khi các cơ quan quản lý vào cuộc? Hay đây sẽ là hồi chuông báo tử cho những startup coi thường bảo mật?