Một số liên kết chia sẻ cuộc trò chuyện từ chatbot Claude đã bất ngờ xuất hiện trên công cụ tìm kiếm Google và Bing rồi sau đó bị gỡ bỏ. Sự cố này dấy lên lo ngại về tính bảo mật dữ liệu của người dùng AI.
Vụ việc bắt nguồn từ tính năng tạo liên kết chia sẻ, hoàn toàn không phải toàn bộ lịch sử trò chuyện Claude bị hệ thống tự động công khai. Tuy nhiên, nhiều người không ngờ rằng đường dẫn gửi cho bạn bè hoặc đồng nghiệp lại có thể bị lập chỉ mục và tìm thấy công khai.
Cuối tháng 7, một số người dùng đã phát hiện các cuộc trò chuyện và nội dung được tạo bằng Claude xuất hiện trong kết quả tìm kiếm của Google và Bing. Các kết quả này đều dẫn đến những đường liên kết công khai được tạo từ tính năng chia sẻ của chính chatbot này.
Ngoài các đoạn trò chuyện thông thường, nội dung bị công cụ tìm kiếm phát hiện còn bao gồm tài liệu, bảng tính, trang web, sơ đồ và các ứng dụng nhỏ. Một số tài liệu có vẻ liên quan đến kế hoạch kinh doanh, hạ tầng công nghệ hoặc hoạt động nội bộ của các tổ chức.
Tuy nhiên, sự việc không đồng nghĩa với việc Claude tự động công khai toàn bộ lịch sử trò chuyện của người dùng. Anthropic khẳng định, các cuộc trò chuyện luôn được đặt ở chế độ riêng tư theo mặc định. Hệ thống chỉ tạo đường dẫn truy cập khi người dùng chủ động sử dụng tính năng chia sẻ.
Khi một cuộc trò chuyện được chia sẻ, bất kỳ ai có đường dẫn đều có thể xem bản chụp nội dung tại thời điểm liên kết được tạo. Bản chụp này bao gồm các tin nhắn đã gửi trước đó. Các tin nhắn gửi sau thời điểm chia sẻ vẫn được giữ riêng tư, trừ khi người dùng cập nhật lại bản chia sẻ.
Điều dễ gây nhầm lẫn nằm ở cách người dùng hiểu về đường liên kết này. Một người có thể gửi liên kết cho vài đồng nghiệp và cho rằng nội dung chỉ nằm trong nhóm kín. Tuy nhiên, nếu đường dẫn không yêu cầu mật khẩu, người nhận hoàn toàn có thể chuyển tiếp hoặc đăng lên mạng xã hội.
Anthropic giải thích rằng họ không cung cấp danh mục URL cho Google. Những địa chỉ này thường không thể bị đoán ngẫu nhiên, nhưng sẽ bị công cụ tìm kiếm phát hiện nếu người dùng vô tình đăng chúng ở một nơi công khai trên Internet.
Hiện tại, Anthropic đã xử lý sự cố và đưa các liên kết bị lập chỉ mục khỏi kết quả tìm kiếm. Dù vậy, những địa chỉ cũ vẫn có thể được truy cập trực tiếp nếu chủ sở hữu chưa chuyển cuộc trò chuyện về lại chế độ riêng tư.
Vụ việc cho thấy sự khác biệt giữa việc ngăn công cụ tìm kiếm đọc nội dung và việc ngăn địa chỉ xuất hiện trong kết quả tìm kiếm.
Anthropic đã sử dụng tệp robots.txt để yêu cầu các trình thu thập dữ liệu không truy cập khu vực chứa cuộc trò chuyện chia sẻ. Tuy nhiên, robots.txt chủ yếu chỉ hướng dẫn không truy cập nội dung bên trong. Nếu đường dẫn được đăng trên một website khác, Google hoặc Bing vẫn biết địa chỉ đó tồn tại và đưa vào kết quả.
Để yêu cầu một trang không xuất hiện, website cần bổ sung thẻ "noindex". Khi sự việc được phát hiện, một số trang chia sẻ Claude đã bị thiếu chỉ dẫn quan trọng này.
Dù các cuộc trò chuyện đã biến mất khỏi Google, Bing vẫn trả về khoảng 612 kết quả liên quan đến khu vực chia sẻ của Claude tại thời điểm kiểm tra (ngày 28/7). Do đó, nguy cơ rò rỉ vẫn chưa được loại bỏ hoàn toàn.
Anthropic khuyến nghị người dùng nên kiểm tra lại các liên kết đã chia sẻ bằng cách mở mục Settings > Privacy. Tại đây, bạn có thể xem danh sách các cuộc trò chuyện từng chia sẻ và chọn Unshare (Hủy chia sẻ) hoặc chuyển về chế độ riêng tư để vô hiệu hóa quyền truy cập.
Nếu cuộc trò chuyện có tệp đính kèm, tệp gốc sẽ không xuất hiện. Tuy nhiên, nội dung văn bản được sao chép từ tệp và các câu trả lời do Claude tạo ra vẫn sẽ hiển thị công khai trong bản chia sẻ.
Nguyên tắc an toàn nhất khi sử dụng AI:
Nguồn bài viết: Tổng hợp thông tin bảo mật AI và cảnh báo từ Anthropic.
Vụ việc bắt nguồn từ tính năng tạo liên kết chia sẻ, hoàn toàn không phải toàn bộ lịch sử trò chuyện Claude bị hệ thống tự động công khai. Tuy nhiên, nhiều người không ngờ rằng đường dẫn gửi cho bạn bè hoặc đồng nghiệp lại có thể bị lập chỉ mục và tìm thấy công khai.
Vì sao đoạn chat Claude lại xuất hiện trên Google?
Cuối tháng 7, một số người dùng đã phát hiện các cuộc trò chuyện và nội dung được tạo bằng Claude xuất hiện trong kết quả tìm kiếm của Google và Bing. Các kết quả này đều dẫn đến những đường liên kết công khai được tạo từ tính năng chia sẻ của chính chatbot này.
Ngoài các đoạn trò chuyện thông thường, nội dung bị công cụ tìm kiếm phát hiện còn bao gồm tài liệu, bảng tính, trang web, sơ đồ và các ứng dụng nhỏ. Một số tài liệu có vẻ liên quan đến kế hoạch kinh doanh, hạ tầng công nghệ hoặc hoạt động nội bộ của các tổ chức.
Tuy nhiên, sự việc không đồng nghĩa với việc Claude tự động công khai toàn bộ lịch sử trò chuyện của người dùng. Anthropic khẳng định, các cuộc trò chuyện luôn được đặt ở chế độ riêng tư theo mặc định. Hệ thống chỉ tạo đường dẫn truy cập khi người dùng chủ động sử dụng tính năng chia sẻ.
Bản chất của tính năng chia sẻ trên Claude
Khi một cuộc trò chuyện được chia sẻ, bất kỳ ai có đường dẫn đều có thể xem bản chụp nội dung tại thời điểm liên kết được tạo. Bản chụp này bao gồm các tin nhắn đã gửi trước đó. Các tin nhắn gửi sau thời điểm chia sẻ vẫn được giữ riêng tư, trừ khi người dùng cập nhật lại bản chia sẻ.
Điều dễ gây nhầm lẫn nằm ở cách người dùng hiểu về đường liên kết này. Một người có thể gửi liên kết cho vài đồng nghiệp và cho rằng nội dung chỉ nằm trong nhóm kín. Tuy nhiên, nếu đường dẫn không yêu cầu mật khẩu, người nhận hoàn toàn có thể chuyển tiếp hoặc đăng lên mạng xã hội.
Anthropic giải thích rằng họ không cung cấp danh mục URL cho Google. Những địa chỉ này thường không thể bị đoán ngẫu nhiên, nhưng sẽ bị công cụ tìm kiếm phát hiện nếu người dùng vô tình đăng chúng ở một nơi công khai trên Internet.
Hiện tại, Anthropic đã xử lý sự cố và đưa các liên kết bị lập chỉ mục khỏi kết quả tìm kiếm. Dù vậy, những địa chỉ cũ vẫn có thể được truy cập trực tiếp nếu chủ sở hữu chưa chuyển cuộc trò chuyện về lại chế độ riêng tư.
Liên kết công khai không phải là kênh riêng tư
Vụ việc cho thấy sự khác biệt giữa việc ngăn công cụ tìm kiếm đọc nội dung và việc ngăn địa chỉ xuất hiện trong kết quả tìm kiếm.
Anthropic đã sử dụng tệp robots.txt để yêu cầu các trình thu thập dữ liệu không truy cập khu vực chứa cuộc trò chuyện chia sẻ. Tuy nhiên, robots.txt chủ yếu chỉ hướng dẫn không truy cập nội dung bên trong. Nếu đường dẫn được đăng trên một website khác, Google hoặc Bing vẫn biết địa chỉ đó tồn tại và đưa vào kết quả.
Để yêu cầu một trang không xuất hiện, website cần bổ sung thẻ "noindex". Khi sự việc được phát hiện, một số trang chia sẻ Claude đã bị thiếu chỉ dẫn quan trọng này.
Dù các cuộc trò chuyện đã biến mất khỏi Google, Bing vẫn trả về khoảng 612 kết quả liên quan đến khu vực chia sẻ của Claude tại thời điểm kiểm tra (ngày 28/7). Do đó, nguy cơ rò rỉ vẫn chưa được loại bỏ hoàn toàn.
Người dùng cần làm gì để bảo vệ dữ liệu?
Anthropic khuyến nghị người dùng nên kiểm tra lại các liên kết đã chia sẻ bằng cách mở mục Settings > Privacy. Tại đây, bạn có thể xem danh sách các cuộc trò chuyện từng chia sẻ và chọn Unshare (Hủy chia sẻ) hoặc chuyển về chế độ riêng tư để vô hiệu hóa quyền truy cập.
Nếu cuộc trò chuyện có tệp đính kèm, tệp gốc sẽ không xuất hiện. Tuy nhiên, nội dung văn bản được sao chép từ tệp và các câu trả lời do Claude tạo ra vẫn sẽ hiển thị công khai trong bản chia sẻ.
Nguyên tắc an toàn nhất khi sử dụng AI:
- Không xem liên kết chia sẻ công khai như một kênh trao đổi thông tin nội bộ hay riêng tư.
- Luôn rà soát toàn bộ nội dung trước khi tạo liên kết chia sẻ.
- Chủ động xóa các thông tin nhạy cảm như mật khẩu, dữ liệu tài chính, mã nguồn, thông tin khách hàng hoặc tài liệu nội bộ trước khi cung cấp cho chatbot xử lý.
Nguồn bài viết: Tổng hợp thông tin bảo mật AI và cảnh báo từ Anthropic.