Nguy cơ rò rỉ dữ liệu nhạy cảm khi xem các chatbot trí tuệ nhân tạo như nhật ký cá nhân
Nhiều người có thói quen tâm sự bí mật với chatbot AI như ChatGPT, mà không lường trước nguy cơ pháp lý cùng rủi ro rò rỉ dữ liệu từ máy chủ của nhà cung cấp.
Cảm giác được lắng nghe mà không bị phán xét đang khiến nhiều người dùng hình thành thói quen chia sẻ chuyện riêng tư, tài chính và công việc với các chatbot trí tuệ nhân tạo. Tuy nhiên, việc xem các mô hình ngôn ngữ lớn như ChatGPT là một cuốn nhật ký an toàn là một quan niệm sai lầm, tiềm ẩn nhiều rủi ro về an toàn thông tin.
Khoảng một phần ba người dùng từng tiết lộ bí mật cho AI
Theo báo cáo khảo sát "The AI Privacy Problem" do DuckDuckGo thực hiện, khoảng 1/3 người sử dụng thừa nhận từng chia sẻ với chatbot những bí mật mà họ không muốn tiết lộ ngay cả với những người thân cận. Chatbot đang dần vượt ra ngoài vai trò của một công cụ tra cứu thông tin đơn thuần để trở thành nơi giãi bày tâm tư cá nhân.

Đáng lưu ý, trải nghiệm trò chuyện mang tính cá nhân hóa cao không đồng nghĩa với việc nội dung hoàn toàn được bảo mật giữa hai bên. Theo dữ liệu từ tờ Washington Post, trong hai năm qua đã có khoảng một chục vụ việc tại tòa án ghi nhận nội dung trao đổi với chatbot được trích dẫn trong các hồ sơ công khai nhằm phục vụ quy trình pháp lý.
Hệ thống lưu trữ máy chủ và cơ chế xử lý dữ liệu
Về mặt kỹ thuật, các chatbot AI hoạt động dựa trên hạ tầng máy chủ tập trung của nhà cung cấp dịch vụ. Khi người dùng xóa một đoạn hội thoại trên giao diện cá nhân, điều đó không đồng nghĩa với việc toàn bộ dữ liệu lập tức biến mất hoàn toàn khỏi hệ thống lưu trữ dự phòng hoặc cơ sở dữ liệu của nhà phát triển.
Nhà nghiên cứu Jen King từ Viện Trí tuệ nhân tạo lấy con người làm trung tâm thuộc Đại học Stanford nhấn mạnh rằng người dùng không thể chắc chắn về mức độ riêng tư tuyệt đối nếu không chủ động sử dụng các chế độ hạn chế lưu trữ dữ liệu chuyên biệt.
Bên cạnh đó, các sự cố rò rỉ vẫn có thể xảy ra. Điển hình như vào tháng 7, một lượng lớn cuộc trò chuyện trên chatbot Claude của Anthropic đã bị phát hiện có thể truy cập công khai trên Internet, cho thấy nguy cơ thất thoát dữ liệu luôn hiện hữu.
Lỗ hổng trong nhận thức bảo mật của người dùng
Khảo sát của DuckDuckGo chỉ ra sự chênh lệch lớn giữa mức độ sử dụng AI và hiểu biết về an toàn dữ liệu:
- 53% người dùng thường xuyên không biết các công ty AI có thể tận dụng dữ liệu hội thoại để phục vụ huấn luyện mô hình.
- 75% người dùng không biết nội dung trao đổi có thể bị yêu cầu cung cấp cho các cơ quan thực thi pháp luật theo quy định.
Thói quen cung cấp nhiều bối cảnh chi tiết về công ty, đồng nghiệp, hợp đồng hay tình trạng tài chính để AI phản hồi chính xác hơn vô tình biến các đoạn hội thoại thành kho thông tin nhạy cảm tập trung, có giá trị khai thác cao hơn nhiều so với các truy vấn tìm kiếm truyền thống.
Khuyến nghị thiết lập bảo mật khi tương tác với AI
Để giảm thiểu rủi ro, người dùng cần lưu ý các nguyên tắc quản lý dữ liệu khi làm việc với các hệ thống AI:
- Tuyệt đối không nhập thông tin tài chính, mật khẩu, dữ liệu định danh hoặc bí mật kinh doanh vào khung chat.
- Kiểm tra và kích hoạt các chế độ trò chuyện tạm thời hoặc tùy chọn không lưu lịch sử hội thoại trên nền tảng.
- Cân nhắc chính sách quản lý dữ liệu của tổ chức nếu sử dụng tài khoản AI do doanh nghiệp cấp.
Tóm lại, dù giao diện mang lại cảm giác thân thiện, phía sau AI vẫn là hệ thống công nghệ vận hành theo các chính sách thu thập và xử lý thông tin nghiêm ngặt, hoàn toàn không phải là một cuốn nhật ký cá nhân khép kín.