Việc chia sẻ bí mật đời tư hay công việc với chatbot AI tiềm ẩn nhiều nguy cơ bảo mật khi dữ liệu được lưu trên máy chủ và có thể bị thu thập hoặc rò rỉ.
Cảm giác tương tác với một công cụ luôn sẵn sàng phản hồi và không phán xét đang khiến nhiều người dùng có xu hướng cởi mở chia sẻ những câu chuyện thầm kín với chatbot trí tuệ nhân tạo (AI). Tuy nhiên, việc xem các mô hình như ChatGPT là nơi lưu trữ tâm sự cá nhân tiềm ẩn nhiều lỗ hổng nghiêm trọng về bảo mật và quyền riêng tư.
Các cuộc hội thoại với AI ngày càng vượt ra ngoài phạm vi tra cứu thông tin đơn thuần. Nhiều người dùng tìm đến chatbot để giãi bày vướng mắc trong công việc, các mối quan hệ gia đình, khó khăn tài chính hoặc những bí mật chưa từng tiết lộ với người thân.
Theo khảo sát "The AI Privacy Problem" do DuckDuckGo thực hiện, khoảng 1/3 số người sử dụng AI thừa nhận từng chia sẻ với chatbot những thông tin nhạy cảm mà họ không muốn nói với bất kỳ ai. Sự tương tác tự nhiên của các mô hình ngôn ngữ lớn tạo ra cảm giác an toàn giả định, khiến lượng dữ liệu cá nhân đổ về các máy chủ ngày một lớn.

Về mặt kỹ thuật, mọi nội dung gửi lên chatbot đều được xử lý và lưu trữ trên hạ tầng điện toán đám mây của nhà cung cấp dịch vụ, chịu sự quản lý của các quy định lưu trữ dữ liệu. Việc xóa hội thoại trên giao diện người dùng không đồng nghĩa với việc toàn bộ bản ghi lập tức biến mất khỏi hệ thống máy chủ.
Theo thống kê từ tờ The Washington Post, trong vòng hai năm qua đã có khoảng một chục vụ việc tại tòa án dẫn lại nội dung trò chuyện giữa người dùng và chatbot trong hồ sơ công khai. Điều này xác nhận các đoạn hội thoại có thể bị thu thập phục vụ quy trình pháp lý nếu có yêu cầu từ cơ quan chức năng.
Bên cạnh đó, môi trường sử dụng cũng đem lại rủi ro nếu người dùng thao tác trên tài khoản doanh nghiệp, nơi tổ chức có toàn quyền kiểm soát nhật ký trò chuyện. Chuyên gia Jen King từ Viện Trí tuệ nhân tạo lấy con người làm trung tâm thuộc Đại học Stanford nhận định rằng người dùng không thể đảm bảo tính riêng tư tuyệt đối nếu không chủ động kích hoạt các tùy chọn hạn chế lưu trữ dữ liệu chuyên biệt.
Dữ liệu khảo sát từ DuckDuckGo chỉ ra khoảng trống nhận thức đáng kể: 53% người dùng thường xuyên không biết các công ty AI có thể dùng nội dung trò chuyện để huấn luyện mô hình, và 75% không nắm được thông tin dữ liệu có thể bị cung cấp cho cơ quan thực thi pháp luật khi có yêu cầu.
Rủi ro bảo mật càng tăng cao khi người dùng cung cấp ngữ cảnh chi tiết để nhận được câu trả lời chuẩn xác hơn. Sự cố vào tháng 7 khi lượng lớn cuộc trò chuyện trên chatbot Claude của Anthropic bị phát hiện công khai trên mạng Internet là minh chứng rõ ràng cho thấy nguy cơ thất thoát dữ liệu luôn hiện hữu.
Khác với lịch sử tìm kiếm từ khóa, nội dung tương tác với chatbot thường xâu chuỗi nhiều thông tin nhạy cảm. Để đảm bảo an toàn, người dùng cần lưu ý những nguyên tắc sau: