← Quay lại Blog An toàn số

Bảo vệ dữ liệu khi dùng AI: 7 quy tắc an toàn cho người dùng

2026-09-20 · Tân IT365
Người dùng che thông tin nhạy cảm trước khi hỏi trợ lý AI

Chatbot AI rất tiện: hỏi gì cũng trả lời, viết giúp email, tóm tắt tài liệu, sửa câu chữ. Nhưng mỗi câu bạn gõ vào ô chat là một mẩu dữ liệu rời khỏi máy của bạn và đi tới hệ thống của một công ty khác. Phần lớn người dùng chỉ hỏi "câu trả lời có đúng không", ít ai hỏi "dữ liệu mình vừa đưa lên sẽ đi đâu".

Bài này là bộ quy tắc thực hành cho người dùng cuối, không cần biết kỹ thuật: AI nhận gì và lưu gì, những thông tin tuyệt đối không dán vào chatbot, cách che dữ liệu trước khi hỏi, cách kiểm chứng câu trả lời, các mục cài đặt quyền riêng tư cần tắt, cách nhận diện lừa đảo giả AI, và quy ước dùng AI trong gia đình hay công việc.

Minh bạch: bài viết có thể chứa liên kết tiếp thị. Nếu anh/chị mua dịch vụ qua các liên kết này, Tân IT365 có thể nhận một khoản hoa hồng nhỏ. Khoản này không làm tăng giá anh/chị phải trả và không chi phối nội dung hướng dẫn.

1. AI nhận gì và lưu gì: hiểu rủi ro trước khi gõ câu hỏi

Khi bạn gõ một câu hỏi rồi bấm gửi, nội dung đó rời khỏi thiết bị và đi qua mạng tới máy chủ của nhà cung cấp dịch vụ, được xử lý ở đó rồi trả kết quả về. Điểm cần nhớ: trên đường đi và tại máy chủ, dữ liệu có thể được ghi lại.

Một lượt hỏi đáp thường kèm theo những thứ sau:

Những dữ liệu này thường được giữ lại vì ba mục đích: hiển thị lại lịch sử cho bạn xem, cải thiện chất lượng mô hình, và rà soát an toàn. Mục thứ ba là mục dễ bị bỏ qua nhất. Các dịch vụ lớn thường có quy trình kiểm duyệt nội dung vi phạm, xử lý lỗi và gán nhãn dữ liệu; trong quy trình đó, một phần hội thoại có thể được nhân viên hoặc cộng tác viên đọc. Nói cách khác, "chỉ có máy đọc" không phải là bảo đảm đúng trong mọi trường hợp.

Rủi ro chia thành bốn nhóm, và cách phòng mỗi nhóm một khác:

Nhóm rủi roChuyện gì xảy raCách giảm
Rò rỉ do sự cốDữ liệu bị lộ trong một vụ tấn công hoặc lỗi hệ thống của nhà cung cấpĐừng đưa lên thứ bạn không muốn thấy trong bản tin sự cố
Bị người đọcHội thoại được rà soát để chống lạm dụng hoặc gán nhãn cho mô hìnhChe thông tin nhận dạng, không dán hồ sơ khách hàng
Lưu quá lâuNội dung nằm trong hệ thống nhiều tháng, nhiều năm, lâu hơn bạn nhớTắt lưu lịch sử nếu có, xoá hội thoại định kỳ
Vướng hợp đồngDữ liệu của bên thứ ba bị đưa lên khi chưa được phépKhông dán dữ liệu khách hàng, đối tác, nhân viên

Cũng cần nhớ rủi ro không chỉ đến từ những dịch vụ lớn. Tiện ích mở rộng trình duyệt, ứng dụng "AI miễn phí" không rõ nguồn gốc, trang web nhái giao diện chatbot đều có thể đọc được nội dung bạn dán vào. Với một dịch vụ miễn phí, hãy tự hỏi họ lấy tiền ở đâu để duy trì; nếu không có câu trả lời rõ ràng thì dữ liệu của người dùng có thể chính là nguồn thu.

Quy tắc gốc của cả bài viết: hãy giả định rằng mọi thứ gõ vào chatbot đều có thể được lưu lại và có thể có người đọc. Thấy thoải mái với giả định đó thì gửi, còn không thì đừng gửi.

2. Những thông tin tuyệt đối không dán vào chatbot

Trước khi nhớ danh sách dài, hãy nhớ một câu lọc duy nhất: nếu thông tin này bị lộ mà bạn phải gọi điện xin lỗi khách hàng, báo cáo sự cố nội bộ, hoặc đổi mật khẩu ngay, thì không được dán vào chatbot. Danh sách dưới đây là những nhóm gần như luôn rơi vào trường hợp đó.

Một hiểu nhầm phổ biến: nhiều người nghĩ "AI chỉ đọc giúp mình" nên thoải mái tải ảnh giấy tờ lên để nhờ điền thông tin. Thực tế ảnh được tải nguyên tệp lên hệ thống, và phần chữ trong ảnh cũng được xử lý như dữ liệu. Cùng lý do đó, đừng nhờ AI "đọc giúp" hoá đơn có số tài khoản, hay bảng lương có số căn cước.

Vậy làm sao vẫn nhận được trợ giúp mà không đưa dữ liệu thật? Bảng dưới là cách thay thế thường dùng:

Bạn cầnĐừng làmLàm thay thế
Hỏi thủ tục hành chínhGửi ảnh giấy tờ, số giấy tờMô tả bằng lời: ở tỉnh nào, làm việc gì, cần giấy tờ nào
Kiểm tra cách tính lãi, thuếDán bảng giao dịch thậtHỏi nguyên tắc tính, dùng số giả cùng định dạng
Viết email cho kháchDán tên, số điện thoại kháchThay bằng "Khách hàng A", bỏ số điện thoại
Xử lý bảng dữ liệuTải cả tệp lênCắt 5 dòng mẫu, xoá cột tên và liên hệ
Nhờ gỡ lỗiDán mã nguồn nội bộViết lại đoạn nhỏ đã bỏ tên hệ thống, dữ liệu thật

Nếu việc bạn đang làm cần đến dữ liệu nhạy cảm thật, hãy dùng đúng kênh chuyên môn: luật sư, bác sĩ, kế toán, hoặc bộ phận phụ trách — họ có trách nhiệm nghề nghiệp về bảo mật. Chatbot công cộng không có cam kết tương tự với riêng bạn.

3. Che dữ liệu trước khi hỏi: thay tên, che số, tách câu hỏi khỏi dữ liệu

Không phải lúc nào cũng bỏ hẳn được dữ liệu. Khi buộc phải dùng một ví dụ có ngữ cảnh, hãy che trước khi gửi. Việc này làm thủ công mất khoảng một phút, rẻ hơn nhiều so với xử lý một lần lộ dữ liệu.

Bảy bước che dữ liệu, làm theo thứ tự:

  1. Xác định dữ liệu nào thật sự cần. Phần lớn câu hỏi chỉ cần cấu trúc và vài con số, không cần tên thật.
  2. Thay tên riêng bằng nhãn. "Nguyễn Văn An" thành "Nhân viên A", công ty thành "Công ty X", khách thành "Khách hàng 1". Nhãn phải thay nhất quán trong cả đoạn, không sót chỗ nào.
  3. Che số nhưng giữ định dạng. Số điện thoại thành "10 chữ số bắt đầu bằng 0"; số tài khoản thành "số 12 chữ số"; ngày sinh thành "năm sinh 19xx". Giữ định dạng giúp câu trả lời còn đúng về kỹ thuật.
  4. Bỏ chi tiết nhận dạng không cần thiết: địa chỉ cụ thể, mã đơn hàng, tên phòng ban, tên dự án, mốc thời gian riêng.
  5. Tách câu hỏi khỏi dữ liệu. Hỏi nguyên tắc trước, chỉ khi cần mới đưa ví dụ đã rút gọn. Ví dụ nên hỏi "cách tính lãi theo dư nợ giảm dần" thay vì dán cả bảng trả nợ của một khách.
  6. Rút ngắn dữ liệu. Năm dòng mẫu đủ để AI hiểu cấu trúc; đừng tải cả tệp hàng nghìn dòng.
  7. Đọc lại một lần trước khi bấm gửi. Bước này bắt được phần lớn lỗi sót tên hoặc sót số.

Ví dụ cho thấy khác biệt rõ nhất:

Cách saiCách đúng
Dán: "Chị Trần Thị B, số điện thoại 09xx, hợp đồng 12345, phàn nàn tiền điện tháng 8 tăng"Dán: "Khách hàng A, hợp đồng đã ký, tháng này tiền điện tăng gấp đôi. Cách giải thích nhẹ nhàng?"
Tải tệp điểm danh có tên và số điện thoại học viênGửi 5 dòng đã xoá cột tên và liên hệ, chỉ giữ điểm và ngày
Dán nguyên đoạn mã có tên máy chủ, khoá cấu hìnhViết lại hàm sai, thay tên biến hệ thống bằng tên chung

Bốn giới hạn cần biết để không yên tâm quá mức:

Ba câu tự vấn trước khi bấm gửi: trong đoạn này còn tên thật nào không, còn số nào nhận dạng được người không, và nếu đoạn này bị đọc lại bởi một người lạ thì có chuyện gì không.

4. Kiểm chứng câu trả lời: AI có thể bịa rất tự tin

Chatbot tạo câu trả lời bằng cách dự đoán chuỗi từ tiếp theo, không tra cứu một cơ sở dữ liệu sự thật. Vì vậy nó có thể viết ra số liệu không có thật, tên văn bản pháp luật không tồn tại, số điều luật sai, đường dẫn không dẫn tới đâu, và trích dẫn được ghép từ hai tài liệu khác nhau. Điều khó chịu là những câu sai đó vẫn trôi chảy, có cấu trúc, và rất tự tin.

Cách kiểm chứng theo thứ tự:

Danh sách việc không được lấy AI làm nguồn duy nhất: số liệu trong báo cáo, vấn đề thuế và pháp lý, hợp đồng, y tế và liều thuốc, an toàn điện - nước - gas, thủ tục hồ sơ, và trích dẫn trong bài học thuật.

Loại câu hỏiMức cần kiểmKiểm bằng gì
Viết lại câu chữ, đổi giọng vănThấpĐọc lại xem có sai nghĩa không
Gợi ý ý tưởng, dàn bàiThấpChọn lọc theo hiểu biết của mình
Hướng dẫn thao tác phần mềmTrung bìnhLàm thử trên bản nháp
Số liệu, phép tínhCaoTính lại bằng công cụ
Pháp lý, thuế, hồ sơRất caoVăn bản gốc và người có chuyên môn
Y tế, an toàn tính mạngRất caoNhân viên y tế, kỹ thuật viên

Lưu ý riêng với đường dẫn kèm theo câu trả lời: một đường dẫn tồn tại không có nghĩa nội dung trong đó đúng như AI mô tả. Hãy mở và đọc, đối chiếu từng ý. Cũng đừng mặc định AI đúng khi nó nói khác điều bạn đã biết rõ từ kinh nghiệm làm việc của mình.

5. Cài đặt quyền riêng tư: tắt lưu hội thoại, chặn dùng dữ liệu để huấn luyện

Phần lớn dịch vụ chatbot đều có mục cài đặt quyền riêng tư, nhưng đường vào mỗi nơi một khác và hay đổi vị trí sau mỗi bản cập nhật. Hãy tìm theo các từ khoá: Cài đặt hoặc Settings, rồi Quyền riêng tư, Dữ liệu, Kiểm soát dữ liệu, Data controls.

Các mục cần tìm và nên tắt:

Nếu dịch vụ không có tuỳ chọn tắt, hãy coi nó là kênh công khai: chỉ dùng cho nội dung không nhạy cảm.

Khi đọc chính sách, đừng đọc cả trang. Chỉ cần tìm bốn câu trả lời: dữ liệu của tôi có được dùng để huấn luyện không; được lưu trong bao lâu; có chia sẻ cho bên thứ ba không; và được xử lý ở đâu. Bốn điểm này quyết định phần lớn rủi ro.

Tài khoản công việc và tài khoản cá nhân nên tách nhau. Nếu cơ quan cấp tài khoản hoặc gói dành cho tổ chức, dùng đúng tài khoản đó cho việc công, vì gói tổ chức thường có cam kết không dùng dữ liệu của khách hàng để huấn luyện. Ngược lại, đừng dùng tài khoản cá nhân để xử lý việc nội bộ, và đừng dùng tài khoản công ty cho việc riêng — cả hai chiều đều có thể vi phạm quy định.

Trên điện thoại, rà lại các quyền mà ứng dụng đang giữ: danh bạ, ảnh, micro, vị trí, và đặc biệt là quyền đọc nội dung bộ nhớ tạm. Quyền đọc bộ nhớ tạm là đường mà ứng dụng lạ có thể lấy được nội dung bạn vừa sao chép, kể cả mã xác thực.

Hai tình huống rất hay làm lộ dữ liệu mà ít ai để ý: chia sẻ màn hình trong cuộc họp, khi danh sách hội thoại hiện ở cột bên trái; và dùng máy tính chung ở cơ quan. Với trường hợp đầu, hãy đổi tên hội thoại thành tên trung tính và xoá trước khi họp. Với trường hợp sau, dùng cửa sổ riêng tư và đăng xuất khi xong, nhưng nhớ rằng hội thoại đã gửi vẫn nằm trên hệ thống của nhà cung cấp chứ không phải trên máy.

6. Lừa đảo giả AI: app nhái, đòi nạp tiền, deepfake giọng nói

Càng nhiều người dùng AI, càng nhiều chiêu lừa mượn danh AI. Điểm chung là chúng đều muốn một trong ba thứ: tiền, quyền truy cập vào thiết bị, hoặc thông tin đăng nhập của bạn.

Bảng dấu hiệu và việc cần làm ngay:

Dấu hiệuViệc cần làm ngay
Giục gấp, không cho thời gian kiểm traDừng lại, không quyết định trong cuộc gọi
Đòi chuyển tiềnKhông chuyển; gọi lại số đã lưu trong danh bạ
Đòi mã xác thực hoặc mật khẩuKhông đọc; nhớ rằng không tổ chức nào hỏi mã xác thực
Yêu cầu cài tệp ngoài kho ứng dụngKhông cài; chỉ tải từ kho chính thức
Xin quyền danh bạ, tin nhắn, trợ năngTừ chối; gỡ ứng dụng nếu đã cấp quyền
Đường dẫn khác thường, sai chính tả tên miềnKhông bấm; tự mở trang bằng cách gõ địa chỉ

Cách xử lý khi đã nghi ngờ: cúp máy rồi gọi lại bằng số mình tự lưu; hỏi một câu chỉ người thật biết; báo cho người thân trong nhà để cùng kiểm tra; nếu đã nhập mật khẩu thì đổi ngay và đăng xuất khỏi mọi thiết bị; nếu đã cài ứng dụng lạ thì gỡ, quét thiết bị và kiểm tra lại danh sách thiết bị đã đăng nhập vào tài khoản chính. Bật xác thực hai lớp cho các tài khoản quan trọng là cách chặn thiệt hại tốt nhất khi lộ mật khẩu.

7. Quy ước dùng AI trong gia đình và công việc, kiểm tra định kỳ

Quy tắc chỉ có tác dụng khi được viết ra và nhắc lại. Với một nhóm làm việc hoặc một gia đình, chỉ cần một trang giấy hoặc một ghi chú chung là đủ.

Phần thứ nhất là danh sách việc được phép và không được phép:

MứcVí dụ
Được phép thoải máiViết lại câu chữ, dịch, gợi ý dàn bài, học kiến thức chung, nghĩ tên gọi
Phải che dữ liệu trướcVí dụ có ngữ cảnh công việc, bảng dữ liệu đã bỏ tên, mô tả lỗi đã bỏ chi tiết hệ thống
Không được phépHồ sơ khách hàng, dữ liệu nhân sự, giấy tờ tuỳ thân, dữ liệu sức khoẻ, hợp đồng, mã nguồn nội bộ, mật khẩu và mã xác thực

Phần thứ hai là người duyệt. Mọi nội dung gửi ra ngoài — email cho khách, bài đăng, hồ sơ, báo cáo — đều phải qua một người có trách nhiệm đọc lại. Cần ghi rõ ai duyệt loại việc nào, vì nếu chỉ nói chung chung thì không ai duyệt. Nếu dùng AI để soạn một phần nội dung quan trọng, ghi lại ngắn gọn trong hồ sơ công việc là đã dùng cho phần nào — cách này giúp ích khi cần rà lại nguồn gốc thông tin.

Với gia đình, ba câu dễ nhớ cho trẻ là: không dán tên trường, địa chỉ nhà và lịch sinh hoạt; không dán ảnh hoặc thông tin của bạn bè khi chưa xin phép; gặp nội dung lạ thì hỏi người lớn trước khi trả lời. Người lớn cũng nên tránh dùng giọng nói của người khác để tạo bản ghi âm.

Phần thứ ba là buổi kiểm tra định kỳ, mỗi tháng một lần, khoảng mười lăm phút:

  1. Xoá các hội thoại cũ có chứa dữ liệu công việc hoặc thông tin cá nhân.
  2. Mở lại mục cài đặt quyền riêng tư, vì bản cập nhật ứng dụng có thể bật lại mục dùng dữ liệu để huấn luyện.
  3. Rà danh sách quyền của ứng dụng trên điện thoại, thu hồi quyền không cần thiết.
  4. Kiểm tra danh sách thiết bị đang đăng nhập vào các tài khoản chính, đăng xuất thiết bị lạ.
  5. Kiểm tra tiện ích mở rộng trên trình duyệt, gỡ cái không còn dùng.
  6. Nhắc lại quy ước với cả nhà hoặc cả nhóm, bổ sung tình huống mới gặp trong tháng.

Cuối cùng, bảy quy tắc tóm gọn để dán ở chỗ làm việc: giả định mọi câu hỏi đều được lưu; không dán giấy tờ, tài khoản, mật khẩu và mã xác thực; thay tên thật bằng nhãn trước khi hỏi; chỉ đưa phần dữ liệu thật sự cần; kiểm chứng mọi con số và mọi việc liên quan pháp lý, y tế; tắt lưu hội thoại và đọc bốn điểm chính trong chính sách; cảnh giác với ứng dụng, cuộc gọi và đường dẫn mượn danh AI.

Bài viết liên quan