Mở đầu
Mỗi lần đăng ký tài khoản, mua hàng, bình luận trên diễn đàn hay để lại thông tin liên hệ, người dùng đều có thể tạo thêm một “dấu chân số”. Sau nhiều năm, tên, email hoặc số điện thoại có thể xuất hiện trên những trang mà chính chủ không còn nhớ, thậm chí bị thu thập và chia sẻ trong các danh sách dữ liệu công khai.
Việc tự tìm từng thông tin và
liên hệ từng website để yêu cầu xóa thường mất nhiều thời gian. Với hai prompt
dưới đây, người dùng có thể sử dụng ChatGPT để hỗ trợ rà soát dấu vết cá nhân
trên Internet, lập danh sách trang cần xử lý và chuẩn bị nội dung yêu cầu gỡ bỏ
dữ liệu.
1. Vì sao nên kiểm tra thông tin cá nhân trên Internet?
Thông tin cá nhân bị công khai
không chỉ gây phiền toái mà còn có thể dẫn đến nhiều rủi ro. Email và số điện
thoại có thể bị sử dụng để gửi thư rác, gọi điện quảng cáo, lừa đảo hoặc giả mạo
danh tính. Các thông tin về nơi làm việc, tài khoản mạng xã hội và hoạt động
trước đây còn có thể được ghép nối để hình thành một hồ sơ khá đầy đủ về một
người.
Đáng chú ý, thông tin không nhất
thiết phải nằm trên những website chuyên mua bán dữ liệu. Một bình luận cũ trên
diễn đàn, danh sách khách hàng được tải lên dịch vụ chia sẻ tài liệu hay hồ sơ
nghề nghiệp đã lâu không cập nhật cũng có thể xuất hiện trong kết quả tìm kiếm.
Vì vậy, kiểm tra dấu chân số nên
được xem là một hoạt động bảo vệ dữ liệu cá nhân định kỳ, tương tự việc đổi mật
khẩu hoặc kiểm tra quyền riêng tư trên mạng xã hội.
2. Prompt thứ nhất: Tìm thông tin cá nhân đang được công khai
Prompt đầu tiên được sử dụng để
yêu cầu ChatGPT tìm kiếm tên, email, số điện thoại và các dấu vết có liên quan
trên Internet.
Prompt mẫu
Tìm kiếm trên Internet mọi thông tin công khai về tôi: [HỌ VÀ TÊN]. Tìm các trang web đang bán, liệt kê hoặc chia sẻ thông tin cá nhân của tôi, bao gồm địa chỉ email [EMAIL] và số điện thoại [SỐ ĐIỆN THOẠI].
Hãy tìm theo nhiều cách viết khác nhau: họ tên có dấu và không dấu; số điện thoại viết liền, có dấu chấm, có khoảng trắng và có mã quốc gia; email đầy đủ và tên tài khoản email.
Lập danh sách các kết quả, gồm:
- Tên website và đường dẫn trực tiếp đến trang chứa thông tin.
- Loại thông tin cá nhân đang được công khai.
- Mức độ tin cậy rằng thông tin đó thực sự thuộc về tôi.
- Mức độ rủi ro và thứ tự ưu tiên cần xử lý.
- Đường dẫn opt-out, biểu mẫu quyền riêng tư hoặc kênh liên hệ yêu cầu xóa của từng website.
Phân biệt rõ kết quả chắc chắn thuộc về tôi, kết quả cần xác minh và những người khác chỉ trùng họ tên. Không suy đoán hoặc bổ sung thông tin nhạy cảm chưa được công khai.
Cách sử dụng
Trước tiên, người dùng mở
ChatGPT, chọn công cụ Tìm kiếm rồi dán prompt vào khung trò chuyện.
ChatGPT cũng có thể tự tìm trên web khi câu hỏi cần thông tin trực tuyến. Các
câu trả lời sử dụng tìm kiếm thường kèm theo nguồn để người dùng mở và kiểm tra
trực tiếp.
Ba trường trong dấu ngoặc vuông cần
được thay bằng thông tin thật:
- [HỌ VÀ TÊN]: ghi đầy đủ họ tên, có dấu.
- [EMAIL]: địa chỉ email cần kiểm tra.
- [SỐ ĐIỆN THOẠI]: số điện thoại cần tìm.
Nếu tên quá phổ biến, nên bổ sung
một hoặc hai dữ kiện để giúp phân biệt, chẳng hạn nghề nghiệp, tỉnh thành hoặc
cơ quan từng công tác. Tuy nhiên, không nên đưa số căn cước công dân, thông tin
ngân hàng, mật khẩu, mã xác thực hoặc những dữ liệu nhạy cảm không cần thiết
vào prompt.
Sau khi nhận kết quả, người dùng
cần mở từng đường dẫn để kiểm tra. Không nên mặc nhiên cho rằng mọi hồ sơ trùng
họ tên đều thuộc về mình. ChatGPT có thể tìm nhầm người, bỏ sót trang hoặc đọc
thông tin đã cũ. OpenAI cũng khuyến nghị người dùng kiểm tra lại nguồn khi độ
chính xác có ý nghĩa quan trọng.
3. Prompt thứ hai: Soạn và hỗ trợ gửi yêu cầu xóa dữ liệu
Sau khi đã có danh sách các trang
chứa thông tin cá nhân, prompt thứ hai giúp soạn yêu cầu xóa phù hợp với từng
website.
Prompt mẫu
Dựa trên danh sách các trang đã tìm thấy, hãy soạn yêu cầu xóa dữ liệu cá nhân riêng cho từng website.
Mỗi yêu cầu cần:
- Xác định tôi là chủ thể của dữ liệu.
- Nêu chính xác đường dẫn đang công khai thông tin.
- Liệt kê loại dữ liệu cần xóa, gồm họ tên, email, số điện thoại và các thông tin nhận dạng liên quan.
- Yêu cầu xóa nội dung gốc, bản sao, trang hồ sơ, kết quả tìm kiếm nội bộ và dữ liệu lưu trong bộ nhớ đệm của website.
- Yêu cầu website không tiếp tục bán, chia sẻ hoặc xử lý dữ liệu cho mục đích quảng cáo.
- Đề nghị xác nhận bằng email sau khi hoàn tất.
- Sử dụng ngôn ngữ lịch sự, chặt chẽ, thuyết phục; viết bằng tiếng Việt hoặc tiếng Anh tùy theo website.
Sau khi soạn, hãy giúp tôi mở lần lượt từng trang opt-out hoặc biểu mẫu quyền riêng tư, điền các nội dung không nhạy cảm và dừng lại để tôi kiểm tra trước khi gửi. Nếu trang yêu cầu đăng nhập, nhập mật khẩu, mã xác thực, giấy tờ tùy thân hoặc thao tác xác nhận cuối cùng, hãy để tôi tự thực hiện. Không gửi bất cứ yêu cầu nào khi chưa có sự đồng ý của tôi.
4. Cách sử dụng prompt thứ hai an toàn
Prompt này có hai phần việc khác
nhau.
Phần thứ nhất là soạn nội dung.
ChatGPT có thể tạo thư yêu cầu riêng cho từng website, thay vì dùng một văn bản
chung cho tất cả. Cách làm này hiệu quả hơn vì mỗi nền tảng có quy trình và
chính sách quyền riêng tư khác nhau.
Phần thứ hai là hỗ trợ thao tác
trên website. Trong môi trường ChatGPT có khả năng sử dụng trình duyệt, AI có
thể mở trang liên hệ, xác định biểu mẫu và hỗ trợ điền các nội dung thông thường.
Tuy nhiên, khả năng truy cập phụ thuộc vào công cụ, gói sử dụng, chính sách của
website và phiên bản ChatGPT đang được triển khai.
Theo hướng dẫn hiện hành của
OpenAI, chế độ Agent trước đây đã được thay bằng các quy trình làm việc mới như
ChatGPT Work và trình duyệt đám mây đối với những tác vụ được hỗ trợ. Khi gặp
bước đăng nhập hoặc dữ liệu nhạy cảm, ChatGPT có thể yêu cầu người dùng tiếp quản
trình duyệt. Người dùng không nên nhập mật khẩu trực tiếp vào cuộc trò chuyện
và cần kiểm tra kỹ trước những thao tác có ảnh hưởng quan trọng.
Nếu tài khoản chưa có khả năng điều
khiển trình duyệt, ChatGPT vẫn có thể soạn sẵn nội dung. Người dùng chỉ cần sao
chép văn bản, mở đường dẫn opt-out và tự gửi yêu cầu.
5. Kiểm tra kết quả sau khi gửi yêu cầu
Gửi yêu cầu không có nghĩa thông
tin sẽ biến mất ngay lập tức. Quá trình xử lý thường gồm hai giai đoạn.
Trước hết, website phải xóa nội
dung tại nguồn. Người dùng nên yêu cầu họ xác nhận bằng email và kiểm tra lại
đường dẫn sau một khoảng thời gian hợp lý.
Sau đó, thông tin có thể vẫn xuất
hiện trong kết quả của Google hoặc Bing do công cụ tìm kiếm còn lưu bản cũ. Khi
trang nguồn đã được xóa hoặc chỉnh sửa, người dùng có thể tiếp tục yêu cầu công
cụ tìm kiếm cập nhật hoặc loại bỏ kết quả lỗi thời.
Có thể sử dụng prompt bổ sung:
Các website đã xác nhận xóa thông
tin của tôi. Hãy kiểm tra lại từng đường dẫn, xác định trang nào vẫn còn truy cập
được hoặc còn xuất hiện trên công cụ tìm kiếm, sau đó cung cấp đúng biểu mẫu
yêu cầu xóa kết quả lỗi thời của Google và Bing. Không gửi biểu mẫu khi chưa có
xác nhận của tôi.
Người dùng cũng nên lưu lại bảng
theo dõi gồm tên website, đường dẫn vi phạm, ngày gửi yêu cầu, kênh đã liên hệ,
phản hồi nhận được và trạng thái xử lý. Việc này đặc biệt cần thiết khi phải gửi
yêu cầu đến nhiều nền tảng.
6. Những giới hạn cần hiểu đúng
Hai prompt trên giúp quá trình
tìm kiếm và xử lý thông tin cá nhân thuận tiện hơn, nhưng không thể bảo đảm
phát hiện toàn bộ dữ liệu đang tồn tại.
Một số trang có thể chặn công cụ
tìm kiếm, yêu cầu đăng nhập hoặc chỉ hiển thị nội dung trong nhóm kín. Dữ liệu
trong hình ảnh, tài liệu quét, cơ sở dữ liệu trả phí hoặc những nguồn không được
lập chỉ mục cũng có thể bị bỏ sót. Ngay cả việc tìm kiếm trên web cũng không bảo
đảm bao phủ toàn bộ Internet.
Vì vậy, kết quả do AI cung cấp
nên được xem là bước rà soát ban đầu. Người dùng vẫn phải xác minh từng đường dẫn,
phân biệt người trùng tên và quyết định thông tin nào thực sự cần gỡ.
Ngoài ra, không phải mọi thông
tin có tên cá nhân đều nên yêu cầu xóa. Một bài báo chính thống, thành tích nghề
nghiệp hoặc bài viết trên website cơ quan có thể là thông tin công khai hợp
pháp và có lợi cho uy tín cá nhân. Cần ưu tiên xử lý những trang công khai
email, số điện thoại, địa chỉ, giấy tờ, danh sách khách hàng hoặc dữ liệu có
nguy cơ bị lợi dụng.
Kết luận
Dấu chân số được hình thành trong
thời gian dài nhưng có thể được kiểm soát nếu người dùng chủ động rà soát và xử
lý. Prompt thứ nhất giúp tìm kiếm, phân loại và đánh giá những trang đang công
khai thông tin cá nhân. Prompt thứ hai hỗ trợ soạn yêu cầu xóa dữ liệu và hướng
dẫn thực hiện theo từng website.
AI có thể rút ngắn đáng kể thời
gian tìm kiếm và chuẩn bị văn bản, nhưng quyền quyết định cuối cùng vẫn thuộc về
người dùng. Kiểm tra nguồn, hạn chế cung cấp dữ liệu nhạy cảm và chỉ xác nhận gửi
yêu cầu sau khi đã đọc kỹ là những nguyên tắc cần được đặt lên hàng đầu khi sử
dụng ChatGPT để bảo vệ thông tin cá nhân trên Internet.

Nhận xét
Đăng nhận xét