Cách che thông tin trong PDF: Xóa vĩnh viễn dữ liệu nhạy cảm
PDF Toucan editorial team · Cập nhật lần cuối 20 tháng 9, 2026 · Đọc 9 phút

Để thực hiện cách che thông tin trong PDF an toàn, đừng chỉ vẽ ô đen phủ lên chữ. Hãy dùng công cụ ẩn danh để loại bỏ vĩnh viễn vùng chứa văn bản, ảnh hoặc dữ liệu nhạy cảm; sau đó mở tệp kết quả, tìm lại các giá trị cũ và kiểm tra từng trang trước khi chia sẻ.
Vì sao vẽ ô đen lên PDF không phải là che thông tin an toàn?
PDF không đơn thuần là ảnh chụp của một trang giấy. Một tệp có thể lưu văn bản, phông chữ, ảnh, chú thích và các đối tượng đồ họa thành những lớp hoặc đối tượng riêng. Khi bạn dùng công cụ vẽ để đặt hình chữ nhật màu đen lên số CCCD hoặc email, hình đó có thể chỉ nằm trên dữ liệu gốc, chứ không xóa dữ liệu gốc.
Điều này tạo ra các rủi ro thực tế:
- Người nhận có thể quét chọn, sao chép hoặc tìm kiếm phần chữ nằm bên dưới ô che.
- Một số ứng dụng cho phép xóa chú thích hoặc lớp hình vẽ, làm nội dung cũ hiện trở lại.
- Đổi màu chữ sang trắng, phủ nền trắng hoặc cắt mép trang cũng không đồng nghĩa với việc dữ liệu đã bị loại khỏi tệp.
- In lại thành PDF có thể làm phẳng nội dung trong một số trường hợp, nhưng không phải cách đáng tin cậy để xác nhận dữ liệu gốc đã biến mất.
Dùng ẩn danh thực sự khi tài liệu có số CCCD, số tài khoản, IBAN, email, số điện thoại, chữ ký, ảnh chân dung, mã QR hoặc thông tin hợp đồng cần che trước khi gửi ra ngoài.
| Cách xử lý | Dữ liệu gốc còn trong tệp? | Có nên dùng để chia sẻ? |
|---|---|---|
| Vẽ hình chữ nhật đen | Thường vẫn còn | Không |
| Đổi chữ sang màu trắng | Vẫn còn | Không |
| Cắt trang | Có thể vẫn nằm ngoài vùng hiển thị | Không |
| In lại PDF sau khi đánh dấu | Tùy ứng dụng | Không đáng tin cậy |
| Ẩn danh, xóa nội dung đã đánh dấu | Được loại khỏi PDF đầu ra | Có, sau khi tự kiểm tra |
Cách che thông tin trong PDF bằng công cụ Ẩn danh PDF
Công cụ Ẩn danh PDF của PDF Toucan xử lý tệp ngay trong trình duyệt bằng bộ máy cục bộ chạy trong web worker. Tệp PDF không được tải lên máy chủ. Công cụ nhận một tệp PDF mỗi lần; bạn không cần tài khoản, không bị đóng watermark và không có giới hạn dùng hằng ngày cho công cụ trên trình duyệt.
Thực hiện theo các bước sau:
- Mở công cụ Ẩn danh PDF và bấm “Chọn file PDF”. Bạn cũng có thể kéo thả PDF vào bất kỳ vị trí nào trên trang hoặc dán tệp.
- Chờ bản xem trước các trang xuất hiện. Với PDF có lớp văn bản, công cụ có thể hiển thị trạng thái đang tìm kiếm văn bản theo số trang.
- Chọn cách đánh dấu dữ liệu cần xóa:
- Kéo trực tiếp trên trang để khoanh vùng thông tin cần che.
- Nhập tên, họ, tên công ty hoặc chuỗi văn bản vào ô “Word to redact”, rồi bấm “Add”.
- Kiểm tra mục “Marked areas”. Danh sách cho biết vùng đánh dấu nằm ở trang nào. Dùng tùy chọn hiển thị trên trang để đối chiếu, hoặc “Remove mark” để bỏ vùng đánh dấu nhầm.
- Mở “More options” nếu cần chỉnh “Box color” thành đen, trắng hoặc trong suốt. Nếu không muốn giữ thuộc tính tài liệu, bật “Clear document details (title, author)”.
- Bấm “Ẩn danh” để tạo tệp đầu ra.
Các chi tiết đã đánh dấu được xóa vĩnh viễn khỏi tệp đầu ra. Những trang đã xử lý được chuyển thành ảnh, vì vậy phần văn bản cũ trên các trang đó không còn để quét chọn hoặc sao chép. Đổi lại, văn bản trên trang đã xử lý cũng không còn khả năng tìm kiếm; dung lượng PDF đôi khi có thể tăng.
Khi chỉnh một vùng đã chọn trên máy tính, bạn có thể dùng phím mũi tên để di chuyển, giữ Alt cùng phím mũi tên để đổi kích thước và bấm Delete để xóa vùng. Trên điện thoại hoặc máy tính bảng, chuyển giữa “Scroll” và “Draw area” trong phần “With your finger” để cuộn trang hoặc vẽ vùng bằng ngón tay.
Làm sao tự động tìm CCCD, IBAN, email và số điện thoại trong PDF?
Phần “Find automatically” giúp dò các mẫu dữ liệu phổ biến trong lớp văn bản của PDF. Bạn có thể chọn các loại có sẵn gồm “Turkish ID number”, “IBAN”, “Email”, “Phone” và “License plate”. Với tên riêng, tên công ty, mã hồ sơ hoặc cụm từ cụ thể, hãy dùng “Word” hay ô “Word to redact” rồi bấm “Add”.
Quy trình nên làm là:
- Chọn loại dữ liệu muốn dò hoặc nhập từ/cụm từ cần xóa.
- Chờ các kết quả xuất hiện trong danh sách vùng đã đánh dấu.
- Mở từng kết quả theo số trang để xác nhận vùng che bao phủ đủ toàn bộ giá trị.
- Dùng “Remove mark” với kết quả đánh dấu nhầm.
- Bổ sung các vùng kéo thủ công cho thông tin chưa được tìm thấy.
Không nên tin hoàn toàn vào nhận diện tự động. Chuỗi số bị ngắt dòng, chèn khoảng trắng, dùng dấu phân cách lạ hoặc định dạng địa phương có thể không khớp mẫu. Với tài liệu tại Việt Nam, số CCCD, mã số thuế, số tài khoản ngân hàng hoặc địa chỉ có thể cần khoanh tay nếu không thuộc mẫu tự động có sẵn.
Tìm kiếm bằng từ cũng có thể đánh dấu rộng hơn mong muốn. Ví dụ, một tên ngắn có thể xuất hiện trong tên địa danh hoặc tên công ty khác. Luôn xem lại trước khi bấm “Ẩn danh”.
Che thông tin trong PDF scan hoặc PDF không tìm kiếm được thế nào?
PDF scan thường chỉ là ảnh của trang giấy. Nếu công cụ báo “This document has no text (it may be a scan). Automatic search cannot work; draw the areas to redact on the page.” hoặc “The text of this file could not be searched. Draw the areas to redact on the page.”, việc dò tự động không thể hoạt động. Tương tự, một trang có thể báo “No text on this page, select the area by hand”.
Trong trường hợp này, hãy che thủ công theo quy trình sau:
- Đi từ trang đầu đến trang cuối, thay vì chỉ mở những trang bạn nhớ có thông tin nhạy cảm.
- Phóng to trang và kéo vùng che quanh CCCD, ảnh chân dung, chữ ký, dấu mộc, số tài khoản, ghi chú viết tay, mã QR hoặc mã vạch.
- Chừa biên che rộng vừa đủ quanh dữ liệu. Kiểm tra sát các mép để không lộ một phần chữ số hoặc ký tự ở dòng kế bên.
- Kiểm tra đầu trang, chân trang, bảng biểu và phần phụ lục. Các biểu mẫu thường lặp lại cùng một mã số hoặc tên ở nhiều trang.
- Thêm nhiều vùng che nếu dữ liệu bị tách thành nhiều vị trí thay vì cố dùng một vùng lớn che cả phần nội dung không cần xóa.
Logo, chữ ký, ảnh và QR là dữ liệu dạng hình ảnh nên tìm theo từ không thể phát hiện. Với những thành phần này, kéo chọn vùng trực tiếp là cách phù hợp.
Làm sao kiểm tra thông tin đã bị xóa thật sự?
Hoàn tất thao tác không phải là bước cuối. Trước khi gửi, hãy kiểm tra PDF đầu ra bằng một trình xem PDF thông thường và thực hiện danh sách sau:
- Dùng tìm kiếm trong trình xem PDF để tìm tên, email, số điện thoại, số CCCD hoặc một vài chữ số đặc trưng của dữ liệu đã che. Không nên có kết quả trên các trang đã ẩn danh.
- Thử quét chọn và sao chép tại vùng đã che. Nội dung cũ không được xuất hiện trong bộ nhớ tạm.
- Phóng to từng vùng đã che để kiểm tra có hở ký tự, dấu chấm, phần đuôi email hoặc chữ số ở rìa bảng hay không.
- Rà soát toàn bộ tài liệu, bao gồm phụ lục, đầu trang, chân trang, watermark, trang trống xen kẽ và ảnh đính kèm trong trang.
- Nếu đã bật “Clear document details (title, author)”, mở thuộc tính tệp để kiểm tra tiêu đề, tác giả, chủ đề và từ khóa đã được loại bỏ.
- Giữ bản gốc ở nơi lưu trữ riêng và chỉ phân phối bản PDF đã che, đã kiểm tra.
Việc các trang đã ẩn danh được chuyển thành ảnh giúp giảm nguy cơ sao chép văn bản cũ từ chính các vùng đó. Tuy nhiên, kiểm tra trực quan vẫn rất quan trọng để phát hiện chữ ký, chi tiết trong ảnh hoặc lần xuất hiện của dữ liệu tại một trang khác mà tìm kiếm không thấy.
Có nên đặt mật khẩu sau khi che thông tin trong PDF?
Ẩn danh và đặt mật khẩu giải quyết hai vấn đề khác nhau. Ẩn danh loại bỏ nội dung không nên chia sẻ. Mật khẩu chỉ hạn chế ai có thể mở tệp. Nếu dữ liệu nhạy cảm vẫn còn trong PDF, bất cứ ai có mật khẩu cũng vẫn xem được; vì vậy mật khẩu không thay thế việc xóa dữ liệu.
Sau khi đã kiểm tra bản PDF được che, bạn có thể dùng Bảo vệ PDF để thêm mật khẩu:
- Mở Bảo vệ PDF và bấm “Chọn các file PDF”. Công cụ này có thể nhận nhiều PDF.
- Nhập mật khẩu trong mục “Set a password”, rồi nhập lại để xác nhận.
- Mật khẩu mở tệp phải có ít nhất 6 ký tự. Nên dùng từ 8 ký tự trở lên, kết hợp chữ hoa, chữ số và dấu câu.
- Trong “More options”, chọn quyền sau khi mở tệp: “Allow printing”, “Allow copying” hoặc “Allow changes” nếu phù hợp.
- Bấm “Mã hóa các file PDF” để tạo bản được mã hóa AES-256.
Bạn cũng có thể đặt “Owner password” tùy chọn để thay đổi các hạn chế; mật khẩu này phải khác mật khẩu mở tệp. Hãy lưu mật khẩu cẩn thận: mật khẩu không rời khỏi trình duyệt, PDF Toucan không lưu mật khẩu và không thể khôi phục tệp nếu bạn quên. Các quyền như không cho sao chép hoặc in là hạn chế do trình xem thực thi, không phải lý do để bỏ qua bước ẩn danh.
Câu hỏi thường gặp
Che thông tin trên PDF bằng ô đen có xóa được chữ gốc không?
Không nhất thiết. Ô đen có thể chỉ là đối tượng phủ lên nội dung, nên chữ gốc vẫn có thể tìm kiếm, sao chép hoặc trích xuất. Hãy đánh dấu vùng bằng công cụ ẩn danh rồi bấm “Ẩn danh” để tạo tệp mà chi tiết được đánh dấu đã bị loại bỏ.
Tôi có thể tự động che email, IBAN và số điện thoại trong PDF không?
Có, nếu PDF có lớp văn bản có thể tìm kiếm. Trong “Find automatically”, chọn Email, IBAN hoặc Phone để dò các mẫu tương ứng. Tuy vậy, cần rà soát mọi kết quả vì định dạng lạ có thể bị bỏ sót, còn một số kết quả có thể bị đánh dấu nhầm.
PDF scan có che thông tin tự động được không?
Thông thường không. PDF scan có thể chỉ chứa ảnh, không có văn bản để công cụ tìm kiếm. Khi có thông báo tài liệu không có văn bản hoặc không thể tìm kiếm, hãy phóng to từng trang và kéo vùng che thủ công quanh mọi thông tin nhạy cảm.
Sau khi che, người khác có thể sao chép lại nội dung cũ không?
Với vùng đã được ẩn danh đúng cách, nội dung cũ bị loại khỏi PDF đầu ra và các trang đã xử lý được chuyển thành ảnh. Dù vậy, bạn vẫn nên mở tệp kết quả, thử tìm kiếm và sao chép, đồng thời kiểm tra các lần xuất hiện khác của cùng dữ liệu.
Che thông tin rồi có cần đặt mật khẩu cho PDF không?
Tùy cách bạn chia sẻ tệp. Mật khẩu hữu ích khi cần hạn chế người mở PDF, nhưng không thể thay thế ẩn danh vì nó không xóa dữ liệu. Nếu cần, hãy che và kiểm tra trước, rồi mới mã hóa bản sạch bằng mật khẩu mạnh và lưu mật khẩu an toàn.
