Che thông tin trong PDF
Xóa tên, số và mọi thứ không được phép đọc được — xóa khỏi chính tài liệu, không phải che đi. Không lưu trữ gì cả.
- Không bao giờ lưu trữ
- Không xếp hàng, không phải chờ
- Không cần đăng ký, không watermark
Cách hoạt động
Thêm file PDF
Thả tài liệu vào. Mọi trang đều hiện đủ lớn để nhắm chính xác vào từng chữ.
Kéo chọn phần cần xóa
Vẽ một ô lên từng đoạn chữ. Hoàn tác và Xóa hết chỉ cách một cú nhấn, và không có gì thay đổi cho đến khi bạn lưu.
Che và tải xuống
Chữ nằm trong ô bị xóa khỏi file, sau đó các ô đen mới được vẽ lên trên.
Vì sao một hình chữ nhật đen không phải là che thông tin
Đây là sai lầm đã khiến người ta mất việc và thua kiện, nên cần nói thẳng: vẽ một ô đen lên chữ trong PDF không giấu được gì cả. Các ký tự vẫn nằm trong luồng nội dung của trang, ngay bên dưới hình chữ nhật, và ai cũng có thể bôi chọn, sao chép hoặc lấy chúng ra bằng một công cụ miễn phí trong khoảng bốn giây. Mọi vụ che thông tin thất bại từng bị công bố mà bạn đã đọc — số tiền dàn xếp, tên nhân chứng, hồ sơ chưa được che — đều là tài liệu mà ai đó đã vẽ một hình và tin rằng như vậy là xong.
Ở đây mọi thứ diễn ra theo thứ tự ngược lại. Chữ bên trong ô bạn vẽ bị xóa khỏi luồng nội dung trước, rồi ô đen mới được vẽ sau như một dấu hiệu trực quan cho biết chỗ đó từng có gì. Sao chép vùng đã che, bạn chẳng nhận được gì, vì ở đó không còn gì; trích xuất văn bản của trang, các chữ đó không còn nữa. Số đoạn đã bị xóa được hiển thị cho bạn, để một lần che không khớp với chữ nào hiện rõ ra chứ không bị mặc nhiên cho là đã thành công.
Hình vẽ là một vấn đề riêng và có cách giải quyết riêng. Một cái tên nằm trong trang scan, hoặc trong ảnh chụp màn hình dán vào báo cáo, hoàn toàn không phải là chữ — đó là điểm ảnh, và việc xóa chữ không động được đến nó. Bật tùy chọn hình vẽ sẽ kết xuất lại các trang đó với phần che đã được áp dụng, nên điểm ảnh bên dưới thực sự biến mất chứ không chỉ bị phủ lên. Cái giá là có thật và được nói rõ: các trang đó trở thành ảnh, nên mọi chữ trên đó không còn bôi chọn được, và file sẽ nặng hơn.
Một file PDF lưu tên ở nhiều nơi hơn là trên trang, và những nơi còn lại không bị động đến ở đây. Dấu trang, giá trị trường biểu mẫu, file đính kèm, thông tin tài liệu, gói siêu dữ liệu XMP và cả tên file đều là những kho lưu trữ riêng, và một cái tên nằm ở bất kỳ đâu trong số đó vẫn sống sót dù phần che trên trang hoàn hảo. Một phiên bản cũ của tài liệu cũng vậy nếu file được lưu kiểu nối thêm. Trước khi một file đã che thông tin được gửi đến nơi quan trọng, hãy mở phần thuộc tính tài liệu và xem kỹ, rồi đưa kết quả qua một bước dựng lại để loại bỏ những gì các trang không còn tham chiếu tới.
Khi bạn cần công cụ khác
Khi có yếu tố pháp lý, hãy dùng phần mềm được làm cho mức độ rủi ro đó. Tính năng che thông tin của Adobe Acrobat Pro áp dụng cùng logic xóa rồi mới đánh dấu, và thêm thứ mà trang này không thể cung cấp: một bước làm sạch (sanitise) gỡ bỏ siêu dữ liệu, file đính kèm, lớp ẩn, script và các bản đã lưu trước đó chỉ trong một lần. Với hồ sơ nộp tòa, bước đó là bắt buộc.
Phương án miễn phí tương đương là một chuỗi hai lệnh, và nó thực sự kỹ lưỡng. qpdf --qdf --object-streams=disable in.pdf out.pdf hiển thị cấu trúc tài liệu dưới dạng văn bản đọc được để bạn tận mắt xác nhận một cái tên đã biến mất, và exiftool -all:all= out.pdf xóa siêu dữ liệu. Chạy tiếp gs -sDEVICE=pdfwrite -o final.pdf out.pdf sẽ dựng lại file từ những gì các trang thực sự tham chiếu, loại bỏ các đối tượng mồ côi. Kiểm tra lại là phần người ta hay bỏ qua, và đó lại chính là phần quan trọng.
Câu hỏi thường gặp
Cách này khác gì so với vẽ một hình chữ nhật đen?
Khác hoàn toàn, và đó chính là mục đích của công cụ. Một hình chữ nhật đen vẽ trong trình chỉnh sửa PDF không giấu được gì: các ký tự vẫn nằm trong file, và ai cũng có thể bôi chọn, sao chép hoặc trích xuất chúng bằng một công cụ miễn phí. Báo chí và cơ quan nhà nước đã từng làm lộ thông tin đúng theo cách này. Ở đây, chữ được xóa khỏi luồng nội dung của trang trước, rồi ô đen mới được vẽ sau — bôi chọn vùng đen trong bất kỳ trình đọc nào cũng không có gì để sao chép.
Tài liệu của tôi có bị lưu trữ ở đâu không?
Không. Quá trình che thông tin không lưu trữ gì cả, và điều đó ở đây còn quan trọng hơn mọi công cụ khác: những tài liệu người ta cần che thông tin chính là những tài liệu họ ít muốn giao cho một trang web nhất.
Còn ảnh chụp và bản scan nằm dưới ô thì sao?
Chữ bị xóa khỏi luồng nội dung, nhưng điểm ảnh trong một bức ảnh lại là chuyện khác. Bật “Xóa luôn cả hình vẽ bên dưới” và các trang bị ảnh hưởng sẽ được dựng lại thành ảnh đã làm phẳng, nên những gì nằm dưới ô không còn tồn tại trong file nữa. Cái giá là mất lớp văn bản trên các trang đó, vì vậy đây là một lựa chọn chứ không phải mặc định.
Tôi có kiểm tra được là đã che thành công không?
Có, và bạn nên kiểm tra. Mở kết quả và thử bôi chọn vùng đã che, hoặc đưa file qua Chuyển PDF sang văn bản — các chữ đó phải không còn nữa. Kiểm tra lại phần che thông tin trước khi gửi đi là thói quen tốt, dù bạn dùng công cụ nào.
Công cụ có xóa cả siêu dữ liệu không?
Chưa. Tên tác giả và tiêu đề nằm trong thông tin tài liệu, không nằm trên trang. Hãy kiểm tra riêng các mục đó trước khi công bố thứ gì nhạy cảm.
Nên biết: Chữ bị xóa khỏi nội dung trang; nếu một cái tên còn xuất hiện trong dấu trang, trường biểu mẫu, file đính kèm hoặc siêu dữ liệu tài liệu, đó là những nơi riêng biệt và không bị động đến. Che chữ nằm trong ảnh scan cần dùng tùy chọn hình vẽ, tùy chọn này làm phẳng các trang đó và xóa lớp văn bản của chúng.
Đặt công cụ này lên website của bạn
Miễn phí cho mọi blog, trang lớp học hay bài viết hướng dẫn. Chỉ cần dán một đoạn mã là khách truy cập có thể dùng ngay trên trang của bạn.