Sửa file PDF lỗi
Cứu một file PDF không mở được. Bảng chỉ mục của file được dựng lại, và nếu tài liệu hoàn toàn không phân tích được, mọi thứ còn đọc được trong các byte vẫn được khôi phục — và không lưu trữ gì cả.
- Không bao giờ lưu trữ
- Không xếp hàng, không phải chờ
- Không cần đăng ký, không watermark
Cách hoạt động
Thêm file PDF bị hỏng
Thả file không mở được vào. Không sao cả nếu các ứng dụng khác từ chối nó.
Sửa
File được lập lại chỉ mục, hoặc được dựng lại từng đối tượng một nếu không phân tích được.
Kiểm tra và tải xuống
Bạn được biết đã khôi phục bao nhiêu trang và công cụ đã làm gì, sau đó tải file đã sửa xuống.
Thứ thường bị hỏng, và hai cách để lấy lại
Hầu hết các file PDF không mở được đều không hề bị hỏng theo nghĩa thực sự. Một file PDF kết thúc bằng một bảng tham chiếu chéo — bảng chỉ mục ghi lại vị trí byte của mọi đối tượng trong file — và trình đọc dựa vào nó để tìm bất cứ thứ gì. Làm hỏng bảng chỉ mục đó thì một tài liệu hoàn toàn nguyên vẹn cũng không mở được, vì không thứ gì định vị được dù mọi thứ vẫn còn đó. Tải xuống bị gián đoạn, lưu file bị ngắt giữa chừng, ứng dụng bị treo, file bị một phần mềm sửa mà không cập nhật vị trí, việc truyền file làm sai ký tự xuống dòng: tất cả đều làm hỏng bảng chỉ mục và không cái nào động đến nội dung.
Lượt sửa đầu tiên tận dụng đúng điều đó. File được phân tích một cách dễ dãi, bỏ qua các vị trí được khai báo khi chúng không khớp với những gì thực sự có ở đó, rồi được ghi lại từ đầu với bảng chỉ mục đúng, độ dài luồng đúng và một phần trailer sạch. Cách này khôi phục được phần lớn các file, nhanh, và không có gì trên các trang bị thay đổi — kết quả là tài liệu của bạn với một bảng mục lục hoạt động được gắn lại.
Khi file hoàn toàn không phân tích được, lượt thứ hai làm điều mà một công cụ khôi phục trên máy tính vẫn làm: nó quét các byte thô từ đầu đến cuối để tìm phần đầu của các đối tượng, thu thập mọi thứ còn trông giống một đối tượng PDF, và dựng lại bảng chỉ mục từ những gì thực sự có mặt chứ không phải từ những gì file khai báo. Trang sẽ cho bạn biết lượt nào đã chạy, vì điều đó quan trọng — dựng lại nghĩa là cấu trúc gốc không đọc được, và kết quả đáng được xem lại trước khi bạn tin dùng.
Không lượt nào có thể tự tạo ra dữ liệu không có ở đó, và không công cụ nào ở đâu làm được. Nếu quá trình tải xuống dừng ở sáu mươi phần trăm, bốn mươi phần trăm số trang còn lại không hề tồn tại trong file; việc khôi phục tìm thấy những trang đã về và dừng lại. Nếu chỗ hỏng nằm trong một luồng nén, luồng đó không giải nén được và trang mà nó vẽ sẽ trở lại trống trơn, trong khi các trang bên cạnh vẫn ổn. Khôi phục được một phần tài liệu là kết quả tốt bình thường ở đây, và lấy lại được file gốc luôn tốt hơn sửa một bản sao bị cắt cụt.
Khi bạn cần công cụ khác
qpdf là công cụ chuẩn cho việc này và thực hiện lượt đầu tiên kỹ lưỡng hơn: qpdf --replace-input damaged.pdf ghi lại file với bảng chỉ mục đúng, và nó xử lý được tài liệu đã mã hóa, luồng đối tượng và file tuyến tính hóa mà một lần phân tích dễ dãi có thể vấp phải. mutool clean -ggg in.pdf out.pdf còn đi xa hơn, dựng lại cây trang và loại bỏ mọi thứ không được tham chiếu. Cả hai đều miễn phí, đều chạy được với file lớn hơn nhiều so với sức chứa của một tab trình duyệt, và đều cho bạn biết chúng đã phải sửa những gì.
Với file hỏng nặng đến mức quét đối tượng là lựa chọn duy nhất, Ghostscript thường là công cụ lì lợm nhất: gs -o repaired.pdf -sDEVICE=pdfwrite broken.pdf diễn giải nội dung trang thay vì chỉ lập lại chỉ mục, nhờ vậy đôi khi dựng lại được những trang mà các công cụ khác bó tay — đổi lại là mọi thứ đều được ghi lại, nên kết quả không còn giống từng byte với phần còn sót lại.
Câu hỏi thường gặp
Thực ra thì cái gì được sửa?
Hầu hết các file PDF “bị hỏng” vẫn nguyên vẹn về cấu trúc nhưng có bảng tham chiếu chéo bị lỗi — bảng chỉ mục cho biết mỗi đối tượng nằm ở đâu. Tải xuống bị cắt ngang, lưu file bị gián đoạn và phần mềm tạo file bị lỗi đều gây ra tình trạng này, và trình đọc từ chối file dù nội dung vẫn còn nguyên. Dựng lại bảng chỉ mục đó là tài liệu trở lại ngay.
Nếu file hoàn toàn không phân tích được thì sao?
Khi đó các byte thô sẽ được quét để tìm phần đầu của các đối tượng, mọi thứ còn tồn tại được thu thập lại, và một bảng chỉ mục cùng phần trailer mới được ghi bao quanh chúng — đúng cách khôi phục mà một công cụ trên máy tính thực hiện. Kết quả được mở thử lại trước khi đến tay bạn, nên một file vẫn không tải được sẽ được báo lại thay vì cho tải xuống.
File bị hỏng của tôi có bị lưu trữ ở đâu không?
Không. Ngay cả bước quét khôi phục cũng không lưu trữ gì cả. Không có gì được gửi đi đâu.
Công cụ có khôi phục được file bị cắt ngang khi đang tải xuống không?
Thường là được — cho đến điểm dữ liệu bị dừng. Những trang chưa từng được tải xuống thì không thể tự tạo ra, nên có thể bạn chỉ lấy lại được phần đầu của tài liệu chứ không phải toàn bộ.
Công cụ có sửa được file PDF có mật khẩu không?
Mã hóa bị bỏ qua trong lúc sửa, nên một file được bảo vệ chỉ có thể trở lại đọc được nếu bạn cũng có mật khẩu. Hãy dùng Mở khóa PDF riêng cho việc đó.
Nên biết: Công cụ sửa khôi phục những gì vẫn còn trong file — nó không thể dựng lại dữ liệu đã thực sự mất. Nếu tài liệu bị cắt cụt, các trang sau điểm cắt sẽ mất vĩnh viễn. File bị hỏng bên trong các luồng nén có thể được khôi phục nhưng một số trang bị trống.
Đặt công cụ này lên website của bạn
Miễn phí cho mọi blog, trang lớp học hay bài viết hướng dẫn. Chỉ cần dán một đoạn mã là khách truy cập có thể dùng ngay trên trang của bạn.
Công cụ PDF khác
Nén PDF
File nhỏ hơn, tài liệu vẫn như cũ
Ghép PDF
Ghép nhiều file PDF thành một tài liệu
Chuyển PDF sang Word
Chuyển thành .docx chỉnh sửa được, có OCR cho bản scan
OCR PDF
Biến bản scan thành PDF tìm kiếm được
Tạo PDF sẵn sàng in
Đồng bộ khổ giấy, thêm lề tràn và dấu cắt
Đặt mật khẩu PDF
Mã hóa bằng mật khẩu, AES-256