Sửa PDF
Một PDF không chịu mở thường chỉ hỏng về cấu trúc: bảng tham chiếu chéo (xref) bị hỏng, một trailer không khớp hoặc còn sót lại, hay các độ dời của đối tượng không còn khớp sau một lần lưu tồi. Công cụ này mở tệp bằng một bộ phân tích dung thứ, giữ lại mọi trang nó đọc được, và ghi ra một PDF hoàn toàn mới từ đầu, nhờ đó bảng tham chiếu chéo và trailer được tạo lại sạch sẽ. Nó không thể bịa ra dữ liệu đã thực sự mất, nhưng nó sửa được một số lượng đáng ngạc nhiên các PDF có trang còn nguyên vẹn mà vấn đề duy nhất là cấu trúc hỏng. Mọi thứ chạy trong trình duyệt của bạn, nên tệp không bao giờ rời khỏi thiết bị của bạn.
Cách sửa hoạt động
-
1
Tải lên PDF
Kéo và thả tệp không mở được. Nó ở lại trên thiết bị của bạn; không có gì được gửi đến máy chủ.
-
2
Công cụ đọc lại nó
Một bộ máy PDF dung thứ mở tệp, bỏ qua cấu trúc hỏng, và đọc mọi trang có thể khôi phục.
-
3
Một tệp sạch được dựng lại
Các trang được sao chép vào một tài liệu mới, nên bảng tham chiếu chéo và trailer được ghi từ đầu và hợp lệ ngay từ cách dựng.
-
4
Tải kết quả về
Bạn nhận được một PDF mới mở sạch sẽ. Hãy mở nó trong trình đọc của bạn để xác nhận đủ mọi trang.
Việc sửa này có thể và không thể khắc phục gì
Công cụ hoạt động bằng cách đọc lại PDF và ghi ra một tệp hoàn toàn mới. Điều đó tạo lại cấu trúc quanh các trang của bạn, nhờ vậy khắc phục các lỗi cấu trúc nhưng không thể mang lại dữ liệu thực sự đã thiếu.
| Vấn đề | Khắc phục? | Vì sao |
|---|---|---|
| Bảng tham chiếu chéo bị hỏng hoặc không khớp | Có | Tệp mới được ghi với một xref mới và đúng |
| Trailer cũ hoặc còn sót lại sau một lần lưu tồi | Có | Một trailer sạch được tạo cho tệp dựng lại |
| Rác từ các lần lưu tăng dần lặp lại | Có | Chỉ giữ các trang hiện tại; các bản sửa đổi cũ bị bỏ |
| Đối tượng trình đọc từ chối nhưng bộ phân tích đọc được | Thường | Ghi lại chúng trong một tệp sạch thường làm hài lòng các trình đọc khắt khe |
| Tệp bị cắt cụt đến mức bộ phân tích không mở được | Không | Nếu bộ máy không phân tích được tệp thì chẳng có gì để dựng lại |
| Dữ liệu đối tượng thực sự thiếu hoặc không đọc được | Không | Công cụ giữ những gì đọc được; phần còn lại không bịa ra được |
| Mã hóa bằng mật khẩu không biết | Không | Không có mật khẩu thì nội dung vẫn bị khóa |
Vì sao cấu trúc PDF bị hỏng
- Tải xuống hoặc tải lên dở dang. Một tệp mất những byte cuối khi truyền sẽ mất bảng tham chiếu chéo nằm ở phần đuôi.
- Ghi bị gián đoạn. Một chương trình gặp sự cố khi đang lưu có thể chưa bao giờ xả ra được một trailer hợp lệ.
- Truyền nhị phân tồi. Chuyển một PDF ở chế độ văn bản vốn viết lại các ký tự xuống dòng sẽ làm hỏng các byte bên trong luồng nén.
- Chỉnh sửa tăng dần lộn xộn. Lưu chồng nhiều lần có thể để lại một cấu trúc mà một số trình đọc từ chối, dù các trang vẫn ổn.
Những gì nó không làm
- Nó không khôi phục một PDF mà bộ phân tích hoàn toàn không mở được; một tệp bị cắt cụt nặng có thể vượt quá khả năng của công cụ này.
- Nó không sửa một hình ảnh hay phông chữ hỏng lưu bên trong PDF; một JPEG hỏng vẫn hỏng ngay cả trong một vùng chứa sạch.
- Nó không gỡ mật khẩu và không giải mã nội dung được bảo vệ.
Với những trường hợp đó, một công cụ máy tính để bàn như Ghostscript hay qpdf, chạy cục bộ, đôi khi có thể đi xa hơn.
Tránh các PDF bị hỏng
Khi bạn tạo PDF bằng mã, hãy đóng tệp đúng cách để trailer được ghi. Khi phục vụ chúng qua HTTP, hãy gửi một Content-Length đúng để máy khách biết khi nào tệp đã hoàn chỉnh. Hãy giữ một bản gốc trước khi chỉnh sửa, để một lần lưu tồi không bao giờ là phiên bản duy nhất của bạn.
Câu hỏi thường gặp
Nó giữ mọi trang bộ phân tích đọc được, với các tệp hỏng về cấu trúc thì thường là tất cả. Nếu một số trang thực sự đã mất (dữ liệu của chúng không còn trong tệp), công cụ không thể mang chúng trở lại; nó dựng lại sạch sẽ quanh những gì còn lại.
Có, khi chúng còn nguyên vẹn về cấu trúc: chúng được sao chép nguyên trạng vào tệp mới. Nếu bản thân một phông chữ hoặc luồng hình ảnh bị hỏng, chữ hoặc hình cụ thể đó có thể vẫn hiển thị trống, nhưng phần còn lại của trang vẫn ổn.
Chỉ khi nội dung không thực sự bị khóa. Công cụ cố đọc vượt qua một lớp mã hóa cơ bản, nhưng nó không có ô nhập mật khẩu và không thể phá một lớp bảo vệ thực sự. Một tệp bị khóa bằng mật khẩu bạn không có thì không thể khôi phục.
Không. Tệp được đọc và dựng lại hoàn toàn trong trình duyệt của bạn bằng một bộ máy PDF chạy ngay trên trang. Không có gì được gửi đi đâu cả, nên bạn có thể sửa các tài liệu mật một cách an toàn.
Không có gì. Công cụ không bao giờ thay đổi nguồn của bạn; nó ghi ra một bản sao đã sửa riêng biệt. Hãy tải tệp mới về, xác nhận nó mở được, và giữ tệp gốc cho đến khi bạn chắc chắn.
Công cụ liên quan
Lấy hình ảnh từ tệp PDF
Trích xuất từng hình ảnh được chứa trong tệp PDF và tải chúng ra riêng lẻ hoặc dưới dạng một tệp ZIP duy nhất, đồng thời giữ nguyên độ phân giải gốc.
Thêm số trang vào PDF
Thêm số trang vào bất kỳ tệp PDF nào: chọn một trong sáu vị trí, số bắt đầu, cỡ chữ và hoặc số thường hoặc "1 / N". Chạy hoàn toàn trong trình duyệt của bạn.
Sắp xếp lại trang PDF
Sắp xếp, bỏ hoặc lặp trang PDF bằng dãy số chính xác cách nhau bằng dấu phẩy. Xử lý tệp tối đa 20 MiB và 200 trang trên trình duyệt.
Chuyển đổi MD sang PDF
Chuyển đổi tài liệu Markdown thành PDF có định dạng đẹp với khả năng nổi bật mã nguồn, bảng biểu, hình ảnh và viền trang tùy chỉnh. Mặc định sử dụng giao diện theo phong cách GitHub.
OCR cho PDF
Trích xuất văn bản thuần từ bản in quét trong PDF bằng OCR trên trình duyệt. Hỗ trợ 12 ngôn ngữ, tệp tối đa 20 MB và tài liệu tối đa 40 trang.
Công cụ chuyển đổi PDF sang PDF/A
Chuyển đổi một tệp PDF thông thường sang PDF/A-2b (ISO 19005-2), định dạng lưu trữ nhúng phông chữ và loại bỏ các phụ thuộc bên ngoài để tài liệu vẫn đọc được trong nhiều thập kỷ.
Công cụ này có phiên bản bằng các ngôn ngữ khác
- Reparar PDF [ES]
- Réparer un PDF [FR]
- Napraw PDF [PL]
- PDF reparieren [DE]
- PDF repareren [NL]
- Reparar PDF [PT]
- PDF 복구 [KO]
- ซ่อม PDF [TH]
- PDF を修復 [JA]
- Reparera PDF [SV]
- Perbaiki PDF [ID]
- إصلاح PDF [AR]
- Repair PDF [EN]
- Riparare PDF [IT]
- Восстановить PDF [RU]
- PDF Onar [TR]
- 修复 PDF [ZH]