Trình chỉnh sửa siêu dữ liệu PDF
Mọi tệp PDF đều mang theo siêu dữ liệu: tiêu đề hiển thị trong kết quả tìm kiếm và trên thanh thẻ, tên tác giả, chủ đề, từ khóa và dấu vết của ứng dụng đã tạo ra nó (Word, InDesign, in từ Chrome). Trước khi chia sẻ một tài liệu ra bên ngoài, bạn nên dọn dẹp những thông tin này: đặt một tiêu đề phù hợp, sửa lại tác giả, thêm từ khóa dễ tìm kiếm và ghi đè mọi tên mã nội bộ vô tình lọt vào hoặc tên còn sót lại trong trường người tạo.
Cách chỉnh sửa siêu dữ liệu PDF
-
1
Tải lên tệp PDF
Các tệp PDF được bảo vệ bằng mật khẩu cần được mở khóa trước.
-
2
Siêu dữ liệu hiện tại xuất hiện
Tiêu đề, tác giả, chủ đề, từ khóa và người tạo hiện tại được đọc từ tệp.
-
3
Chỉnh sửa trường bất kỳ
Ghi đè hoặc xóa bất kỳ trường nào trong năm trường. Để trống một trường sẽ loại bỏ mục đó.
-
4
Lưu
Tệp PDF đã chỉnh sửa được tạo cùng siêu dữ liệu mới; các trang nội dung vẫn nguyên vẹn.
Các trường siêu dữ liệu PDF tiêu chuẩn
| Trường | Nơi xuất hiện | Chỉnh sửa được ở đây |
|---|---|---|
| Tiêu đề | Thanh thẻ, công cụ tìm kiếm, danh sách thư viện của trình đọc | Có |
| Tác giả | Thuộc tính tệp, cột tác giả trên ổ đĩa dùng chung | Có |
| Chủ đề | Mô tả trong một số trình xem và thư viện số | Có |
| Từ khóa | Được công cụ tìm kiếm lập chỉ mục, dùng để tìm ra PDF | Có |
| Người tạo | Ứng dụng ban đầu tạo ra PDF | Có |
| Nhà sản xuất | Ứng dụng đã ghi tệp PDF hiện tại | Đặt tự động |
| Ngày tạo | Thời điểm PDF được tạo lần đầu | Không |
| Ngày sửa đổi | Thời điểm PDF được lưu lần cuối | Không |
Công cụ này chỉnh sửa năm trường thông tin tài liệu tiêu chuẩn (tiêu đề, tác giả, chủ đề, từ khóa, người tạo). Trường Nhà sản xuất được đóng dấu tự động khi lưu tệp, còn ngày tạo và ngày sửa đổi được giữ nguyên.
Vì sao siêu dữ liệu sạch lại quan trọng
- Hình ảnh chuyên nghiệp. Một tiêu đề như “Không có tiêu đề.pdf” hay “Tài liệu2.pdf” trong trình xem của người nhận trông có vẻ dở dang.
- SEO và khả năng được tìm thấy. Các công cụ tìm kiếm (Google, Bing) dùng tiêu đề và từ khóa của PDF để xếp hạng.
- Quyền riêng tư. Siêu dữ liệu PDF có thể vô tình để lộ tên mã nội bộ (“Dự án Blueshift”) hoặc tên nhân viên còn sót lại trong trường tác giả và người tạo.
- Lưu trữ. Siêu dữ liệu tốt giúp việc truy xuất sau này trong các hệ thống quản lý tài liệu dễ dàng hơn.
- Tuân thủ. Một số ngành (dược phẩm, tài chính) yêu cầu các tiêu chuẩn siêu dữ liệu cụ thể trên tài liệu được chia sẻ.
Những lỗi siêu dữ liệu phổ biến mà công cụ này khắc phục
- Sót lại từ Microsoft Word. Tác giả mặc định của Word là người đã cài đặt phần mềm; một cái tên “John Smith” có thể đến từ một bản cài đặt hàng chục năm trước vẫn còn dùng.
- Tên người tạo sai. Một cái tên lỗi thời trong trường người tạo có thể được ghi đè chỉ bằng một lần chỉnh sửa.
- Tiêu đề sao chép dán. Các tệp PDF xuất ra từ trang web thường thừa hưởng tiêu đề của trang web, bao gồm cả hậu tố kiểu “ | Tên Trang“.
- Mã phiên bản nội bộ. Việc một tệp có tên “v14_final_FINAL_dungcainay.pdf” là một chuyện; việc để “v14_final_FINAL” làm tiêu đề lại là chuyện khác.
XMP và siêu dữ liệu mở rộng
Các tệp PDF hiện đại còn mang theo XMP (eXtensible Metadata Platform) bên cạnh từ điển thông tin tài liệu cơ bản. XMP có thể chứa:
- Bản quyền và quyền sử dụng
- Phần mềm nhà sản xuất và lịch sử phiên bản
- Mẫu gốc và quy trình làm việc
- Các trường tùy chỉnh do quy trình xuất bản thiết lập
Trình chỉnh sửa này ghi các trường thông tin tài liệu tiêu chuẩn (tiêu đề, tác giả, chủ đề, từ khóa, người tạo); nó không xóa toàn bộ gói XMP. Nếu bạn cần xóa sạch mọi dấu vết của XMP, hãy dùng một công cụ làm sạch PDF chuyên dụng hoặc tính năng “Xóa thông tin ẩn” của Acrobat.
Những gì không được tính là siêu dữ liệu
- Nội dung trang. Chỉnh sửa siêu dữ liệu không thay đổi bất kỳ văn bản nào trên trang.
- Dữ liệu trường biểu mẫu. Các trường biểu mẫu là một phần của nội dung trang, không phải siêu dữ liệu.
- Dấu trang và dàn ý. Được lưu riêng trong cấu trúc PDF.
- Tệp nhúng và tệp đính kèm. Được xử lý riêng; chỉnh sửa siêu dữ liệu không đụng đến chúng.
Mẹo
- Luôn đặt một tiêu đề phù hợp. Không gì trông nghiệp dư hơn trên thẻ trình duyệt bằng “Microsoft Word - baocaocuoicung.docx”.
- Giữ từ khóa tập trung. Từ 3 đến 7 cụm từ, mỗi cụm đều liên quan. Nhồi nhét từ khóa không giúp ích cho việc tìm kiếm PDF, giống như nó chẳng giúp ích cho SEO web.
- Dọn dẹp trước khi chia sẻ. Mọi tệp PDF dành cho khách hàng, cơ quan quản lý hay để tải lên công khai đều đáng được rà soát siêu dữ liệu.
- Đừng dựa vào siêu dữ liệu để chứng minh quyền tác giả. Siêu dữ liệu PDF chỉnh sửa cực kỳ dễ; chữ ký mã hóa mới là công cụ chuỗi lưu ký thực sự.
Câu hỏi thường gặp
Microsoft Office ghi lại người dùng Windows đã cài đặt phần mềm làm tác giả mặc định. Trên máy tính dùng chung, tên của người thực hiện cài đặt ban đầu vẫn còn trên mọi tài liệu được tạo trên máy đó cho đến khi được thay đổi thủ công. Hãy luôn kiểm tra và cập nhật tác giả trước khi chia sẻ ra bên ngoài.
Không. Siêu dữ liệu nằm trong một từ điển thông tin riêng. Việc chỉnh sửa nó không đụng đến bất kỳ trang nội dung nào: văn bản, hình ảnh, phông chữ và bố cục đều giữ nguyên hệt như trước.
Năm trường thông tin tài liệu tiêu chuẩn: tiêu đề, tác giả, chủ đề, từ khóa và người tạo. Công cụ cũng tự động đóng dấu trường Nhà sản xuất. Ngày tạo và ngày sửa đổi không chỉnh sửa được ở đây; với chúng, bạn cần một tiện ích siêu dữ liệu chuyên dụng hoặc Acrobat.
Có. Google lập chỉ mục tiêu đề của PDF và, ở một mức độ nào đó, cả chủ đề lẫn từ khóa. Một tiêu đề rõ ràng, mang tính mô tả sẽ cải thiện đáng kể tỷ lệ nhấp vào kết quả tìm kiếm PDF. Chủ đề và từ khóa có ích, nhưng quan trọng ít hơn tiêu đề và văn bản trên trang.
Công cụ liên quan
OCR cho PDF
Trích xuất văn bản thuần từ bản in quét trong PDF bằng OCR trên trình duyệt. Hỗ trợ 12 ngôn ngữ, tệp tối đa 20 MB và tài liệu tối đa 40 trang.
Sắp xếp lại trang PDF
Sắp xếp, bỏ hoặc lặp trang PDF bằng dãy số chính xác cách nhau bằng dấu phẩy. Xử lý tệp tối đa 20 MiB và 200 trang trên trình duyệt.
Lấy hình ảnh từ tệp PDF
Trích xuất từng hình ảnh được chứa trong tệp PDF và tải chúng ra riêng lẻ hoặc dưới dạng một tệp ZIP duy nhất, đồng thời giữ nguyên độ phân giải gốc.
Trình chuyển HEIC sang PDF
Ghép tối đa 20 ảnh HEIC hoặc HEIF vào một tệp PDF khổ A4 hoặc US Letter. Mọi thao tác đều diễn ra trong trình duyệt.
Biểu mẫu PDF
Điền cục bộ các trường AcroForm có sẵn, giữ nguyên dữ liệu điền trước và tải xuống bản tương tác hoặc bản làm phẳng được chọn rõ ràng.
Trình tạo PDF tìm kiếm được
Biến một PDF đã quét thành tài liệu tìm kiếm và chọn được chữ bằng cách thêm lớp văn bản OCR vô hình. Hoàn toàn trong trình duyệt; 7 ngôn ngữ chữ Latinh.
Công cụ này có phiên bản bằng các ngôn ngữ khác
- Editor de metadatos PDF [ES]
- PDF-metadataredigerare [SV]
- Éditeur de métadonnées PDF [FR]
- เครื่องมือแก้ไขข้อมูลเมตา PDF [TH]
- محرر بيانات PDF الوصفية [AR]
- Editor Metadata PDF [ID]
- PDF 메타데이터 편집기 [KO]
- PDF-metadata-editor [NL]
- PDF メタデータエディター [JA]
- PDF-Metadaten-Editor [DE]
- Edytor metadanych PDF [PL]
- Editor de metadados de PDF [PT]
- PDF Metadata Editor [EN]
- Editor di metadati PDF [IT]
- Редактор метаданных PDF [RU]
- PDF Meta Veri Düzenleyici [TR]
- PDF 元数据编辑器 [ZH]