Dokumentinformationen, Softwareangaben und XMP-Metadaten prüfen und löschen

Legen Sie ein PDF ab, und die Seite liest die Werte, die die Datei trägt: Title, Author, Subject, Keywords, Creator, Producer, Erstellungs- und Änderungsdatum sowie die Angabe, ob ein XMP-Paket oder ein PieceInfo-Eintrag angehängt ist. Jeder weitere Schlüssel des Info-Wörterbuchs erscheint unter seinem PDF-Namen: eine als inkrementelles Update geschriebene Datei zeigte eine Zeile Custom neben den neun Standardzeilen.

Wählen Sie die Gruppen zum Löschen und drücken Sie Ausgewählte Metadaten entfernen: die Tabelle wird zur Vorher-Nachher-Gegenüberstellung, der Zähler nennt die verschwundenen Werte, und die bereinigte Kopie lädt als name-metadata-clean.pdf herunter. pdf-lib arbeitet in diesem Tab, die Datei verlässt den Browser also nicht.

  1. Legen Sie ein PDF auf die Eingabefläche oder klicken Sie, um eine Datei zu wählen; die Tabelle füllt sich aus der lokalen Datei.
  2. Prüfen Sie die Zeilen: vier beschreibende Felder, fünf technische Felder, jeder weitere Schlüssel des Info-Wörterbuchs und die XMP-Zeile, die Vorhanden zeigt, wenn ein XMP-Paket oder ein PieceInfo-Eintrag angehängt ist.
  3. Entfernen Sie das Häkchen bei den Gruppen, die bleiben sollen. Alle drei sind voreingestellt: Dokumentinformationen, Software und Datumsangaben, Eingebettete XMP-Metadaten.
  4. Drücken Sie Ausgewählte Metadaten entfernen. Die Tabelle wird zu Feld / Vorher / Nachher, der Zähler zeigt die gelöschten Werte, und die Kopie lädt als <name>-metadata-clean.pdf herunter.
  5. Drücken Sie Leeren, um Dateiliste, Tabelle und Zähler vor dem nächsten Dokument zu leeren.

Was die Tabelle liest, was jede Gruppe löscht und was die Kopie behält

Welche Gruppe welche Werte löscht

Dokumentinformationen löscht Title, Author, Subject, Keywords und jeden weiteren Schlüssel des Info-Wörterbuchs, auch einen eigenen wie /Custom. Software und Datumsangaben löscht Creator, Producer, CreationDate, ModDate und Trapped. Eingebettete XMP-Metadaten löscht das XMP-Paket samt PieceInfo-Eintrag. Die beiden Listen überschneiden sich nicht: ist nur Software und Datumsangaben gewählt, bleiben Titel und Autor in der Kopie.

Das XMP-Paket wird als Objekt entfernt, nicht nur ausgehängt: die Kopie wurde Byte für Byte geprüft, und die Kennung des Pakets war nicht mehr darin. Nur die Katalogreferenz zu löschen ließ das Paket früher in der Datei lesbar.

Was die Kopie behält

Seitenzahl, Seiteninhalt, Anmerkungen und Formularfelder bleiben unverändert: eine Datei mit 40 Seiten kam mit 40 Seiten zurück, und ein Formulardokument kam mit AcroForm, seinen drei Anmerkungen, dem eingetragenen Text und dem gesetzten Häkchen zurück.

Der Trailer behält sein ID-Paar, eine Datei mit ID geht also mit derselben ID heraus. Das Löschen von Metadaten versteckt nichts, was auf einer Seite sichtbar bleibt oder anderswo in der Datei gespeichert ist.

Was das Werkzeug ablehnt und was es annimmt

Eine Datei, die kein PDF ist, eine leere Datei und eine abgeschnittene Datei enden mit demselben Satz und ohne Download: die PDF-Engine meldet eine abgeschnittene Datei als Dokument mit null Seiten, und die Seite lehnt dieses Ergebnis ab, statt eine Kopie mit unvollständigem Seitenbaum zu schreiben. Ein verschlüsseltes PDF wird getrennt gemeldet, weil die Engine es nicht entschlüsseln kann und die Seite nie nach einem Passwort fragt.

Als inkrementelles Update bearbeitete Dateien werden in ihrer neuesten Revision gelesen, und ältere Revisionen kommen nicht in die Kopie zurück: eine Datei, deren Info-Wörterbuch nur in der ersten Revision stand, verlor Titel und Autor wie jede andere. In UTF-16BE gespeicherte Texte (ein chinesischer Titel, ein kyrillischer Autor) und beide PDF-Datumsformate (D:2024, D:20230101120000-05'30') werden gelesen, Datumsangaben erscheinen als ISO-8601-Zeitstempel in UTC.

Zuletzt verwendet: