Supprimer les métadonnées PDF

Passez en revue toutes les valeurs du fichier, y compris les clés personnalisées du dictionnaire Info et le paquet XMP, puis effacez les groupes choisis. Le tableau indique ce que chaque groupe a supprimé et la copie est écrite dans ce navigateur.

Fonctionne localement dans votre navigateur
·
    →

    Comment consulter et effacer les informations du document, les données logicielles et les métadonnées XMP

    Déposez un PDF : la page lit les valeurs qu’il contient (Title, Author, Subject, Keywords, Creator, Producer, les dates de création et de modification, ainsi que la présence d’un paquet XMP ou d’une entrée PieceInfo). Toute autre clé du dictionnaire d’informations apparaît sous son nom PDF : un fichier écrit en mise à jour incrémentale a montré une ligne Custom à côté des neuf lignes standard.

    Cochez les groupes à effacer et cliquez sur Supprimer les métadonnées sélectionnées : le tableau devient une comparaison avant/après, le compteur indique les valeurs disparues et la copie se télécharge sous le nom nom-metadata-clean.pdf. pdf-lib travaille dans cet onglet, le fichier ne quitte donc pas le navigateur.

    1. Déposez un PDF sur la zone d’entrée ou cliquez pour choisir un fichier ; le tableau se remplit depuis le fichier local.
    2. Vérifiez les lignes : quatre champs descriptifs, cinq champs techniques, toute clé supplémentaire du dictionnaire Info et la ligne XMP, qui affiche Présent lorsqu’un paquet XMP ou une entrée PieceInfo est joint.
    3. Décochez les groupes à conserver. Les trois sont cochés par défaut : Informations sur les documents, Logiciel et dates, Métadonnées XMP intégrées.
    4. Cliquez sur Supprimer les métadonnées sélectionnées. Le tableau devient Champ / Avant / Après, le compteur indique les valeurs effacées et la copie se télécharge sous <nom>-metadata-clean.pdf.
    5. Cliquez sur Effacer pour vider la liste de fichiers, le tableau et les compteurs avant d’ouvrir le document suivant.

    Ce que lit le tableau, ce que chaque groupe efface et ce que la copie conserve

    Ce que chaque groupe efface

    Informations sur les documents efface Title, Author, Subject, Keywords et toute autre clé du dictionnaire Info, y compris une clé personnalisée comme /Custom. Logiciel et dates efface Creator, Producer, CreationDate, ModDate et Trapped. Métadonnées XMP intégrées efface le paquet XMP et son entrée PieceInfo. Les deux listes ne se recouvrent pas : si seul Logiciel et dates est coché, le titre et l’auteur restent dans la copie.

    Le paquet XMP est supprimé en tant qu’objet, et pas seulement détaché : la copie a été analysée octet par octet et le marqueur qu’il contenait ne s’y trouvait plus. Supprimer la seule référence du catalogue laissait auparavant le paquet lisible dans le fichier.

    Ce que la copie conserve

    Nombre de pages, contenu, annotations et champs de formulaire passent sans modification : un fichier de 40 pages est revenu avec 40 pages, et un document de formulaire est revenu avec son AcroForm, ses trois annotations, le texte saisi et la case cochée.

    Le trailer conserve sa paire d’identifiants : un fichier qui arrive avec un ID repart avec le même. Effacer les métadonnées ne cache rien de ce qui reste visible sur une page ou stocké ailleurs dans le fichier.

    Ce que l’outil refuse, et ce qu’il accepte

    Un fichier qui n’est pas un PDF, un fichier vide et un fichier tronqué se terminent par la même phrase, sans téléchargement : le moteur PDF présente un fichier tronqué comme un document de zéro page, et la page refuse ce résultat au lieu d’écrire une copie à l’arbre de pages incomplet. Un PDF chiffré est signalé séparément, car le moteur ne peut pas le déchiffrer et la page ne demande jamais de mot de passe.

    Les fichiers modifiés par mises à jour incrémentales sont lus dans leur révision la plus récente, et les révisions antérieures ne reviennent pas dans la copie : un fichier dont le dictionnaire Info n’existait que dans la première révision a perdu titre et auteur comme un autre. Les chaînes stockées en UTF-16BE (un titre chinois, un auteur cyrillique) et les deux formats de date PDF (D:2024, D:20230101120000-05'30') sont lus, les dates étant affichées en ISO 8601 UTC.

    Outils récents :