Ce que sont les métadonnées d’un PDF
Les PDF stockent des métadonnées à deux endroits. Le dictionnaire d’informations du document contient quelques champs standard : titre, auteur, sujet, mots-clés, application ayant créé le document d’origine, logiciel ayant produit le PDF, et dates de création et de modification. Un flux XMP, bloc XML intégré au fichier, reprend souvent ces informations et peut en ajouter d’autres, comme des identifiants de document, des noms d’outils d’édition et des entrées d’historique écrites par les logiciels qui ont manipulé le fichier. Presque rien de tout cela n’est saisi par une personne. Les traitements de texte remplissent l’auteur avec le nom du compte, les scanners et imprimantes ajoutent leur modèle, et les modèles transmettent leur titre d’origine à chaque document créé à partir d’eux.
Ce que les métadonnées peuvent révéler
Le champ auteur contient souvent un nom complet ou un nom d’utilisateur, ce qui compte quand un document doit rester anonyme, par exemple lors d’une relecture par les pairs à l’aveugle ou d’un signalement d’alerte. Le nom d’une entreprise, d’un service ou d’un client peut figurer dans le titre ou le sujet d’un modèle. Les versions de logiciels montrent quels outils utilise une organisation, et les dates peuvent contredire un récit : un rapport présenté comme tout juste rédigé peut porter une date de création vieille de plusieurs années, et une date de modification peut montrer qu’un document prétendument définitif a été changé ensuite. Les mots-clés conservent parfois des noms de projets internes. Rien de tout cela n’est visible quand le destinataire lit simplement les pages, mais quiconque ouvre les propriétés du document peut le voir.
Vérifier d’abord les métadonnées du PDF
La plupart des visionneuses PDF affichent les principaux champs dans un menu du type Propriétés du document. Vous pouvez aussi ajouter le fichier à Voir et modifier les métadonnées, qui lit le titre, l’auteur, le sujet et les mots-clés dès le chargement du PDF et vous permet de les modifier. Les visionneuses affichent rarement le flux XMP : un document qui paraît propre dans ses propriétés peut donc encore y contenir des informations. Si vous n’êtes pas sûr de ce que contient un fichier, supprimer toutes les métadonnées est le choix le plus sûr.
Supprimer les métadonnées avec VelloDoc
Supprimer les métadonnées vide le dictionnaire d’informations du document et efface le flux XMP, puis enregistre une copie propre. Les pages elles-mêmes, avec tout leur texte et leurs images, restent exactement identiques. Ajoutez le PDF, saisissez son mot de passe s’il est protégé, cliquez sur Supprimer les métadonnées et téléchargez le résultat. Si le fichier publié doit garder un titre utile, par exemple pour que les moteurs de recherche et les lecteurs d’écran le présentent correctement, ouvrez ensuite la copie propre dans Voir et modifier les métadonnées et ne remplissez que les champs que vous voulez partager. Vérifiez le résultat dans les propriétés du document de votre visionneuse avant de l’envoyer.
Ce que la suppression des métadonnées ne retire pas
Les métadonnées ne sont qu’une couche d’un PDF. Les commentaires et annotations peuvent contenir le nom de leurs auteurs, les champs de formulaire conservent les valeurs saisies, les pièces jointes voyagent dans le PDF, les signets peuvent porter des libellés révélateurs et les calques cachés peuvent contenir du contenu non affiché. Les photos intégrées aux pages peuvent encore contenir, dans leurs propres données d’image, des informations d’appareil, y compris la localisation. Et le contenu de la page lui-même, des noms présents dans le texte au texte caché en blanc ou sous une image, n’est pas modifié. Pour le contenu de la page, utilisez Caviarder un PDF, qui supprime ce qui se trouve dans les zones marquées. Quand vous avez besoin d’une copie ne contenant que ce qui est visible, Aplatir un PDF reconstruit chaque page sous forme de nouvelle image, ce qui écarte annotations, pièces jointes, texte caché et photos d’origine, mais rend aussi le texte impossible à sélectionner. Le nom du fichier est indépendant de tout cela : renommez-le aussi.
Une liste de vérification avant de partager
Travaillez du contenu vers les propriétés. Déterminez d’abord ce dont le destinataire a réellement besoin et retirez tout le reste avec Supprimer des pages ou Extraire des pages. Caviardez les informations sensibles des pages restantes et aplatissez le document si les commentaires, les données de formulaire ou le contenu caché peuvent poser problème. Supprimez les métadonnées en dernière étape de modification, pour qu’aucune étape antérieure ne laisse d’informations derrière elle. Si le fichier doit être protégé par un mot de passe, ajoutez-le avec Protéger un PDF une fois les métadonnées supprimées. Enfin, donnez au fichier un nom neutre et ouvrez-le une dernière fois pour vérifier que les pages et les propriétés sont conformes à vos attentes. Le guide sur ce qu’un PDF peut révéler détaille chacun de ces risques.
Questions fréquentes
La suppression des métadonnées modifie-t-elle les pages ?
Non. Supprimer les métadonnées vide les propriétés du document et le flux XMP ; le texte et les images des pages restent exactement identiques.
Le nom du fichier affichera-t-il encore mon nom ?
Oui, s’il contient votre nom. Le nom du fichier ne fait pas partie des métadonnées du PDF : renommez le fichier avant de l’envoyer.
Les commentaires et annotations sont-ils supprimés ?
Non. Les annotations peuvent contenir le nom de leurs auteurs. Supprimez-les dans un éditeur PDF, ou utilisez Aplatir un PDF pour créer une copie qui ne contient que des images de pages.
Les données de localisation des photos du PDF sont-elles supprimées ?
Non. Supprimer les métadonnées ne modifie pas les images intégrées. Aplatir un PDF reconstruit chaque page sous forme de nouvelle image, ce qui écarte les photos d’origine et leurs données d’appareil.
Faut-il supprimer les métadonnées avant ou après l’ajout d’un mot de passe ?
Avant. Supprimez d’abord les métadonnées, puis protégez la copie propre avec Protéger un PDF.