Propriétés du document et métadonnées
Tout PDF peut stocker un ensemble de propriétés que la plupart des gens ne regardent jamais : titre, auteur, sujet, mots-clés, application ayant créé le document, logiciel ayant produit le PDF, dates de création et de modification. Beaucoup de fichiers contiennent aussi un flux XMP, un bloc XML qui reprend ces informations et peut en ajouter d’autres, comme l’historique des modifications ou le nom de l’organisation issu d’une licence logicielle. Rien de tout cela n’apparaît sur la page, mais n’importe qui peut le lire dans les propriétés du document d’une visionneuse. L’embarras classique vient d’un modèle : une proposition envoyée à un client dont le titre mentionne encore un autre client. Supprimer les métadonnées efface à la fois les propriétés et le flux XMP, et Voir et modifier les métadonnées permet de définir un titre propre et réfléchi pour les documents que vous publiez.
Du texte masqué mais pas supprimé
Les fuites de PDF les plus graves relèvent rarement du piratage. Elles surviennent quand quelqu’un dessine un rectangle noir ou un surlignage épais sur un texte sensible en pensant qu’il a disparu. La forme cache les mots à l’œil, mais le texte reste dans le fichier : il peut être sélectionné, copié dans un autre document, trouvé par une recherche ou révélé en déplaçant la forme. Des pièces de procédure et des rapports officiels ont ainsi divulgué des informations à plusieurs reprises. Un vrai caviardage fonctionne autrement : il supprime le contenu de la zone marquée avant de la remplir de noir. Caviarder un PDF retire le texte de chaque zone et efface les pixels d’image situés dessous. Quel que soit l’outil utilisé, vérifiez le résultat : recherchez dans le fichier caviardé les mots supprimés et essayez de sélectionner à travers les zones noires. Si quelque chose se surligne, le contenu est toujours là.
Du contenu hors de la page visible
Une page peut contenir plus qu’elle n’en montre. Rogner un PDF définit un cadre visible, mais tout ce qui se trouve à l’extérieur reste dans le fichier, où n’importe qui disposant d’un éditeur peut agrandir la page et le revoir. Les graphistes laissent parfois des notes ou des variantes juste au-delà du bord de la page. Du texte peut être blanc sur fond blanc, réduit à une taille illisible ou placé dans un calque facultatif désactivé. Aucune de ces méthodes n’est un moyen sûr de cacher quoi que ce soit. Rogner un PDF sert à ajuster les marges, pas à dissimuler. Quand vous avez besoin d’une copie qui ne contient que ce qui est visible sur chaque page, Aplatir un PDF rend chaque page en image et reconstruit le document à partir de ces images, en laissant de côté les calques cachés, le contenu hors page et le texte invisible.
Commentaires, historique des modifications et saisies de formulaire
Les commentaires de relecture vont souvent plus loin que prévu. Les notes peuvent être repliées et donc faciles à manquer, et chaque annotation peut porter le nom du relecteur et l’heure à laquelle elle a été faite. Les documents exportés depuis un traitement de texte peuvent inclure des commentaires ou le suivi des modifications selon les réglages d’export, ce qui dévoile des formulations supprimées volontairement. Les formulaires sont une autre source : les valeurs saisies dans les champs restent dans le fichier, y compris dans des champs ensuite masqués ou vidés visuellement dans certaines visionneuses. Le plus sûr est de traiter les commentaires et d’accepter ou refuser les modifications dans le document d’origine avant l’export. Si vous n’avez que le PDF, l’aplatissement intègre les annotations visibles et les valeurs de formulaire dans les images de page et abandonne les objets d’annotation et de formulaire sous-jacents ; supprimez avant l’aplatissement les commentaires que vous ne voulez pas montrer.
Les photos et les numérisations ont leurs propres données
Les images intégrées à un PDF peuvent révéler ce que la page ne montre pas. Les photos prises au téléphone ou à l’appareil photo contiennent souvent des données EXIF, qui peuvent inclure le modèle de l’appareil, la date et l’heure, et parfois des coordonnées GPS. Quand un JPEG est placé dans un PDF sans être réencodé, ses données d’origine peuvent l’accompagner ; l’outil JPG en PDF de VelloDoc intègre les JPEG standard sans modification pour préserver la qualité, alors retirez les données de localisation des photos avant la conversion si cela compte pour vous. Recadrer une image dans un logiciel de mise en page conserve généralement l’image entière en masquant simplement les bords, si bien qu’Extraire les images peut restituer l’original non recadré. Les numérisations capturent tout ce qui se trouve sur la vitre, y compris des notes adhésives et des feuilles voisines. L’aplatissement crée de nouvelles images de page sans les données d’image d’origine ni leurs métadonnées.
Pièces jointes, liens et signets
Certains PDF contiennent des fichiers entiers en pièce jointe, des tableurs justifiant un rapport jusqu’à d’anciennes versions réunies dans un portfolio, et ces pièces jointes passent facilement inaperçues dans de nombreuses visionneuses. Les liens hypertexte peuvent révéler des adresses de systèmes internes ou contenir des paramètres de suivi, et les titres de signets conservent parfois des libellés de travail comme « brouillon, ne pas envoyer ». Supprimer les métadonnées n’a aucun effet sur tout cela. L’aplatissement produit un nouveau document composé uniquement d’images de pages : pièces jointes, liens et signets ne sont donc pas repris, mais les liens cessent aussi de fonctionner. Pour les documents où ces détails comptent, vérifiez les panneaux des pièces jointes et des signets dans une visionneuse PDF complète avant de partager, et reconstruisez le PDF à partir d’une source nettoyée quand c’est possible.
Le contrôle d’accès est une couche distincte
Les mots de passe répondent à une autre question que tout ce qui précède. Le chiffrement contrôle qui peut ouvrir un document ; il ne change rien à ce que le document révèle à ceux qui peuvent l’ouvrir. Protéger un PDF chiffre un fichier en AES-256, une protection robuste contre quiconque n’a pas le mot de passe, à condition que ce mot de passe soit solide et transmis par un autre canal que le fichier. Mais chaque destinataire qui a le mot de passe voit aussi les métadonnées cachées, le texte masqué et les images non recadrées. Considérez la protection comme la dernière étape qui limite qui reçoit un document déjà nettoyé, jamais comme un substitut au nettoyage.
Une liste de vérification avant de partager
Travaillez du contenu vers l’accès. Déterminez d’abord ce dont le destinataire a réellement besoin, et retirez ou extrayez tout le reste avec Supprimer des pages ou Extraire des pages. Traitez les commentaires et le suivi des modifications dans le fichier source si vous l’avez. Caviardez correctement les zones sensibles, puis supprimez les métadonnées. Pour le résultat le plus sûr, aplatissez le document afin qu’il ne reste que le contenu visible. Protégez le fichier en dernier s’il doit être réservé à certaines personnes. Vérifiez ensuite : recherchez les termes caviardés, contrôlez les propriétés du document et extrayez le texte avec PDF en TXT pour voir exactement ce qu’un lecteur pourrait copier. Les fichiers traités sur VelloDoc le sont dans un dossier temporaire supprimé après le téléchargement, comme l’explique la page sur la sécurité des fichiers. Le guide des outils de sécurité détaille chaque outil. Le guide pas à pas pour supprimer les métadonnées avant de partager approfondit les propriétés du document.
Questions fréquentes
Peut-on voir ce que j’ai masqué en noir dans un PDF ?
Oui, si le rectangle noir n’est qu’une forme dessinée sur le texte. Les mots situés dessous peuvent être sélectionnés ou recherchés. Utilisez un vrai caviardage, puis faites une recherche dans le résultat pour confirmer que le texte a disparu.
L’export en PDF supprime-t-il les commentaires et le suivi des modifications de Word ?
Pas forcément. Cela dépend des réglages d’export. Traitez les commentaires et acceptez ou refusez les modifications dans Word avant de créer le PDF.
Les photos d’un PDF peuvent-elles contenir des données de localisation ?
Oui, si la photo d’origine contenait des données GPS et a été intégrée sans réencodage. Retirez les données de localisation avant la conversion, ou aplatissez le PDF pour créer de nouvelles images de page.
Un PDF protégé par mot de passe est-il confidentiel ?
Seulement vis-à-vis des personnes qui n’ont pas le mot de passe. Quiconque peut l’ouvrir voit tout son contenu et ses métadonnées : nettoyez donc le document avant de le protéger.
Quelle est la manière la plus sûre de partager une partie d’un document ?
Extrayez uniquement les pages nécessaires, caviardez les zones sensibles, supprimez les métadonnées et aplatissez le résultat, puis protégez-le si l’accès doit être limité.