Le PDF/A en bref
Le PDF/A est une famille de normes internationales, publiées sous la référence ISO 19005, destinée à la conservation à long terme des documents électroniques. Sa règle centrale : un fichier doit être autonome, c’est-à-dire contenir tout ce qu’il faut pour s’afficher à l’identique à l’avenir. Les polices doivent être intégrées, les couleurs définies indépendamment du périphérique, et les métadonnées du document stockées dans un format XML standard. Les fonctions qui dépendent de ressources externes ou pourraient modifier l’apparence sont interdites, notamment le chiffrement, JavaScript et les liens vers des contenus externes. La famille comporte plusieurs parties. Le PDF/A-1 est la plus ancienne et la plus restrictive ; le PDF/A-2 ajoute la prise en charge de fonctions PDF plus modernes comme la transparence, les calques et la compression JPEG 2000 ; le PDF/A-3 autorise en plus l’intégration de fichiers de tout type ; et le PDF/A-4 repose sur PDF 2.0. Les parties définissent aussi des niveaux de conformité, dont le niveau b, qui garantit l’apparence visuelle, est le plus utilisé.
Quand le PDF/A est exigé ou utile
Certains tribunaux, administrations, archives nationales et politiques de gestion documentaire exigent ou recommandent le PDF/A pour les dépôts et versements, et de nombreuses universités le demandent pour le dépôt des thèses dans leurs archives ouvertes. Dans certains pays, les factures électroniques structurées utilisent le PDF/A-3 avec des données lisibles par machine intégrées au fichier. En dehors de ces cas, le PDF/A mérite d’être envisagé pour tout document qui doit rester lisible pendant de nombreuses années : contrats signés, actes de propriété, rapports définitifs et papiers personnels. Il n’est pas nécessaire pour les échanges courants, et c’est un mauvais choix pour des fichiers qui doivent rester modifiables, être protégés par mot de passe ou comporter des fonctions interactives.
Ce que fait la conversion de VelloDoc
PDF en PDF/A utilise Ghostscript pour réécrire le document en PDF/A-2, en visant le niveau de base qui préserve l’apparence visuelle. L’outil intègre un profil de couleur sRGB comme intention de sortie du fichier, convertit les couleurs en RVB, intègre les polices lorsqu’elles sont disponibles et crée les métadonnées XML standard. Ghostscript reçoit pour consigne d’écarter les fonctions que le PDF/A n’autorise pas et de poursuivre plutôt que de s’arrêter au premier élément incompatible. Si le fichier source est protégé par un mot de passe, vous le saisissez pour qu’il puisse être lu, et le résultat est enregistré sans chiffrement, puisque le PDF/A ne l’autorise pas.
Ce qui peut changer lors de la conversion
L’objectif étant un fichier autonome et prévisible, certains éléments peuvent disparaître. Les couleurs définies pour l’impression, comme le CMJN, sont converties en RVB, ce qui peut légèrement modifier certaines teintes. JavaScript, les actions et le multimédia sont supprimés, et les champs de formulaire interactifs peuvent ne plus fonctionner comme des champs. Les mots de passe et les autorisations disparaissent. Les fichiers joints ne sont pas conservés. Une police absente du fichier source et impossible à intégrer peut être remplacée, ce qui peut modifier les retours à la ligne. Comparez toujours le fichier converti à l’original, page par page si le document est important, avant de vous y fier ou de supprimer l’original.
Valider le résultat
Un outil de conversion peut viser le PDF/A, mais seule la validation montre si un fichier est réellement conforme. Le validateur open source veraPDF, soutenu par la PDF Association, contrôle un fichier au regard des règles du PDF/A et liste les problèmes détectés. Si un tribunal, un service d’archives ou un système destinataire exige le PDF/A, validez avant le dépôt et conservez le rapport au cas où il serait demandé. Quand la validation échoue, la cause se trouve souvent dans le fichier source : structure endommagée, polices inhabituelles ou éléments impossibles à convertir. Lancer d’abord Réparer un PDF puis reconvertir peut aider ; si des erreurs persistent, un logiciel d’archivage spécialisé peut être nécessaire.
Préparer un document pour l’archivage
L’ordre compte. Réparez d’abord les fichiers endommagés. Rendez les documents numérisés interrogeables avec OCR PDF, car le PDF/A conserve ce qui existe mais n’ajoute pas de texte aux images. Définissez un titre, un auteur et un sujet clairs avec Voir et modifier les métadonnées avant la conversion, pas après : modifier les propriétés ensuite supprime les métadonnées XML exigées par le PDF/A. Remplissez les formulaires et, si leur apparence doit être figée exactement, Aplatir un PDF transforme les pages en images, au prix d’un texte non sélectionnable. Convertissez en PDF/A en dernière étape, validez le résultat et évitez d’utiliser d’autres outils sur le fichier archivé, car toute modification ultérieure peut rompre la conformité. Conservez l’original à côté de la copie d’archivage.
Questions fréquentes
Le PDF/A est-il la même chose que le PDF/X ou le PDF/UA ?
Non. Le PDF/X est une norme pour la production imprimée, le PDF/UA pour l’accessibilité et le PDF/A pour l’archivage à long terme. Un même fichier peut être conforme à plusieurs d’entre elles.
Un fichier PDF/A peut-il avoir un mot de passe ?
Non. Le PDF/A n’autorise pas le chiffrement : un fichier source protégé est donc enregistré sans son mot de passe.
Quelle version du PDF/A faut-il utiliser ?
Celle qu’exige le tribunal, le service d’archives ou le système destinataire. VelloDoc produit du PDF/A-2 ; si le PDF/A-1 ou le PDF/A-3 est expressément exigé, utilisez un logiciel qui vise cette partie.
La conversion en PDF/A rend-elle le texte numérisé interrogeable ?
Non. Le PDF/A conserve le document tel quel. Lancez l’OCR sur les numérisations avant la conversion.
Pourquoi définir les métadonnées avant la conversion ?
Le PDF/A exige des métadonnées XML dans le fichier. Modifier les propriétés ensuite avec Voir et modifier les métadonnées supprime ces métadonnées XML, ce qui peut rompre la conformité.