Identifier ce qui alourdit le fichier
Avant de toucher au moindre réglage, déterminez quel type de PDF vous avez. Le texte lui-même est remarquablement compact : une page de texte saisi, stockée sous forme de caractères, ne pèse souvent que quelques kilo-octets. Les mégaoctets se trouvent dans les images. Un document numérisé est le cas extrême, car chaque page est une photo pleine page du papier, même si elle ne montre que du texte noir. Les photos prises au téléphone ajoutent plusieurs mégaoctets chacune, et une présentation exportée avec des images haute résolution peut peser plus lourd que le fichier de présentation d’origine. Un test rapide indique dans quel cas vous êtes : essayez de sélectionner un mot. Si le curseur trace un cadre au lieu de surligner le texte, la page est une image, et la compression d’images fera une vraie différence. Si le texte se sélectionne normalement et que le fichier reste lourd, cherchez les photos, captures d’écran et schémas intégrés. Diviser la taille du fichier par le nombre de pages donne un autre indice : un fichier de 40 Mo de 20 pages fait en moyenne 2 Mo par page, ce qui signifie presque toujours des pages numérisées ou photographiques.
La résolution est le réglage qui compte le plus
La résolution d’une image se mesure en ppp, le nombre de pixels utilisés pour chaque pouce de la page imprimée. Elle a un effet démesuré sur la taille, car les pixels augmentent avec la surface, pas avec la largeur. Une page A4 numérisée à 300 ppp mesure environ 2 480 sur 3 508 pixels, soit près de 8,7 millions de pixels. La même page à 150 ppp mesure environ 1 240 sur 1 754 pixels, soit 2,2 millions environ, le quart des données. Diviser la résolution par deux supprime donc environ les trois quarts des pixels avant même toute compression. Pour la lecture à l’écran, 150 ppp suffit confortablement pour un texte ordinaire ; les petits caractères, les notes de bas de page et les signatures restent plus nets autour de 200 ppp, et 300 ppp est une valeur courante pour l’impression. Les bons outils de compression ne réduisent que les images supérieures à la cible : une page déjà à 120 ppp n’est pas dégradée par un réglage à 150 ppp. Compresser PDF fonctionne ainsi, avec des niveaux correspondant à l’écran, à l’usage courant et à l’impression.
Pourquoi la compression JPEG floute d’abord le texte
La plupart des images photographiques des PDF utilisent la compression JPEG, qui gagne de la place en supprimant des détails que l’œil a peu de chances de remarquer. Elle découpe l’image en petits blocs et simplifie chacun d’eux. Les photos le supportent bien, car elles sont faites de dégradés doux. Le texte non, car les lettres sont des contours noirs nets sur fond blanc, et des réglages JPEG agressifs laissent de légers halos, des empattements baveux et un bruit en blocs autour de chaque caractère. C’est pourquoi un contrat numérisé se dégrade bien plus vite qu’une photo de vacances au même réglage de qualité. Deux habitudes aident. D’abord, compressez à partir du fichier d’origine plutôt que d’une copie déjà compressée, car chaque passe de compression avec perte ajoute de nouveaux défauts aux anciens. Ensuite, jugez la qualité sur le plus petit texte du document, pas sur l’aspect général de la page. Les dessins au trait et les captures d’écran se prêtent mieux à une compression sans perte, qui garde les contours exacts, même si elle produit des fichiers plus lourds pour les photos.
Couleur, niveaux de gris et noir et blanc
Une image en couleur stocke trois canaux d’information par pixel, une image en niveaux de gris un seul. En règle générale, passer une image en niveaux de gris ramène ses données brutes à environ un tiers avant compression, et les numérisations de documents ordinaires n’y perdent rien d’important. Les niveaux de gris conservent toute la gamme de tons : ombres, photos et tampons gardent un aspect naturel. Ce n’est pas le bon choix quand la couleur porte une information : graphiques à séries codées par couleur, passages surlignés, annotations colorées ou signatures dont l’encre bleue contribue à prouver qu’il s’agit d’un original. PDF en niveaux de gris convertit tout le document ; sur un serveur équipé de Ghostscript, le texte reste du vrai texte, tandis que la solution de repli rend les pages sous forme d’images en niveaux de gris. Pour des courriers, formulaires et relevés numérisés, les niveaux de gris suivis d’une compression modérée forment souvent la combinaison la plus efficace pour obtenir un petit fichier tout en gardant l’ensemble lisible.
Polices, doublons et poids caché
Après les images, le poids restant d’un PDF vient généralement des polices intégrées et de la façon dont le fichier a été enregistré. Les PDF bien conçus n’intègrent que les caractères réellement utilisés, ce qu’on appelle un sous-ensemble, mais certains documents intègrent des polices complètes, et un fichier qui utilise de nombreuses polices peut transporter une quantité étonnante de données de police. Les logos et fonds répétés sur chaque page peuvent être stockés une fois et réutilisés, ou stockés à nouveau sur chaque page, selon le logiciel qui a créé le fichier. Les documents modifiés et enregistrés de nombreuses fois peuvent aussi accumuler des objets inutilisés hérités de versions antérieures. Réécrire le fichier avec nettoyage, ce que VelloDoc fait chaque fois qu’il enregistre un PDF, supprime ce poids mort. Ces gains sont réels mais modestes par rapport à la compression des images : ils suffisent rarement, à eux seuls, à régler le cas d’un fichier plusieurs fois au-dessus d’une limite.
Respecter une limite de taille stricte
Les portails d’envoi ne regardent qu’un nombre, et même ce nombre est ambigu : certains comptent un mégaoctet comme 1 048 576 octets, d’autres comme 1 000 000. Visez légèrement sous la limite annoncée, par exemple 1,9 Mo pour un formulaire limité à 2 Mo, pour éviter un refus. Compresser à une taille cible est conçu pour cette situation. Il effectue une série de tentatives, chacune avec une résolution d’image et une qualité JPEG plus faibles, en partant d’environ 150 ppp et en descendant vers 55 ppp, et garde le premier résultat qui tient, car c’est celui qui préserve le plus de détails. Si aucune tentative ne tient, il renvoie la plus petite version plutôt qu’une erreur : vérifiez donc toujours la taille finale. Ouvrez ensuite le fichier et lisez le plus petit texte de la page. Un fichier qui respecte la limite mais reste illisible n’a pas résolu le problème : il l’a seulement transféré à la personne qui examine votre dossier.
Quand compresser n’est pas la bonne réponse
Certains fichiers ne peuvent pas respecter une limite sans devenir illisibles, et certains ne devraient pas être compressés du tout. Si un dossier numérisé de 60 pages doit tenir dans 2 Mo, la réponse honnête consiste souvent à envoyer moins : retirez les pages dont le destinataire n’a pas besoin avec Supprimer des pages, éliminez les pages vides de la numérisation avec Supprimer les pages blanches, ou divisez le document en parties envoyées séparément avec Diviser PDF. Pour les documents que vous archivez, conservez l’original en pleine qualité et ne compressez que la copie envoyée. Et pour les PDF publiés sur un site web, notez que rendre un fichier plus rapide à ouvrir est une autre tâche que le rendre plus léger : Optimiser un PDF pour le web réorganise le fichier pour un affichage progressif mais ne réduit pas sa taille, et les deux gagnent à être combinés.
Une liste de vérification pratique
Partez du fichier d’origine, pas d’une copie déjà compressée. Retirez les pages qu’il n’est pas nécessaire d’envoyer, y compris les versos vides des numérisations recto verso. Si les pages sont des documents en noir et blanc, passez-les en niveaux de gris. Compressez au niveau équilibré et comparez le résultat à l’original avec un zoom à 200 %, en regardant le plus petit texte et les signatures. Si un portail impose une limite, utilisez la compression à une taille cible avec une valeur juste en dessous, puis vérifiez à nouveau la lisibilité. Si la cible reste inatteignable sans nuire à la lisibilité, divisez le document ou demandez au destinataire un autre moyen d’envoi. Conservez l’original jusqu’à ce que la version allégée soit acceptée. Suivre cet ordre évite les deux échecs les plus courants : des fichiers légers mais illisibles, et des heures passées à lutter contre une limite qu’aucune compression raisonnable ne peut respecter. Le guide des outils d’optimisation détaille les outils associés, et le guide sur la qualité des numérisations montre comment obtenir d’emblée des numérisations plus légères et plus nettes.
Questions fréquentes
Pourquoi mon PDF numérisé est-il bien plus lourd qu’un document saisi ?
Chaque page numérisée est une image pleine page, alors qu’un document saisi stocke ses mots sous forme de caractères compacts. Une page de texte peut peser quelques kilo-octets en caractères et des centaines de kilo-octets en image.
Quelle résolution choisir pour un PDF envoyé par e-mail ?
Environ 150 ppp conviennent à la plupart des documents lus à l’écran. Choisissez environ 200 ppp si le document contient de petits caractères ou des signatures qui doivent rester lisibles, et gardez 300 ppp pour l’impression.
Compresser un PDF deux fois le rend-il plus léger ?
Généralement très peu, et chaque passe de compression avec perte ajoute des défauts. Compressez l’original une seule fois au niveau voulu plutôt que de recompresser une copie compressée.
La compression supprime-t-elle des pages ou du texte ?
Non. La compression modifie la façon dont les images sont stockées. Les pages, le texte et la structure du document ne changent pas, même si le texte numérisé peut paraître plus doux avec des réglages forts.
Pourquoi la compression a-t-elle à peine changé mon fichier ?
Le fichier contient probablement surtout du texte ou est déjà compressé. VelloDoc renvoie votre original quand le résultat ne serait pas plus léger. Diviser ou retirer des pages peut être une meilleure solution.