Aller au contenu
Français
L'établiDes outils qui ne téléversent rien
Un atelier de l'association ODERSARien ne part, rien n'est gardé, rien ne nous arrive.

L'atelier · Alléger un PDF

Comment ça marche : Alléger un PDF

Le poids d'un PDF, ce sont presque toujours ses images. L'outil les liste une par une, dit ce qu'il peut faire de chacune, et affiche le gain réel avant et après. Quand il n'y a rien à gagner, il le dit au lieu de vous rendre le même fichier avec un autre nom.

Ouvrir l'outil

Un PDF de vingt mégaoctets, c'est presque toujours un scan ou un document illustré : ses images pèsent tout, et le texte ne pèse rien. C'est la première chose à comprendre pour ne pas se faire avoir par les sites qui promettent de compresser n'importe quel PDF.

Réécrire un PDF sans toucher aux images ne gagne à peu près rien, et nous l'avons mesuré : sur un document à trois images, la réécriture complète a rendu cinq octets. La norme exclut en effet les flux d'images du mécanisme de compression des objets. Le seul vrai levier est donc de RÉENCODER les images, et c'est ce que fait cet outil.

Il travaille à découvert. Chaque image du document est listée avec ses dimensions, son poids et son mode d'encodage. Celles qu'il sait réencoder, il le dit ; celles qu'il ne sait pas toucher, il le dit aussi, avec la raison. À la fin, le gain est affiché image par image, et le fichier obtenu est relu pour compter ses pages.

Comment ça marche

  1. Déposez votre PDF. L'outil ouvre le document, trouve ses images, et vous les liste avant de rien faire.
  2. Réglez la largeur maximale et la qualité. Sur un scan, réduire la résolution gagne souvent plus que baisser la qualité.
  3. Cliquez. Le fichier arrive, et le tableau du gain vous dit ce qui a été réencodé et ce qui a été laissé tel quel.

Formats acceptés

Uniquement des PDF. Pour alléger une image seule, l'outil « Compresser et redimensionner » du coin images est plus direct et travaille par lot.

Document PDF

Le texte, les polices et la structure des pages sont recopiés sans être touchés. Seules les images JPEG du document sont réencodées, et seulement celles que votre navigateur sait décoder.

Voir la matrice de compatibilité

Ses limites

L'outil réencode les images JPEG, et seulement elles

Ce sont celles qui font le poids d'un scan ou d'un document photo, et ce sont celles qu'un navigateur sait décoder tout seul. Une image rangée autrement dans le document (compression sans perte, image en noir et blanc de télécopie, image à un bit servant de pochoir) est laissée intacte et la ligne du tableau le dit avec sa raison. Retoucher ce qu'on ne sait pas relire est le meilleur moyen d'abîmer un fichier.

Une image en quadrichromie est laissée intacte, et l'outil la nomme

Un JPEG à quatre composantes vient d'une chaîne d'impression. Les navigateurs ne le décodent pas, et Adobe y applique en plus une inversion des valeurs qu'il faut connaître pour ne pas rendre un négatif. Nous détectons ces images en lisant leur en-tête, nous les laissons telles quelles, et nous le disons : un outil qui rendrait vos photos en négatif serait pire qu'un outil qui ne fait rien.

Un PDF qui n'est que du texte ne s'allègera pas ici

Il n'y a rien à réencoder : les polices et le texte pèsent déjà très peu, et la norme (paragraphe 7.5.7) exclut les flux du mécanisme de compression des objets. Nous l'avons mesuré : moins cinq octets sur un document à trois images. L'outil vous le dira au lieu de vous rendre un fichier presque identique en laissant croire au travail accompli.

Le réencodage est une PERTE définitive

Une image réencodée en JPEG à qualité réduite ne se restaure pas : les détails effacés sont partis. Gardez l'original si le document a une valeur d'archive. L'outil affiche le gain de chaque image pour que vous puissiez juger si l'échange en valait la peine, et un aperçu de la première image réencodée est montré avant et après.

Une image transparente garde son masque, qui n'est pas réencodé

Dans un PDF, la transparence d'une image vit dans une seconde image posée à côté, en niveaux de gris. Le JPEG ne sait pas porter de transparence : nous réencodons donc l'image visible et nous laissons son masque intact. C'est le comportement le plus sûr, et c'est aussi pourquoi une image transparente gagne moins que les autres.

80 Mo

Le document entier, ses images décodées et sa version allégée vivent en mémoire en même temps. C'est la limite honnête d'un onglet sur un appareil modeste, et le réencodage d'images est l'opération la plus gourmande de tout le site.

Un PDF protégé par mot de passe ne s'ouvre pas ici

Il faut d'abord le déverrouiller, ce qui demande son mot de passe. L'outil « Protéger un PDF par mot de passe » du même coin sait le faire.

Questions sur cet outil

Mon document est-il envoyé quelque part ?

Non, et vous pouvez le vérifier en trente secondes. Ouvrez l'inspecteur avec la touche F12, onglet « Réseau », videz la liste, puis déposez le document et allégez-le. Aucune ligne n'apparaît. Coupez votre connexion et refaites-le : l'outil fonctionne pareil, parce que le décodage et le réencodage des images sont faits par votre navigateur lui-même.

Pourquoi mon PDF de texte ne s'allège-t-il pas ?

Parce qu'il n'y a rien à alléger, et c'est une bonne nouvelle. Le texte d'un PDF est déjà stocké de façon compacte, ses polices ne pèsent que quelques dizaines de kilooctets, et la norme interdit de compresser les flux avec le reste des objets. Nous avons mesuré le gain d'une réécriture complète sur un document à trois images : cinq octets. Les sites qui annoncent « jusqu'à 90 % » sur n'importe quel PDF parlent en réalité de documents pleins d'images, et ils réencodent ces images exactement comme nous.

Vaut-il mieux réduire la largeur ou baisser la qualité ?

Réduire la largeur, presque toujours, et surtout sur un scan. Le poids d'une image varie à peu près comme sa surface : diviser la largeur par deux divise la surface par quatre. Baisser la qualité en dessous de 60 abîme visiblement les aplats et les textes fins d'une capture d'écran, pour un gain moindre. Commencez par ramener la largeur à ce que vous allez vraiment regarder.

Pourquoi certaines images sont-elles laissées intactes ?

Parce que l'outil ne touche que ce qu'il sait relire, et il vous nomme chaque cas. Une image en quadrichromie vient d'une chaîne d'impression, les navigateurs ne la décodent pas et Adobe y inverse les valeurs : la réencoder rendrait un négatif. Une image compressée sans perte, une image de télécopie en noir et blanc ou une image à un bit servant de pochoir sont soit déjà minuscules, soit détruites par un passage en JPEG. Dans tous ces cas, l'outil laisse l'image exactement où elle est.

Le fichier obtenu peut-il être plus lourd que l'original ?

Oui, et l'outil vous le dit en clair au lieu de le cacher. Cela arrive quand les images du document étaient déjà mieux compressées que ce que nous savons faire, ou quand vous demandez une qualité plus haute que celle d'origine. Dans ce cas, gardez votre original : c'est lui qui est le meilleur, et un outil honnête doit savoir dire qu'il n'a rien apporté.

Est-ce que ça retire mes métadonnées ?

Non, et c'est volontaire : alléger et nettoyer sont deux gestes différents, et les mélanger vous ferait croire que vous avez fait l'un quand vous vouliez l'autre. La fiche d'identité du document, son bloc XML et ce qui est posé sur les pages restent en place. L'outil « Nettoyer les métadonnées d'un PDF » du même coin les montre, les retire, puis rouvre le fichier produit pour dire ce qui reste.

Est-ce que la qualité du texte est touchée ?

Non. Le texte d'un PDF n'est pas une image : ce sont des instructions de tracé et une police. L'outil ne les recopie même pas, il les laisse dans le document. Le seul cas où le texte s'abîme est celui d'un scan, où le texte EST une image de texte : là, réduire la largeur le rend moins net, et c'est visible tout de suite sur l'aperçu avant et après.