Extracteur d’images PDF
Extrayez les images d’un PDF, comme les photos, les logos, les graphiques et les pages numérisées. Consultez chaque image et sa taille, puis téléchargez-les une par une ou toutes à la fois dans un fichier ZIP. Les photos JPEG sont enregistrées telles quelles, sans perte de qualité. Fonctionne dans votre navigateur.
Entrée
Sortie
Documentation
Qu’est-ce qu’un extracteur d’images PDF ?
Un PDF stocke les images de ses pages dans des fichiers image distincts à l’intérieur du document : photos, logos, graphiques, illustrations et, dans un document numérisé, la numérisation de chaque page. Un extracteur d’images PDF extrait ces images afin que vous puissiez les enregistrer et les réutiliser à la résolution qu’elles ont dans le PDF, au lieu de faire des captures d’écran des pages.
Description de l’outil
Cet outil trouve toutes les images d’un PDF et les affiche dans une grille, avec les dimensions de chaque image en pixels et sa taille de fichier. Vous pouvez télécharger chaque image séparément ou les télécharger toutes en même temps dans un fichier ZIP. Les photos enregistrées au format JPEG sont conservées telles quelles, exactement comme dans le PDF, et toutes les autres images sont enregistrées au format PNG.
Fonctionnalités
- Extrait les photos, les logos, les graphiques et les pages numérisées de n’importe quel PDF
- Enregistre les photos JPEG sans réencodage, afin qu’elles conservent leur qualité d’origine et leur taille de fichier
- Enregistre toutes les autres images au format PNG sans perte, en préservant la transparence
- Ne répertorie qu’une seule fois une image présente sur plusieurs pages, comme un logo
- Nomme chaque fichier selon la page où il apparaît, par exemple page-3-image-2.jpg
- Télécharge des images individuelles ou toutes les images dans un fichier ZIP
- Fonctionne dans votre navigateur : le PDF ne quitte donc jamais votre appareil
Fonctionnement
L’outil lit le PDF avec PDF.js et parcourt les pages une par une, en recueillant les images affichées sur chaque page, y compris celles des champs de formulaire et des tampons. PDF.js décode tous les formats d’image pris en charge par les PDF, applique leur masque de transparence et convertit leurs couleurs en RGB.
Lorsqu’une image est stockée sous forme de fichier JPEG standard en niveaux de gris ou en couleurs RGB, l’outil copie les données JPEG d’origine depuis le PDF au lieu de les décoder, afin que la photo reste strictement identique, octet par octet. Les autres images, comme les photos CMYK, les images avec transparence et les images bitmap compressées, sont enregistrées au format PNG après décodage. Les images présentes plusieurs fois dans le PDF sont comparées selon leur contenu et répertoriées à la première page où elles apparaissent.
Les images en noir et blanc de type pochoir, souvent utilisées dans les PDF pour les pages numérisées contenant du texte, sont enregistrées en noir sur fond blanc.
Remarques
- Les PDF protégés par mot de passe ne peuvent pas être lus. Supprimez d’abord le mot de passe.
- Un PDF soumis à des restrictions, comme l’interdiction de copier ou d’imprimer, est chiffré même s’il s’ouvre sans mot de passe. Ses images sont extraites normalement, mais les photos JPEG sont enregistrées au format PNG, car leurs données sont chiffrées et ne peuvent pas être copiées telles quelles.
- Les graphiques vectoriels, comme les graphiques dessinés avec des lignes et des formes, ainsi que le texte ne sont pas des images et ne sont donc pas extraits. Pour enregistrer une page entière sous forme d’image, convertissez-la plutôt au format PNG.
- Les images conservent la résolution à laquelle elles sont stockées dans le PDF, qui peut être supérieure ou inférieure à leur taille à l’écran sur la page. Une image recadrée ou redimensionnée est extraite dans son intégralité.
- Les images très volumineuses peuvent être réduites à la taille maximale que votre navigateur peut afficher.