Afbeeldingen uit PDF halen
Haal afbeeldingen uit een PDF, zoals foto's, logo's, grafieken en gescande pagina's. Bekijk elke afbeelding met de bijbehorende afmetingen en download ze afzonderlijk of allemaal tegelijk als ZIP-bestand. JPEG-foto's worden opgeslagen zonder kwaliteitsverlies. Werkt in je browser.
Invoer
Uitvoer
Readme
Wat is een tool voor het extraheren van afbeeldingen uit PDF-bestanden?
Een PDF slaat afbeeldingen op de pagina's op als afzonderlijke afbeeldingsbestanden in het document: foto's, logo's, grafieken, illustraties en, in een gescand document, de scan van elke pagina. Een tool voor het extraheren van afbeeldingen uit PDF-bestanden haalt deze afbeeldingen eruit, zodat je ze kunt opslaan en opnieuw gebruiken met de resolutie die ze in de PDF hebben, in plaats van schermafbeeldingen van de pagina's te maken.
Beschrijving van de tool
Deze tool vindt alle afbeeldingen in een PDF en toont ze in een raster, samen met de afmetingen in pixels en de bestandsgrootte van elke afbeelding. Je kunt elke afbeelding afzonderlijk downloaden of ze allemaal tegelijk als ZIP-bestand downloaden. Foto's die als JPEG zijn opgeslagen, worden precies zo opgeslagen als ze in de PDF staan. Alle andere afbeeldingen worden als PNG opgeslagen.
Functies
- Haalt foto's, logo's, grafieken en gescande pagina's uit elke PDF
- Slaat JPEG-foto's op zonder ze opnieuw te coderen, zodat de volledige kwaliteit en bestandsgrootte behouden blijven
- Slaat alle andere afbeeldingen op als verliesvrije PNG, waarbij transparantie behouden blijft
- Vermeldt een afbeelding die op meerdere pagina's voorkomt, zoals een logo, slechts één keer
- Geeft elk bestand een naam op basis van de pagina, zoals pagina-3-afbeelding-2.jpg
- Downloadt afzonderlijke afbeeldingen of alle afbeeldingen tegelijk als ZIP-bestand
- Werkt in je browser, zodat de PDF je apparaat nooit verlaat
Hoe het werkt
De tool leest de PDF met PDF.js en doorloopt de pagina's één voor één. Daarbij verzamelt de tool de afbeeldingen die op elke pagina worden weergegeven, waaronder afbeeldingen in formuliervelden en stempels. PDF.js decodeert elk afbeeldingsformaat dat een PDF kan bevatten, past het transparantiemasker toe en zet de kleuren om naar RGB.
Als een afbeelding is opgeslagen als een gewoon JPEG-bestand in grijswaarden of RGB, kopieert de tool de oorspronkelijke JPEG-gegevens rechtstreeks uit de PDF, in plaats van de afbeelding te decoderen. Zo blijft de foto byte voor byte hetzelfde. Andere afbeeldingen, zoals CMYK-foto's, afbeeldingen met transparantie en gecomprimeerde bitmapafbeeldingen, worden na het decoderen opgeslagen als PNG. Afbeeldingen die meerdere keren in de PDF voorkomen, worden op basis van hun inhoud vergeleken en vermeld op de eerste pagina waarop ze voorkomen.
Zwart-witte maskerafbeeldingen, die PDF-bestanden vaak gebruiken voor gescande pagina's met tekst, worden opgeslagen als zwart op wit.
Opmerkingen
- PDF-bestanden die met een wachtwoord zijn beveiligd, kunnen niet worden gelezen. Verwijder eerst het wachtwoord.
- Een PDF met beperkingen, zoals een verbod op kopiëren of afdrukken, is versleuteld, zelfs als het bestand zonder wachtwoord kan worden geopend. De afbeeldingen worden op de gebruikelijke manier geëxtraheerd, maar JPEG-foto's worden opgeslagen als PNG, omdat de opgeslagen gegevens zijn versleuteld en niet ongewijzigd kunnen worden gekopieerd.
- Vectorafbeeldingen, zoals grafieken die met lijnen en vormen zijn getekend, en tekst zijn geen afbeeldingen en worden daarom niet geëxtraheerd. Als je een hele pagina als afbeelding wilt opslaan, converteer je de pagina naar PNG.
- Afbeeldingen behouden de resolutie waarin ze in de PDF zijn opgeslagen. Die kan hoger of lager zijn dan de resolutie waarmee ze op de pagina worden weergegeven. Een bijgesneden of geschaalde afbeelding wordt in zijn geheel geëxtraheerd.
- Zeer grote afbeeldingen kunnen worden verkleind tot de maximale grootte die je browser kan weergeven.