Was ist ein PDF-Bildextraktor?

Ein PDF speichert die Bilder auf seinen Seiten als separate Bilddateien im Dokument: Fotos, Logos, Diagramme, Illustrationen und bei einem gescannten Dokument den Scan jeder einzelnen Seite. Ein PDF-Bildextraktor holt diese Bilder heraus, damit Sie sie in der Auflösung speichern und wiederverwenden können, in der sie im PDF vorliegen, anstatt Screenshots der Seiten zu machen.

Beschreibung des Tools

Dieses Tool findet alle Bilder in einem PDF und zeigt sie in einer Rasteransicht mit den Abmessungen jedes Bildes in Pixeln und der jeweiligen Dateigröße an. Sie können jedes Bild einzeln oder alle zusammen als ZIP-Datei herunterladen. Als JPEG gespeicherte Fotos werden genau so gespeichert, wie sie im PDF vorliegen. Alle anderen Bilder werden als PNG gespeichert.

Funktionen

  • Extrahiert Fotos, Logos, Diagramme und gescannte Seiten aus jedem PDF
  • Speichert JPEG-Fotos ohne erneute Kodierung, sodass sie ihre volle Qualität und Dateigröße behalten
  • Speichert alle anderen Bilder als verlustfreies PNG und erhält dabei die Transparenz
  • Listet ein Bild, das auf vielen Seiten erscheint, beispielsweise ein Logo, nur einmal auf
  • Benennt jede Datei nach der Seite, beispielsweise page-3-image-2.jpg
  • Lädt einzelne Bilder oder alle zusammen als ZIP-Datei herunter
  • Läuft in Ihrem Browser, sodass das PDF Ihr Gerät niemals verlässt

So funktioniert es

Das Tool liest das PDF mit PDF.js und geht die Seiten der Reihe nach durch. Dabei sammelt es die Bilder, die auf jeder Seite dargestellt werden, einschließlich Bildern in Formularfeldern und Stempeln. PDF.js dekodiert jedes Bildformat, das ein PDF enthalten kann, wendet dessen Transparenzmaske an und wandelt die Farben in RGB um.

Wenn ein Bild als normale JPEG-Datei in Graustufen oder RGB gespeichert ist, kopiert das Tool die ursprünglichen JPEG-Daten aus dem PDF, anstatt das Bild zu dekodieren. So bleibt das Foto bytegenau unverändert. Andere Bilder, etwa CMYK-Fotos, Bilder mit Transparenz und komprimierte Bitmaps, werden nach dem Dekodieren als PNG gespeichert. Bilder, die mehrmals im PDF vorkommen, werden anhand ihres Inhalts verglichen und nur auf der ersten Seite aufgeführt, auf der sie erscheinen.

Schwarz-Weiß-Schablonenbilder, die PDFs häufig für gescannte Textseiten verwenden, werden in Schwarz auf Weiß gespeichert.

Hinweise

  • Passwortgeschützte PDFs können nicht gelesen werden. Entfernen Sie zuerst das Passwort.
  • Ein PDF mit Einschränkungen, etwa einem Kopier- oder Druckverbot, ist auch dann verschlüsselt, wenn es sich ohne Passwort öffnen lässt. Die Bilder werden wie gewohnt extrahiert, aber JPEG-Fotos werden als PNG gespeichert, da ihre gespeicherten Daten verschlüsselt sind und nicht unverändert kopiert werden können.
  • Vektorgrafiken, etwa mit Linien und Formen gezeichnete Diagramme, sowie Text sind keine Bilder und werden daher nicht extrahiert. Um eine ganze Seite als Bild zu speichern, wandeln Sie die Seite stattdessen in PNG um.
  • Bilder behalten die Auflösung bei, mit der sie im PDF gespeichert sind. Diese kann höher oder niedriger sein, als es ihrem Aussehen auf der Seite entspricht. Ein zugeschnittenes oder skaliertes Bild wird vollständig extrahiert.
  • Sehr große Bilder werden möglicherweise auf die größte Größe verkleinert, die Ihr Browser darstellen kann.