Wyodrębnianie obrazów z PDF
Wyodrębnij z pliku PDF obrazy, takie jak zdjęcia, logo, wykresy i zeskanowane strony. Zobacz każdy obraz wraz z jego rozmiarem i pobierz je pojedynczo lub wszystkie naraz jako plik ZIP. Zdjęcia JPEG są zapisywane bez zmian, bez utraty jakości. Działa w przeglądarce.
Wejście
Wyjście
Instrukcja
Czym jest narzędzie do wyodrębniania obrazów z PDF?
PDF przechowuje obrazy ze swoich stron jako osobne pliki wewnątrz dokumentu: zdjęcia, logotypy, wykresy, ilustracje, a w przypadku zeskanowanego dokumentu — skan każdej strony. Narzędzie do wyodrębniania obrazów z PDF zapisuje te obrazy osobno, dzięki czemu możesz je zachować i ponownie wykorzystać w rozdzielczości, w jakiej znajdują się w PDF, zamiast robić zrzuty ekranu stron.
Opis narzędzia
To narzędzie wyszukuje wszystkie obrazy w PDF i wyświetla je w siatce wraz z wymiarami każdego obrazu w pikselach i rozmiarem pliku. Możesz pobrać każdy obraz osobno lub pobrać wszystkie jednocześnie jako plik ZIP. Zdjęcia zapisane jako JPEG są zachowywane dokładnie w takiej postaci, w jakiej znajdują się w PDF, a wszystkie pozostałe obrazy są zapisywane jako PNG.
Funkcje
- Wyodrębnia zdjęcia, logotypy, wykresy i zeskanowane strony z dowolnego PDF
- Zapisuje zdjęcia JPEG bez ponownego kodowania, dzięki czemu zachowują pełną jakość i rozmiar pliku
- Zapisuje wszystkie pozostałe obrazy jako bezstratne pliki PNG z zachowaniem przezroczystości
- Wyświetla tylko raz obraz występujący na wielu stronach, na przykład logotyp
- Nadaje każdemu plikowi nazwę odpowiadającą stronie, na przykład page-3-image-2.jpg
- Pobiera pojedyncze obrazy lub wszystkie jednocześnie jako plik ZIP
- Działa w przeglądarce, więc PDF nigdy nie opuszcza Twojego urządzenia
Jak to działa
Narzędzie odczytuje PDF za pomocą PDF.js i przegląda strony po kolei, zbierając obrazy wyświetlane na każdej stronie, w tym obrazy w polach formularzy i pieczęciach. PDF.js dekoduje każdy format obrazu obsługiwany przez PDF, nakłada maskę przezroczystości i konwertuje kolory do RGB.
Gdy obraz jest zapisany jako zwykły plik JPEG w skali szarości lub w kolorach RGB, narzędzie kopiuje oryginalne dane JPEG z PDF zamiast je dekodować, dzięki czemu zdjęcie pozostaje identyczne bajt po bajcie. Pozostałe obrazy, takie jak zdjęcia CMYK, obrazy z przezroczystością i skompresowane mapy bitowe, są zapisywane jako PNG po dekodowaniu. Obrazy występujące w PDF więcej niż raz są porównywane na podstawie zawartości i wyświetlane przy pierwszej stronie, na której się pojawiają.
Czarno-białe obrazy maskujące, często używane w PDF-ach zawierających zeskanowane strony z tekstem, są zapisywane jako czarne obrazy na białym tle.
Uwagi
- Nie można odczytać PDF-ów chronionych hasłem. Najpierw usuń hasło.
- PDF z ograniczeniami, takimi jak zakaz kopiowania lub drukowania, jest zaszyfrowany nawet wtedy, gdy otwiera się bez hasła. Obrazy są z niego wyodrębniane w zwykły sposób, ale zdjęcia JPEG są zapisywane jako PNG, ponieważ ich zapisane dane są zaszyfrowane i nie można ich skopiować w niezmienionej postaci.
- Grafiki wektorowe, takie jak wykresy narysowane za pomocą linii i kształtów, oraz tekst nie są obrazami, więc nie są wyodrębniane. Aby zapisać całą stronę jako obraz, przekonwertuj ją do PNG.
- Obrazy zachowują rozdzielczość, w jakiej są zapisane w PDF, która może być większa lub mniejsza niż sugeruje ich wygląd na stronie. Obraz przycięty lub przeskalowany jest wyodrębniany w całości.
- Bardzo duże obrazy mogą zostać zmniejszone do największego rozmiaru, jaki przeglądarka może wyświetlić.