PDF edytowalny czy PDF-obraz — na czym naprawdę polega różnica
Ostatnia aktualizacja
Dwa pliki mogą oba być PDF-ami i zachowywać się zupełnie inaczej. Jeden pozwala zaznaczać tekst, kopiować cytaty, wyszukiwać słowa i edytować treść. Drugi wygląda identycznie na ekranie, ale w istocie jest obrazkiem dokumentu – tekst jest częścią obrazu, a nie czymś od niego oddzielnym. Pierwszy to PDF edytowalny; drugi to PDF-obraz (czasem nazywany zeskanowanym albo obrazowym PDF-em).
Wiedza o tym, który typ masz, ma znaczenie, bo narzędzia do pracy z każdym z nich są inne. PDF-y edytowalne reagują na edytory PDF, narzędzia konwersji i wyszukiwanie. PDF-obraz potrzebuje OCR-u, żeby stać się przeszukiwalny, a jego edycja oznacza albo najpierw OCR i dopiero edycję, albo całkowitą podmianę obrazu. Próba użycia narzędzi do PDF-ów edytowalnych na PDF-obrazie zwykle kończy się frustracją.
Ten poradnik wyjaśnia różnicę, prowadzi przez test, który da Ci odpowiedź w dwie sekundy, i pokazuje, kiedy który typ jest właściwym wyborem. Czasem PDF-obraz powstaje celowo – czasem to przypadek wynikający ze sposobu, w jaki plik powstał.
Krok po kroku
- 1
Test na dwie sekundy: spróbuj zaznaczyć tekst
Otwórz PDF, kliknij i przeciągnij przez fragment tekstu. Jeśli tekst się zaznacza (podświetla, da się skopiować), to PDF edytowalny. Jeśli kursor rysuje ramkę zaznaczenia, ale żaden tekst się nie podświetla, to PDF-obraz – „tekst” jest tam danymi obrazu.
- 2
PDF edytowalny: tekst jest zaznaczalny, przeszukiwalny, kopiowalny
Bezpośrednie eksporty z Worda, Pages, Docs albo narzędzi projektowych tworzą PDF-y edytowalne. Tekst jest ustrukturyzowanymi danymi wewnątrz pliku; wyszukiwanie i kopiuj-wklej działają; edytory PDF mogą go zmieniać.
- 3
PDF-obraz: obraz strony bez tekstu pod spodem
Zeskanowane dokumenty to najczęstsza postać PDF-obrazu. Tekst istnieje tam wyłącznie jako piksele; nie ma pod spodem żadnych danych znakowych. Wyszukiwanie nic nie znajduje; kopiuj-wklej nic nie daje.
- 4
OCR zamienia PDF-obraz w przeszukiwalny (ale nie w pełni edytowalny)
OCR analizuje obraz strony i dodaje warstwę tekstową pod pikselami. Wyszukiwanie zaczyna działać; kopiuj-wklej daje przybliżony tekst. Edycja nadal wymaga ręcznej podmiany elementów obrazu.
- 5
Kiedy PDF-obraz jest celowy: blokada, wierność obrazu
Niektóre sposoby pracy celowo spłaszczają PDF do obrazu – pliku nie da się łatwo edytować, a podpisy i pieczątki nie naruszają tekstu pod spodem, bo go tam już nie ma. PDF do obrazów, a potem Obraz do PDF, tworzy taką spłaszczoną kopię w obie strony.
- 6
Kiedy edytowalny jest celowy: każdy inny sposób pracy
Do udostępniania, podpisywania, edycji, archiwizacji, ponownego wykorzystania – PDF edytowalny jest właściwym wyborem. Nie spłaszczaj do obrazu, jeśli nie masz do tego konkretnego powodu.
Wskazówki
- Jeśli nie możesz zaznaczyć tekstu w PDF-ie, który sam stworzyłeś, ustawienia eksportu pominęły warstwę tekstową. Wyeksportuj ponownie z włączoną opcją „zachowaj tekst”.
- Zeskanowane PDF-y ze starszych skanerów zwykle są PDF-ami-obrazami. Zastosuj OCR w trakcie skanowania albo później narzędziem, żeby były użyteczne na dłuższą metę.
- PDF-obraz jest większy niż odpowiadający mu PDF edytowalny – dane obrazu zajmują więcej miejsca niż dane znakowe.
- Nie spłaszczaj PDF-a do obrazu, żeby go „zablokować” – właściwe ograniczenia edycji działają lepiej i zachowują przeszukiwalność.
- Niektóre „edytowalne” PDF-y eksportują każdy znak jako mały kształt zamiast tekstu. Zaznaczanie wygląda poprawnie, ale kopiuj-wklej daje bezsensowny wynik. To najgorszy przypadek pod kątem edycji.