hddn Ukryj to, co wrażliwe.

Poradniki07 z 07

Jak zaczernić dane w zeskanowanym PDF-ie

W skanie nie ma tekstu do zaznaczenia, więc zwykłe porady zawodzą. Co działa na stronie z pikseli, po co spłaszczanie i która ukryta warstwa psuje całą pracę.

Ostatnia aktualizacja: 18 września 2026

07

Masz sfotografowaną umowę, skan dowodu albo pasek wynagrodzenia zeskanowany w biurze. Jedno nazwisko ma zniknąć. Każdy poradnik mówi to samo: zaznacz tekst, zastosuj usuwanie danych. Przeciągasz kursorem po nazwisku, ale nic się nie podświetla. Kursor nawet nie zmienia kształtu.

Nic się nie zepsuło. Na stronie nie ma tekstu do zaznaczenia.

01

Strona jest zdjęciem

Natywny PDF zapisuje tekst jako instrukcje — po jednej dla każdego znaku — wraz ze współrzędnymi i krojem pisma. Skan zawiera zwykle jeden obraz na stronę, bez niczego więcej. Nazwisko, na które patrzysz, jest skupiskiem ciemnych pikseli w pliku JPEG. Dla PDF-a to ten sam rodzaj obiektu co cień pokrywy skanera.

Zaznaczanie nie ma więc czego chwycić. Narzędzia zaznaczania odczytują strumień treści, a na zeskanowanej stronie mówi on mniej więcej tyle: narysuj ten obraz na całą szerokość i wysokość. To cała strona. Wyszukiwanie nic nie znajduje, a ekstrakcja nie zwraca tekstu.

02

Tutaj czarne pole faktycznie działa

To jedyny przypadek, w którym pozornie oczywiste podejście może zadziałać. Po setkach ostrzeżeń, że prostokąty nie usuwają danych, trudno się tego spodziewać.

W prawdziwym skanie pod spodem nie ma tekstu, bo nie ma go tam w ogóle. Gdy zamalujesz piksele wypełnionym prostokątem, a potem spłaszczysz stronę, piksele pod polem zostaną nadpisane. Nie są zakryte. Przestają istnieć.

Warunkiem jest spłaszczenie; nie można go pominąć. Eksport musi wyrenderować każdą stronę do nowej bitmapy z wypalonym prostokątem, a potem złożyć PDF z tych obrazów. Jeśli narzędzie zachowa oryginalny skan i umieści kształt nad nim, czarny prostokąt będzie leżał na nienaruszonym obrazie nazwiska. Wyciągnięcie osadzonych obrazów z PDF-a wymaga wtedy jednego polecenia.

03

Sprawdź, czy twój skan jest naprawdę skanem

Wiele dokumentów wyglądających jak skany nie jest już czystymi skanami. Oprogramowanie skanerów, systemy obiegu dokumentów i wszystkie narzędzia z opcją „PDF z możliwością wyszukiwania” uruchamiają OCR, a rozpoznane słowa zapisują w pliku jako niewidoczną warstwę tekstową dokładnie na obrazie. Strona wygląda identycznie. Plik zawiera wtedy zarówno obraz nazwiska, jak i prawdziwy ciąg znaków, który da się wyodrębnić.

Gdy narysujesz pole na obrazie, zakryjesz piksele tylko dla oka. Warstwa tekstowa zostanie nietknięta i da się ją skopiować z pliku. To problem czarnego prostokąta z obrazem położonym na wierzchu.

Sprawdź to, zanim zrobisz cokolwiek innego. Otwórz plik i przeciągnij kursorem po wierszu tekstu. Jeśli pojawi się podświetlenie albo Ctrl+F znajdzie słowo widoczne na stronie, warstwa tekstowa istnieje i trzeba usunąć tę treść razem z pikselami. Sprawdzaj każdą stronę, bo dokumenty mieszane są częste: pismo przewodnie napisane na komputerze, potem dwanaście stron skanu, na końcu podpisany załącznik.

Potem powtórz to samo sprawdzenie na wyeksportowanym pliku, nie na tym, który edytowałeś.

04

Adnotacja to nie spłaszczone pole

Prostokąt zapisany jako adnotacja PDF jest osobnym obiektem w pliku. Ma własne współrzędne, kolor i wpis na liście adnotacji strony. Czytniki pozwalają go kliknąć, przesunąć i usunąć. Nawet gdy interfejs tego nie umożliwia, obiekt pozostaje w strukturze pliku, a usunięcie adnotacji jest proste.

Po spłaszczeniu kształt przestaje być obiektem i staje się ciemnymi pikselami w obrazie strony. Nie zostaje nic, co można zaznaczyć i usunąć.

Wiele osób myli tu jedno: drukowanie do PDF-a nie jest spłaszczeniem. W większości systemów ścieżka wydruku zapisuje tekst ponownie jako tekst, a adnotacje pozostawia adnotacjami. Szukaj opcji rasteryzacji, spłaszczania lub eksportu do obrazu, a potem sprawdź wynik zamiast ufać etykiecie.

05

Rozdzielczość i kopia, o której zapomniałeś

Niektóre sposoby eksportu zmniejszają rozdzielczość. Dla prywatności nie ma to znaczenia, ale skan po usunięciu danych zapisany z niskim DPI może być dla odbiorcy nieczytelny. Obejrzyj wynik przed wysłaniem, nie dopiero po jego pytaniach.

Inny problem z prywatnością kryje się w strukturze pliku. Oprogramowanie skanerów i pakiety biurowe czasem osadzają miniaturę lub podgląd każdej strony, a plik zapisany przyrostowo może zachować wcześniejsze wersje. Jeśli taki podgląd powstał przed narysowaniem pola, dokument nadal zawiera małą kopię strony sprzed usunięcia danych. Eksportuj do nowego pliku, zamiast nadpisywać oryginał, i raz sprawdź właściwości dokumentu, zanim plik opuści komputer.

06

OCR użyty świadomie

Świadomie użyte OCR pozwala przejść przez ten proces. Najpierw rozpoznaj tekst, a narzędzie odczyta stronę na tyle dobrze, by wskazać kandydatów: nazwiska, numery identyfikacyjne, daty urodzenia i numery rachunków. Pola trafiają na właściwe współrzędne, ponieważ rozpoznawanie zwraca pozycję każdego słowa, nie tylko jego zapis.

OCR się myli. Blade kopie z faksu, przekrzywione strony, pismo odręczne na marginesie, piątka odczytana jako S. Traktuj kandydatów jako punkt wyjścia i przeczytaj stronę sam. Tego, co przeoczył program rozpoznający, nic później nie wychwyci. Eksport i tak musi spłaszczyć stronę. Trafne znalezienie nazwiska nic nie daje, jeśli pole tylko leży na nim z wierzchu.

hddn działa tak na stronach skanowanych: OCR uruchamia się w przeglądarce, wykryte miejsca są propozycjami do zatwierdzenia lub odrzucenia, a spłaszczona ścieżka eksportu renderuje każdą stronę do bitmapy z wypalonymi zatwierdzonymi polami. Edycja tekstu na stronach z OCR jest niedostępna, zamiast udawać, że działa.

Skan może wydawać się bezpieczniejszy niż PDF z tekstem, bo niczego nie da się zaznaczyć ani wyszukać. To właśnie tworzy ryzyko. Zanim narysujesz pierwsze pole, przeciągnij kursorem po jednym wierszu i sprawdź, czy plik nie zawiera niewidocznej warstwy tekstowej.

Jak to działa

Cztery kroki. W każdym to ty decydujesz.

  1. 01

    Otwórz PDF

    Przeciągnij plik na stronę. Przeglądarka otworzy go bezpośrednio na twoim urządzeniu.

  2. 02

    Sprawdź znalezione dane

    Narzędzie zaznaczy imiona i nazwiska, adresy e-mail, numery identyfikacyjne, numery kont i daty, które mogą wymagać ukrycia.

  3. 03

    Wybierz, co usunąć

    Potwierdź trafne znaleziska, odrzuć pozostałe albo samodzielnie zaczernij dowolny tekst lub obszar. W cyfrowym PDF możesz też zmienić treść. Nic nie zostanie ukryte bez twojej zgody.

  4. 04

    Zapisz oczyszczony PDF

    Potwierdzone dane zostaną trwale usunięte, a gotowy plik zapiszesz z powrotem na swoim urządzeniu.