PDF

Trwałe zaczernianie PDF

Prawdziwe zaczernianie — tekst usunięty i sprawdzony.

Nie masz pod ręką pliku?

Oznaczone strony są ponownie tworzone jako płaskie obrazy — tekst pod spodem jest usuwany z pliku, a nie tylko ukrywany. Zanim pojawi się pobieranie, narzędzie ponownie otwiera własny plik wynikowy i potwierdza, że na każdej zredagowanej stronie pozostało zero tekstu. Metadane dokumentu (tytuł, autor…) również są czyszczone.

Redakcja, która naprawdę usuwa tekst

Narysowanie czarnego prostokąta na tekście w zwykłym edytorze PDF niczego nie ukrywa: słowa nadal są w pliku i można je odzyskać przez kopiowanie i wklejanie lub indeks wyszukiwania. To narzędzie ponownie tworzy każdą oznaczoną stronę jako płaski obraz, więc obiekty tekstowe pod spodem przestają istnieć — następnie ponownie otwiera wynik i wyodrębnia tekst z każdej zredagowanej strony, aby przed udostępnieniem pliku dowieść, że liczba znaków wynosi zero.

Nieoznaczone strony są kopiowane bez zmian, a cały proces działa w przeglądarce: dokument poddawany redakcji jest właśnie takim plikiem, którego nie należy nigdzie przesyłać.

Większość „redakcji” jest pozorna: czarny prostokąt narysowany na tekście ukrywa piksele, nie dane. Zaznacz zakryty obszar, skopiuj i wklej — a sekret wraca. Właśnie w ten sposób wyciekały akta sądowe i publikacje rządowe. Prawdziwa redakcja musi usunąć tekst z samego pliku, co robi to narzędzie: każda oznaczona strona jest ponownie renderowana jako płaski obraz, więc słowa pod spodem po prostu nie istnieją już w pliku wynikowym.

Narzędzie następnie tego dowodzi. Po utworzeniu zredagowanego PDF ponownie otwiera własny plik wynikowy i wykonuje ekstrakcję tekstu na każdej zredagowanej stronie — przycisk pobierania pojawia się tylko wtedy, gdy liczba wynosi dokładnie zero znaków. Metadane dokumentu (tytuł, autor, temat, słowa kluczowe, twórca) są czyszczone w tym samym przebiegu, ponieważ właściwości pliku również ujawniają nazwy osób i organizacji.

Dokument wymagający redakcji to niemal z definicji dokument, którego nie należy przesyłać do przypadkowej witryny. Wszystko tutaj — renderowanie, zamazywanie, ponowne tworzenie i samokontrola — działa lokalnie w przeglądarce. Nieoznaczone strony są kopiowane bez zmian, a ich tekst nadal można zaznaczać.

FAQ

Dlaczego strony są rasteryzowane zamiast nakładania czarnych pól?

Ponieważ czarny prostokąt nałożony na tekst jest tylko zabiegiem kosmetycznym: obiekty tekstowe nadal znajdują się w pliku i można je odzyskać przez kopiowanie i wklejanie, ekstrakcję tekstu lub indeks wyszukiwania. Ponowne utworzenie oznaczonej strony jako płaskiego obrazu całkowicie usuwa warstwę tekstową — nie pozostaje nic do wyodrębnienia. Dlatego tekstu na zredagowanych stronach nie można już zaznaczać.

Co dokładnie sprawdza samokontrola?

Po wygenerowaniu pliku wynikowego narzędzie otwiera go ponownie i wykonuje ekstrakcję tekstu na każdej zredagowanej stronie. Przycisk pobierania pojawia się tylko wtedy — gdy nie zostanie zwrócony żaden znak tekstowy i liczba stron zgadza się z oryginałem — w przeciwnym razie plik nie jest udostępniany.

Czy nieoznaczone strony się zmieniają?

Nie. Strony bez pól są kopiowane z oryginalną zawartością: tekst nadal można zaznaczać, a linki działają. Tylko oznaczone strony są ponownie tworzone jako obrazy.

Co dzieje się z metadanymi PDF?

Tytuł, autor, temat, słowa kluczowe, twórca i producent są czyszczeni w pliku wynikowym — właściwości dokumentu często ujawniają nazwiska, pracodawców i wersje oprogramowania. Pamiętaj, że nazwę pliku nadal wybierasz samodzielnie.

Czy mój dokument jest przesyłany?

Nie. Renderowanie, redakcja, ponowne tworzenie i samokontrola działają w przeglądarce. Dokument wymagający redakcji to dokładnie taki plik, który nigdy nie powinien trafić na serwer strony trzeciej.

Czy działa ze skanowanymi plikami PDF?

Tak — zeskanowane strony są już obrazami, więc narysowanie pola na poufnym obszarze i ponowne utworzenie działa tak samo. Uwaga: narzędzie redaguje to, co jest widoczne; nie wykonuje OCR.

Dlaczego mój plik stał się większy lub mniejszy?

Zredagowane strony są ponownie kodowane jako obrazy JPEG w wybranej rozdzielczości (96/144/216 dpi). Strony z dużą ilością tekstu zwykle nieco rosną; strony bogate w obrazy często maleją. Nieoznaczone strony pozostają bez zmian.