Trwałe zaczernianie PDF
Prawdziwe zaczernianie — tekst usunięty i sprawdzony.
Nie masz pod ręką pliku?
Oznaczone strony są ponownie tworzone jako płaskie obrazy — tekst pod spodem jest usuwany z pliku, a nie tylko ukrywany. Zanim pojawi się pobieranie, narzędzie ponownie otwiera własny plik wynikowy i potwierdza, że na każdej zredagowanej stronie pozostało zero tekstu. Metadane dokumentu (tytuł, autor…) również są czyszczone.
Przeciągnij po stronie, aby narysować pole na poufnej treści. Pola są przypisane wyłącznie do tej strony.
Redakcja, która naprawdę usuwa tekst
Narysowanie czarnego prostokąta na tekście w zwykłym edytorze PDF niczego nie ukrywa: słowa nadal są w pliku i można je odzyskać przez kopiowanie i wklejanie lub indeks wyszukiwania. To narzędzie ponownie tworzy każdą oznaczoną stronę jako płaski obraz, więc obiekty tekstowe pod spodem przestają istnieć — następnie ponownie otwiera wynik i wyodrębnia tekst z każdej zredagowanej strony, aby przed udostępnieniem pliku dowieść, że liczba znaków wynosi zero.
Nieoznaczone strony są kopiowane bez zmian, a cały proces działa w przeglądarce: dokument poddawany redakcji jest właśnie takim plikiem, którego nie należy nigdzie przesyłać.
Większość „redakcji” jest pozorna: czarny prostokąt narysowany na tekście ukrywa piksele, nie dane. Zaznacz zakryty obszar, skopiuj i wklej — a sekret wraca. Właśnie w ten sposób wyciekały akta sądowe i publikacje rządowe. Prawdziwa redakcja musi usunąć tekst z samego pliku, co robi to narzędzie: każda oznaczona strona jest ponownie renderowana jako płaski obraz, więc słowa pod spodem po prostu nie istnieją już w pliku wynikowym.
Narzędzie następnie tego dowodzi. Po utworzeniu zredagowanego PDF ponownie otwiera własny plik wynikowy i wykonuje ekstrakcję tekstu na każdej zredagowanej stronie — przycisk pobierania pojawia się tylko wtedy, gdy liczba wynosi dokładnie zero znaków. Metadane dokumentu (tytuł, autor, temat, słowa kluczowe, twórca) są czyszczone w tym samym przebiegu, ponieważ właściwości pliku również ujawniają nazwy osób i organizacji.
Dokument wymagający redakcji to niemal z definicji dokument, którego nie należy przesyłać do przypadkowej witryny. Wszystko tutaj — renderowanie, zamazywanie, ponowne tworzenie i samokontrola — działa lokalnie w przeglądarce. Nieoznaczone strony są kopiowane bez zmian, a ich tekst nadal można zaznaczać.
FAQ
Dlaczego strony są rasteryzowane zamiast nakładania czarnych pól?
Ponieważ czarny prostokąt nałożony na tekst jest tylko zabiegiem kosmetycznym: obiekty tekstowe nadal znajdują się w pliku i można je odzyskać przez kopiowanie i wklejanie, ekstrakcję tekstu lub indeks wyszukiwania. Ponowne utworzenie oznaczonej strony jako płaskiego obrazu całkowicie usuwa warstwę tekstową — nie pozostaje nic do wyodrębnienia. Dlatego tekstu na zredagowanych stronach nie można już zaznaczać.
Co dokładnie sprawdza samokontrola?
Po wygenerowaniu pliku wynikowego narzędzie otwiera go ponownie i wykonuje ekstrakcję tekstu na każdej zredagowanej stronie. Przycisk pobierania pojawia się tylko wtedy — gdy nie zostanie zwrócony żaden znak tekstowy i liczba stron zgadza się z oryginałem — w przeciwnym razie plik nie jest udostępniany.
Czy nieoznaczone strony się zmieniają?
Nie. Strony bez pól są kopiowane z oryginalną zawartością: tekst nadal można zaznaczać, a linki działają. Tylko oznaczone strony są ponownie tworzone jako obrazy.
Co dzieje się z metadanymi PDF?
Tytuł, autor, temat, słowa kluczowe, twórca i producent są czyszczeni w pliku wynikowym — właściwości dokumentu często ujawniają nazwiska, pracodawców i wersje oprogramowania. Pamiętaj, że nazwę pliku nadal wybierasz samodzielnie.
Czy mój dokument jest przesyłany?
Nie. Renderowanie, redakcja, ponowne tworzenie i samokontrola działają w przeglądarce. Dokument wymagający redakcji to dokładnie taki plik, który nigdy nie powinien trafić na serwer strony trzeciej.
Czy działa ze skanowanymi plikami PDF?
Tak — zeskanowane strony są już obrazami, więc narysowanie pola na poufnym obszarze i ponowne utworzenie działa tak samo. Uwaga: narzędzie redaguje to, co jest widoczne; nie wykonuje OCR.
Dlaczego mój plik stał się większy lub mniejszy?
Zredagowane strony są ponownie kodowane jako obrazy JPEG w wybranej rozdzielczości (96/144/216 dpi). Strony z dużą ilością tekstu zwykle nieco rosną; strony bogate w obrazy często maleją. Nieoznaczone strony pozostają bez zmian.