PDF墨消し
本当の黒塗り — テキストを削除して検証。
ファイルをお持ちでないですか?
マークしたページは平坦化画像として再構築され — 下のテキストは隠すのではなくファイルから削除されます。ダウンロードを表示する前に、ツールが出力を再度開き、各墨消しページに残るテキストがゼロであることを証明します。文書メタデータ(タイトル、作成者…)も消去されます。
ページ上をドラッグして機密部分にボックスを描きます。ボックスはこのページだけに固定されます。
テキストを本当に削除する墨消し
通常のPDFエディターでテキスト上に黒い四角を描いても何も隠せません。文字はファイルに残り、コピー&ペーストや検索インデックスですぐ取り出せます。このツールはマークした各ページを平坦化画像として再構築し、下のテキストオブジェクトを完全に削除します — その後、結果を再度開いて各墨消しページからテキストを抽出し、文字数がゼロだと証明してからダウンロードを提供します。
マークしていないページは変更せずそのままコピーされ、処理全体がブラウザ内で動作します。墨消しする文書こそ、どこにもアップロードすべきでないファイルです。
多くの「墨消し」は偽物です。テキスト上の黒い四角はピクセルを隠すだけで、データは隠しません。覆われた部分を選択してコピー、貼り付ければ — 秘密が戻ります。裁判資料や政府公開文書でもこの方法で漏えいしてきました。本当の墨消しはファイル自体からテキストを削除する必要があります。このツールはマークした各ページを平坦化画像として再レンダリングし、下の文字を出力から完全に消します。
ツールはその結果を実証します。墨消しPDFを構築した後に自らの出力を再度開き、すべての墨消しページでテキスト抽出を実行します — 文字数が正確にゼロになった場合だけダウンロードボタンが表示されます。ファイルプロパティから氏名や組織も漏れるため、文書メタデータ(タイトル、作成者、件名、キーワード、作成ソフト)も同時に消去します。
墨消しが必要な文書は、そもそも無関係なWebサイトへアップロードすべきではない文書です。ここでの処理 — レンダリング、墨消し、再構築、自己チェック — はすべてブラウザ内でローカルに実行されます。マークしていないページは変更せずコピーされ、テキストも選択可能なままです。
よくある質問
黒いボックスを描くだけでなく、ページをラスタライズするのはなぜですか?
テキストの上に黒いボックスを置くだけでは見た目しか隠せません。テキストオブジェクトはファイル内に残り、コピー&ペースト、テキスト抽出、検索インデックスで復元できます。マークしたページを平坦化画像として再構築すれば、テキストレイヤーが完全に削除され — 抽出できるものは残りません。そのため墨消ししたページのテキストは選択できなくなります。
自己チェックでは具体的に何を検証しますか?
出力を生成した後、ツールはそのファイルを再度開き、墨消しした全ページからテキストを抽出します。戻るテキスト文字数がゼロ — かつページ数が元と一致 — した場合にのみダウンロードボタンが表示されます。何か一文字でも抽出できる場合、ファイルは提供されません。
マークしていないページは変わりますか?
いいえ。ボックスのないページは元の内容のままコピーされ、テキストは選択可能でリンクも機能します。画像として再構築されるのはマークしたページだけです。
PDFメタデータはどうなりますか?
出力ではタイトル、作成者、件名、キーワード、作成者、生成ソフトが消去されます — 文書プロパティから氏名、雇用主、ソフトウェアバージョンが漏れることがあります。ファイル名は自分で選ぶ点に注意してください。
文書はアップロードされますか?
いいえ。レンダリング、墨消し、再構築、自己チェックはすべてブラウザ内で動作します。墨消しが必要な文書こそ、第三者サーバーへ送るべきではありません。
スキャンしたPDFでも使えますか?
はい — スキャンページはすでに画像なので、機密部分にボックスを描いて再構築すれば同じように機能します。このツールは見えている部分を墨消しし、OCRは実行しません。
ファイルが大きく、または小さくなったのはなぜですか?
墨消ししたページは選択した解像度(96/144/216 dpi)のJPEG画像として再エンコードされます。テキスト中心のページは通常少し大きくなり、画像中心のページは小さくなることが多いです。未マークのページには影響しません。