PDF

PDF永久涂黑

真正涂黑——移除文本后再验证。

手头没有文件?

标记页面会重建为扁平图像——下方文本会从文件中移除,而不是仅仅隐藏。下载按钮出现前,工具会重新打开自己的输出文件,证明每个已涂黑页面上的文本残留均为零。文档元数据(标题、作者……)也会一并清除。

真正移除文本的涂黑

在普通 PDF 编辑器中用黑色矩形盖住文字,什么也没有删除:文字仍在文件中,通过复制粘贴或搜索索引就能重新提取出来。本工具会将每个已标记页面重建为扁平图像,使下方的文本对象不复存在;随后重新打开结果,并从每个已涂黑页面提取文本,确认数量为零后才提供下载。

未标记的页面会原样复制,整个过程都在浏览器中运行:您要涂黑的文档,恰恰就是不应上传到任何地方的那类文件。

大多数“涂黑”都是假的:在文本上画一个黑色矩形,只能遮住像素,无法删除数据。选中被遮区域,复制、粘贴——秘密就会重新出现。法院文件和政府公报曾经正是以这种方式泄密。真正的涂黑必须从文件本身移除文本;本工具所做的正是如此:每个标记页面都会重新渲染为扁平图像,因此下方文字在输出文件中彻底不复存在。

随后,工具会自行证明结果。生成已涂黑 PDF 后,它会重新打开输出文件,并对每个已涂黑页面运行文本提取——只有字符数恰好为零时,下载按钮才会出现。文档元数据(标题、作者、主题、关键词、创建者)也会在同一过程中清除,因为文件属性同样可能泄露姓名和组织信息。

需要涂黑的文档,几乎必然不该上传到来路不明的网站。这里的所有操作——渲染、涂黑、重建和自检——都在浏览器本地运行。未标记的页面会原样复制,其中的文本仍可选择。

常见问题

为什么要将页面栅格化,而不只是绘制黑框?

因为在文本上盖一个黑框只是表面处理:文本对象仍留在文件中,可通过复制粘贴、文本提取或搜索索引恢复。将标记页面重建为扁平图像会彻底移除文本层——不再有任何内容可供提取。这也正是已涂黑页面上的文本无法再被选择的原因。

自检具体会验证什么?

生成输出文件后,工具会重新打开文件,并对每个已涂黑页面运行文本提取。只有在未提取出任何文本字符——且页数与原文件一致——时,下载按钮才会出现。只要还能提取出任何内容,就不会提供文件。

未标记的页面会改变吗?

不会。没有遮盖框的页面会保留原始内容并直接复制:文本仍可选择,链接仍然有效。只有标记页面会重建为图像。

PDF 元数据会如何处理?

输出文件会清除标题、作者、主题、关键词、创建者和生成程序——文档属性经常会泄露姓名、雇主和软件版本。请注意,文件名仍由您自行选择。

我的文档会被上传吗?

不会。渲染、涂黑、重建和自检都在浏览器中运行。需要涂黑的文档,恰恰最不应该接触第三方服务器。

它适用于扫描版 PDF 吗?

可以——扫描页面本来就是图像,因此在敏感区域上绘制遮盖框并重建页面的方式同样有效。请注意,本工具只涂除可见内容,不会运行 OCR。

为什么文件变大或变小了?

已涂黑页面会按所选分辨率重新编码为 JPEG 图像(96/144/216 dpi)。文本较多的页面通常会稍微变大;图像较多的页面往往会变小。未标记页面不受影响。