PDF 涂黑
把姓名、数字乃至整块区域涂黑,让它们从文件里消失,而不是被盖住。
PDF 涂黑的全部处理都在你的设备上完成。正在涂黑的文档本就承受不起外送的风险,因此这里不会上传任何东西。
看看这份文件还泄露了什么
关于 PDF 涂黑
涂黑最经典的失败,是在文字上画一个黑色矩形,而文字仍原封不动地留在下面,谁选中页面都能复制出来。法院、编辑部和政府部门都这样发布过文件。这个工具从做法上避开了这个陷阱:你标出的区域会被烧进每一页的重新渲染里,于是它们背后的词在导出的文件中根本不存在,而不只是被遮住。你可以在页面上拖选,也可以输入一个姓名或号码,让全文中的每一处一次标齐,然后逐页复核。
功能特性
- 在页面任意区域拖选,标记为需要移除
- 搜索某个词或数字,标出全文中的每一处
- 标记区域被烧进重新渲染的页面——下面的文字随之消失
- 逐页复核,导出前任何一个框都能撤掉
- 一次清空某一页上的全部标记
- 对扫描件和文字型 PDF 一视同仁,因为它作用于渲染结果
- 统计标记区域的数量与所涉页数
如何使用 PDF 涂黑
- 把 PDF 拖到页面上
- 拖选一切必须去掉的内容,或搜索某个词并全部标记
- 逐页翻过文档,核对每一个标记
- 导出涂黑后的 PDF,并试着选中被移除的文字来验证
示例
输入
witness-statement.pdf — search for the surname "Okonkwo"
输出
Every occurrence marked across 6 pages, exported with the name absent from the text layer.
搜索只标记命中的那一段,周围的词仍然可读。
常见错误与故障排除
- 导出的文字不能再选中了。 — 这是这里真正涂黑的代价:页面被重新渲染,于是整页变成一张图。若还需要可检索,请对结果做文字识别。
- 词明明看得见,搜索却什么也没找到。 — 这份 PDF 是扫描件,根本没有可搜的文字。请用拖选来标记,任何页面都适用。
- 标出的框盖住的比预期多。 — 来自搜索的框会取命中片段的宽度和行高。可以撤掉它,再拖一个更贴的框。
- 涂黑之后文件变大了。 — 重新渲染的页面是图片,通常比矢量原件大。若在意体积,请把结果压缩一下。
常见问题
- 被移除的文字还能从导出的文件里找回来吗?
- 不能。页面是在框已经涂好的状态下从像素重画的,下面的字符从来没有写进新文档。
- 为什么在文字上画个黑矩形还不够?
- 因为矩形只是页面上的又一个对象。文字仍留在它下面的内容流里,一复制粘贴或一做文本提取就会原样出来。
- 涂黑过程中我的文档会被上传吗?
- 不会,而这正是关键——你在涂黑的文档,按定义就是哪儿都不能送的文档。全部处理都在这个标签页里完成。
- 涂黑会连文档元数据一起清掉吗?
- 不会。元数据与页面内容是两回事——请扫描文档,并把清理元数据作为第二步。
- 一次能涂黑多少页?
- 最多载入 40 页供标记,好让预览保持顺畅。更长的文档请拆开分批处理。
相关工具
全部 ArrayKit 工具