修复 PDF
查清 PDF 为什么打不开,再把还能救回来的部分重建出来。
修复会在你的设备上读取并重写文件。损坏的文档往往是你手上唯一的一份,其中的任何内容都不会被上传。
先移除密码
关于 修复 PDF
“文件已损坏且无法修复”这句话,对到底出了什么事只字未提。实际上,打不开的 PDF 通常是少了少数几个标记之一:阅读器最先检查的 %PDF 文件头、结尾的 %%EOF、指明对象表位置的 startxref,或者指出文档根的 trailer。这个工具会逐项报告,说明解析器是否还能搭出页面树,然后依次尝试两种修复:把对象图复制进一份新文档;若不成,就把渲染器还能画出来的每一页重画一遍。
功能特性
- 检查文件头、trailer、交叉引用指针与文件结尾标记
- 报告指向被截断文件末尾之外的 startxref
- 识别加密,重写对象之前必须先解除
- 切掉邮件网关在前后加上的杂物
- 优先从对象图重建,保住文字、字体与矢量图形
- 对象图无法复制时,退回到逐页重画
- 明确告诉你用了哪一种修复,以及付出了什么代价
如何使用 修复 PDF
- 把打不开的 PDF 拖进来
- 阅读结构检查,看少了哪个标记
- 点击修复,先让它尝试从对象重建
- 下载修复后的文件并打开确认
示例
输入
invoice-scan.pdf — downloaded over a dropped connection
输出
End-of-file marker missing; startxref points to byte 481,209 in a 402,880-byte file. Rebuilt: 6 pages recovered.
交叉引用偏移量指到文件末尾之外,正是下载被截断的特征。
常见错误与故障排除
- 修复后的文档页数比预想的少。 — 只有对象还在的页面才救得回来。被截断的文件丢掉了截点之后的一切,也就没有可重建的材料。
- 修复提示文件已加密。 — 读不到的对象无法重写。请先移除密码,再修复。
- 修复后的文件失去了可选中的文字。 — 这说明从对象重建失败,页面是被重画出来的。事后做一次文字识别,就能重新变得可检索。
- 什么也没能救回来。 — 如果连一页都渲染不出来,损坏已经波及内容本身。请重新下载原件或从备份还原。
常见问题
- PDF 通常是怎么坏的?
- 中断的下载或复制会把文件截断,还有在前后追加文字的邮件网关。两者都会在结构检查里显示为缺标记或偏移量不对。
- 修复时我损坏的文件会被上传吗?
- 不会。字节在这个标签页里检查,重建也在这里进行,含敏感内容的损坏文件仍然留在你手里。
- 报告里的“快速 Web 查看”是什么意思?
- 说明这个文件被排布成浏览器可以先显示第一页再下载其余部分。重建会失去这种排布,影响的只是加载速度。
- 修复后的文件会和原件一模一样吗?
- 页面会一样。对象的排布被重写,因此字节大小和线性化会变——这正是修复的含义。
- 它能找回我删掉的 PDF 吗?
- 不能。它处理的是你手上还有的文件;找回删除的文件是磁盘恢复软件的活儿。
相关工具
全部 ArrayKit 工具