PDF 摘要
逐节为长 PDF 生成摘要,模型就跑在你的浏览器里。
PDF 摘要的模型跑在你的设备上。文档在本地读取,任何一部分都不会为了摘要而被送出去。
改为概括纯文本
关于 PDF 摘要
一口气概括一份长文档是行不通的:语言模型只读固定长度的一段,把四十页的报告丢进去,等于概括了前两页却当成了全篇。这个工具改成切分文档。段落被合并成几百词一节,从不把一个段落拦腰截断,每一节各自概括。回来的是一份编号纲要,它跟随的是文档的形状,而不是它的第一页。模型只下载一次,之后就跑在你的浏览器里。
功能特性
- 文档按词数切节,并尊重段落边界
- 逐节单独概括,因此整份文档都被覆盖
- 短、中、长三档,决定回来多少细节
- 工作过程中逐节显示进度
- 模型跑在你的设备上,首次下载后即被缓存
- 标题、列表与表格都会并入模型读取的正文
- 编号结果可复制,也可下载为文本文件
如何使用 PDF 摘要
- 把 PDF 拖到页面上
- 查看词数以及被切成了多少节
- 选一个摘要长度并开始
- 阅读编号纲要,然后复制或下载
示例
输入
annual-report.pdf — 18,400 words
输出
12 numbered summaries, one per section, covering roughly the first 7,000 words.
节的边界跟随段落,因此没有哪段摘要是从句子中间开始的。
常见错误与故障排除
- 第一次运行时很久都没有动静。 — 模型只下载一次,网速慢时会花些时间。之后它被缓存下来,再次运行立刻开始。
- 摘要在文档中途就停了。 — 一共概括十二节,大致覆盖七千词。更长的文档请拆开,分别概括。
- 某一节的摘要把开头那句重复了一遍。 — 小型摘要模型偏向依赖输入的开头。试试“长”这一档,它会把该节更多内容压进输出。
- 浏览器内存不够了。 — 关掉别的标签页再试——模型需要几百兆内存。换一份更短的文档也有帮助。
常见问题
- 摘要实际上是在哪里生成的?
- 在你的浏览器里。模型下载一次之后就跑在你的设备上,董事会材料与机密报告不会为了摘要而被传出去。
- 本机摘要有多可靠?
- 这是个小模型,请把结果当索引,而不是替代阅读。它能可靠地告诉你某一节讲的是什么,细微处则差些。
- 为什么逐节概括,而不是整份文件一起?
- 因为模型只读固定量的文字。对着一份长报告跑一遍,只会概括开头几页而忽略其余。
- 它能概括扫描件吗?
- 不能直接概括——扫描件里没有文字。先做文字识别,识别后的版本就能正常概括。
- 模型每次都要重新下载吗?
- 不用。首次运行后浏览器会缓存它,之后的会话立刻开始,离线也能用。
相关工具
- AI 文本摘要工具 — 在浏览器中用 AI 模型将长文章、邮件或报告归纳为简短摘要。
- 朗读 PDF — 一段一段地收听 PDF 的朗读。
- PDF 转文本 — 将 PDF 中可选取的文本提取为纯文本或 Markdown。
- 可读性评分检测器 — Flesch、Gunning Fog、SMOG 等六种公式为文本评分。
- 字数统计 — 实时统计字符、单词、句子、字节和大致的 token 数。
- AI 实体提取工具 — 在浏览器中用 AI 模型从文本中提取人名、组织、地点、邮箱与电话号码。
- PDF 转 Word — 把 PDF 重建为可编辑的 .docx 文档。
全部 ArrayKit 工具