PDF 摘要

逐节为长 PDF 生成摘要,模型就跑在你的浏览器里。

PDF 摘要的模型跑在你的设备上。文档在本地读取,任何一部分都不会为了摘要而被送出去。

改为概括纯文本

关于 PDF 摘要

一口气概括一份长文档是行不通的:语言模型只读固定长度的一段,把四十页的报告丢进去,等于概括了前两页却当成了全篇。这个工具改成切分文档。段落被合并成几百词一节,从不把一个段落拦腰截断,每一节各自概括。回来的是一份编号纲要,它跟随的是文档的形状,而不是它的第一页。模型只下载一次,之后就跑在你的浏览器里。

功能特性

如何使用 PDF 摘要

  1. 把 PDF 拖到页面上
  2. 查看词数以及被切成了多少节
  3. 选一个摘要长度并开始
  4. 阅读编号纲要,然后复制或下载

示例

输入

annual-report.pdf — 18,400 words

输出

12 numbered summaries, one per section, covering roughly the first 7,000 words.

节的边界跟随段落,因此没有哪段摘要是从句子中间开始的。

常见错误与故障排除

常见问题

摘要实际上是在哪里生成的?
在你的浏览器里。模型下载一次之后就跑在你的设备上,董事会材料与机密报告不会为了摘要而被传出去。
本机摘要有多可靠?
这是个小模型,请把结果当索引,而不是替代阅读。它能可靠地告诉你某一节讲的是什么,细微处则差些。
为什么逐节概括,而不是整份文件一起?
因为模型只读固定量的文字。对着一份长报告跑一遍,只会概括开头几页而忽略其余。
它能概括扫描件吗?
不能直接概括——扫描件里没有文字。先做文字识别,识别后的版本就能正常概括。
模型每次都要重新下载吗?
不用。首次运行后浏览器会缓存它,之后的会话立刻开始,离线也能用。

相关工具

全部 ArrayKit 工具