HTML 转 PDF
粘贴 HTML,得到一份干净、分页、保留文档结构的 PDF。
HTML 转 PDF 的解析在你的设备上完成。排好的发票与客户报表常含个人信息,这些内容不会被上传。
反过来:PDF 转 HTML
关于 HTML 转 PDF
把网页打印成 PDF,得到的是整个页面——导航、Cookie 提示条、三栏的装饰,一样不少。多数时候你要的是内容:应用生成的报表、模板排出的发票、去掉家具的正文。这个转换器读的是标记的结构,而不是它的外观。标题、段落、列表、块引用、预格式代码、水平线和表格都会保留;样式表、脚本与页面装饰则被有意丢弃。结果是一份读起来像文档的文档,按你选定的页面尺寸排版,全程在你的设备上生成。
功能特性
- 从标记里读结构:标题、列表、表格、引用、代码、横线
- 能容忍不完整的 HTML——未闭合的标签不会让它停下
- 字符实体会被还原,& 与 — 都能正确输出
- 表格保留表头,并在跨页时重复
- 脚本、样式与页面装饰被丢弃而非渲染
- 拖入 .html 文件,或粘贴标记后就地编辑
- 把文档自己的 <title> 用作 PDF 中保存的标题
如何使用 HTML 转 PDF
- 粘贴 HTML,或拖入保存下来的 .html 文件
- 查看块数量,确认识别出的结构
- 选择页面尺寸、页边距、字号与字体
- 转换、阅读预览并下载
示例
输入
<h1>Quarterly summary</h1>
<p>Revenue grew across all three regions.</p>
<ul><li>Renewals up 14%</li></ul>
输出
A PDF with a large heading, one paragraph and a bulleted line — no page chrome, no stylesheet.
带过去的是结构,原页面的视觉设计不会带过去。
常见错误与故障排除
- PDF 和来源网页一点都不像。 — 这正是本意。CSS 不会应用——工具把内容重建成一份朴素文档。若要一份与样式一致的副本,请从浏览器打印。
- 从站点保存的网页产生了几百个近乎空白的块。 — 保存的网页会带上导航、页脚和内联脚本。只粘贴文章或报表的标记,输出立刻就干净了。
- 嵌套表格被压平了。 — 单元格里的表格会被当作该单元格的文字读取。如果内层网格重要,请把标记拆成独立的表格。
- 段落内部的换行丢了。 — 这里 <br> 会开启新的块。真正独立的行请各自放进 <p> 元素。
常见问题
- 它会把我的标记发给渲染服务吗?
- 不会。标记在这个标签页里解析,PDF 也在这里写出。当 HTML 是一张发票或客户报表时,这一点尤其要紧。
- 我的 CSS 会作用到 PDF 上吗?
- 不会。字体、颜色与版式来自这个界面上的设置,而不是样式表——正因如此,输出保持易读,而不是把屏幕版式硬搬到纸上。
- 能直接转换一个网址,而不是粘贴标记吗?
- 这里不行,因为抓取网址意味着有请求从你的机器发出。请先保存网页或复制其标记。
- HTML 里的内嵌图片会包含进去吗?
- 不会。只保留替代文字,因为图片位于本工具刻意不去访问的地址。
- 表单或输入框会怎样?
- 纸面上表单控件没有意义,因此被跳过。它们周围的标签文字仍作为普通内容保留。
相关工具
全部 ArrayKit 工具