PDFをHTMLに変換
PDFを意味づけされた可変幅のHTMLにします。見出し、箇条書き、段落も残ります。
PDFをHTMLに変換する読み取りと書き直しは端末上で行われます。社内マニュアルや顧客向け報告書がアップロードされることはありません。
HTMLをPDFに戻す
PDFをHTMLに について
PDFはウェブで公開するには不向きです。開かずにダウンロードされ、携帯では流れ直さず、検索エンジンも渋々しか索引を作りません。きちんと変換するとは、配置が示している構造を取り戻すことであって、各行をdivで包むことではありません。このツールは文字のかたまりを行に、行を段落にまとめ、大きい行を見出しへ昇格させ、それぞれのブロックが何であるかを述べるマークアップを書きます。可変幅で明暗の配色を備えたページ全体でも、ひな形に差し込む本文断片でも取り出せます。
機能
- 意味づけされたマークアップ:h1〜h6、p、ul、li、blockquote、pre、table
- 折り返された行は1行ずつではなく本物の段落にまとまります
- 独立したページ全体、または自分のひな形用の本文断片
- ページ全体は可変幅で、読み手の明暗の設定に従います
- 文書内へ深く連結できるよう、改ページごとに任意のidを付与
- 分離した枠での描画プレビューをマークアップの隣に表示
- クリップボードにコピー、または .html ファイルをダウンロード
PDFをHTMLに の使い方
- PDFをページに置きます
- ページ全体か本文断片かを選びます
- 描画プレビューを読んで構造を確かめます
- マークアップをコピーするか .html をダウンロードします
例
入力
handbook.pdf — 24 pages
出力
<h1>Staff handbook</h1>
<p>This handbook sets out…</p>
<h2>Working hours</h2>
見出しの階層は、各ページの本文に対する文字の大きさから決まります。
よくあるエラーとトラブルシューティング
- マークアップが空です。 — PDFに文字の層がありません。先に文字を認識し、その版を変換してください。
- PDFの画像がありません。 — 変換されるのは文字だけです。ページを画像として別に書き出し、マークアップから参照してください。
- 見出しがすべて同じ階層です。 — 文書がすべての見出しを同じ大きさで組んでおり、2階層目と3階層目を分ける手掛かりがありません。マークアップ側で一度直してください。
- 柱やノンブルが文書全体に現れます。 — PDFでは柱も通常の文字です。生成したマークアップに置換をかけて取り除いてください。
よくある質問
- HTMLへの変換でPDFはアップロードされますか。
- いいえ。文字の層はこのタブで読み、マークアップもここで生成します。社内マニュアルや顧客向け報告書が端末から出ることはありません。
- HTMLは元のPDFと同じ見た目になりますか。
- いいえ。画面で読みやすいように作られており、1段組み、無理のない行長、可変幅の配置になります。内容は同じで、体裁は違います。
- CMSにはどちらの出力を使うべきですか。
- 本文断片です。ヘッダーもスタイルも外枠も持たないため、既存のひな形と衝突せずに収まります。
- 生成されたページはアクセシブルですか。
- 本物の見出し、箇条書き、表の見出しセルを使っており、読み上げに必要な要素の大半を備えます。見出しの順序は確認してください。
- 複数のPDFを1つのページにできますか。
- 先にPDFを結合してから一度に変換してください。見出しの階層が文書全体で揃います。
関連ツール
すべての ArrayKit ツール