HTMLをPDFに変換
HTMLを貼り付けると、文書構造を保った読みやすいページ分割済みPDFになります。
HTMLをPDFに変換する解析は端末上で行われます。組版された請求書や顧客向け報告書には個人情報が含まれがちですが、いずれもアップロードされません。
逆方向にPDFからHTMLへ
HTMLをPDFに について
ウェブページをPDFに印刷すると、ナビゲーション、クッキーの帯、三段組みの飾りまで含めたページ全体が出てきます。多くの場合ほしいのは中身のほうです。アプリケーションが生成した報告書、テンプレートが組んだ請求書、装飾を除いた記事本体です。この変換はマークアップを見た目ではなく構造として読みます。見出し、段落、リスト、引用、整形済みコード、水平線、表は残り、スタイルシートやスクリプト、ページの装飾は意図的に捨てられます。結果は、文書らしく読める文書です。
機能
- マークアップから構造を読み取る:見出し、リスト、表、引用、コード、罫線
- 閉じ忘れたタグがあっても止まらない寛容な解析
- 文字実体参照を解決するため、& や — も正しく出力
- 表は見出し行を保ち、改ページ後も繰り返す
- スクリプト、スタイル、ページの装飾は描かずに捨てる
- .html ファイルを置くか、マークアップを貼り付けてその場で編集
- 文書自身の <title> をPDFの保存タイトルとして利用
HTMLをPDFに の使い方
- HTMLを貼り付けるか、保存済みの .html ファイルを置きます
- 認識された構造をブロック数で確認します
- 用紙サイズ、余白、文字サイズ、書体を選びます
- 変換してプレビューを読み、ダウンロードします
例
入力
<h1>Quarterly summary</h1>
<p>Revenue grew across all three regions.</p>
<ul><li>Renewals up 14%</li></ul>
出力
A PDF with a large heading, one paragraph and a bulleted line — no page chrome, no stylesheet.
引き継がれるのは構造で、元のページの視覚的な設計ではありません。
よくあるエラーとトラブルシューティング
- PDFが元のウェブページとまったく似ていません。 — そういう設計です。CSSは適用されず、内容を素の文書として組み直します。見た目どおりの写しが必要なら、ブラウザから印刷してください。
- サイトから保存したページで、ほぼ空のブロックが大量にできました。 — 保存したページはナビゲーションやフッター、埋め込みスクリプトを抱えています。記事や報告書のマークアップだけを貼れば、出力はすぐ引き締まります。
- 入れ子の表が平坦になりました。 — セル内の表はそのセルの文字列として読まれます。内側の格子が重要なら、別々の表に組み直してください。
- 段落内の改行が失われました。 — ここでは <br> が新しいブロックを開始します。本当に別行なら、それぞれを <p> で囲んでください。
よくある質問
- これはマークアップを描画サービスに送りますか。
- いいえ。解析もPDFの書き出しもこのタブ内で行われます。HTMLが請求書や顧客向け報告書のときに重要な点です。
- 自分のCSSはPDFに適用されますか。
- いいえ。書体、色、体裁はこの画面の設定から決まります。それが、画面用の体裁を紙に押し込めず読みやすさを保つ理由です。
- マークアップを貼る代わりに、URLを直接変換できますか。
- ここではできません。URLの取得は端末からの通信になるためです。ページを保存するか、マークアップをコピーしてください。
- HTML内の画像は含まれますか。
- いいえ。代替テキストのみが残ります。画像は、このツールが意図的に取得しないアドレスにあります。
- フォームや入力欄はどうなりますか。
- 紙の上でフォーム部品には意味がないため飛ばされます。周囲のラベル文字列は通常の内容として残ります。
関連ツール
すべての ArrayKit ツール