PDF-zu-HTML-Konverter
Ein PDF wird zu semantischem, responsivem HTML — samt Überschriften, Listen, Absätzen.
Der PDF-zu-HTML-Konverter liest und schreibt das Dokument auf Ihrem Gerät neu. Interne Handbücher und Kundenberichte werden nie hochgeladen.
HTML zurück in ein PDF
Über PDF zu HTML
Ein PDF taugt schlecht fürs Web: Es lädt herunter, statt sich zu öffnen, fließt auf dem Telefon nicht um, und Suchmaschinen indexieren es widerwillig. Sauber umzuwandeln heißt, die Struktur zurückzugewinnen, die das Layout andeutet, statt jede Zeile in ein div zu wickeln. Dieses Werkzeug gruppiert Textstücke zu Zeilen, Zeilen zu Absätzen und hebt größere Zeilen zu Überschriften, dann schreibt es Markup, das sagt, was jeder Block ist. Sie nehmen eine vollständige Seite — responsiv, mit heller und dunkler Palette — oder nur das Body-Fragment für Ihre Vorlage.
Funktionen
- Semantisches Markup: h1 bis h6, p, ul, li, blockquote, pre und table
- Umbrochene Zeilen fügen sich zu echten Absätzen statt je einer Zeile
- Vollständige Seite oder Body-Fragment für die eigene Vorlage
- Die vollständige Seite ist responsiv und folgt Hell- oder Dunkelmodus
- Optionale id an jedem Seitenumbruch für Tiefenlinks ins Dokument
- Gerenderte Vorschau neben dem Markup, in einem abgeschotteten Rahmen
- In die Zwischenablage kopieren oder als .html-Datei laden
So verwendest du PDF zu HTML
- Das PDF auf die Seite ziehen
- Vollständige Seite oder Body-Fragment wählen
- Die gerenderte Vorschau lesen und die Struktur prüfen
- Markup kopieren oder die .html-Datei herunterladen
Beispiel
Eingabe
handbook.pdf — 24 pages
Ausgabe
<h1>Staff handbook</h1>
<p>This handbook sets out…</p>
<h2>Working hours</h2>
Die Überschriftsebenen ergeben sich aus der Schriftgröße im Verhältnis zum Grundtext jeder Seite.
Häufige Fehler & Fehlerbehebung
- Das Markup ist leer. — Das PDF hat keine Textebene. Lassen Sie zuerst den Text erkennen und wandeln Sie die durchsuchbare Fassung um.
- Bilder aus dem PDF fehlen. — Nur Text wird umgewandelt. Exportieren Sie die Seiten separat als Bilder und verweisen Sie im Markup darauf.
- Alle Überschriften haben dieselbe Ebene. — Das Dokument setzt jede Überschrift gleich groß, es gibt also nichts, was Ebene 2 von 3 trennt. Passen Sie die Ebenen einmal von Hand an.
- Seitenbeiwerk zieht sich durchs Dokument. — Kolumnentitel und Seitenzahlen sind im PDF gewöhnlicher Text. Entfernen Sie sie mit Suchen und Ersetzen im erzeugten Markup.
Häufig gestellte Fragen
- Wird mein PDF beim Umwandeln nach HTML hochgeladen?
- Nein. Die Textebene wird in diesem Tab gelesen und das Markup hier erzeugt, ein internes Handbuch verlässt Ihr Gerät also nie.
- Sieht das HTML aus wie das ursprüngliche PDF?
- Nein — es ist fürs Lesen am Bildschirm gebaut, also eine Spalte, ein bequemes Satzmaß und ein responsives Layout. Der Inhalt ist derselbe, das Design nicht.
- Welche Ausgabe passt zu einem CMS?
- Das Body-Fragment. Es hat keinen Kopf, keine Stile und keinen Rahmen und fügt sich in eine bestehende Vorlage ein.
- Ist die erzeugte Seite barrierearm?
- Sie nutzt echte Überschriften, Listen und Tabellenköpfe, also das meiste, was ein Screenreader braucht. Prüfen Sie die Überschriftsfolge.
- Kann ich mehrere PDFs in eine Seite umwandeln?
- Führen Sie die PDFs zuerst zusammen und wandeln Sie einmal um — so bleibt die Überschriftshierarchie im ganzen Dokument stimmig.
Verwandte Tools
- HTML zu PDF — Wandelt HTML-Markup in ein sauberes, paginiertes PDF-Dokument.
- PDF zu Text — Extrahiere auswählbaren Text aus einem PDF als reinen Text oder Markdown.
- PDF zu Word — Baut ein PDF als bearbeitbares .docx neu auf.
- PDF zu EPUB — Macht ein PDF zu einem fließenden EPUB für Lesegeräte.
- HTML-Formatierer — Verschönere oder minimiere HTML, formatiere eingebettetes CSS/JS und zeige eine Vorschau.
- HTML zu Markdown — Konvertiere HTML in sauberes, lesbares Markdown.
- PDF-OCR — Erkennt Text in einem gescannten PDF und macht ihn durchsuchbar.
Alle ArrayKit-Tools