PDF-OCR

Den Text in einem gescannten PDF erkennen und eine durchsuchbare Datei zurückbekommen.

Die Erkennung läuft auf Ihrem Gerät, gescannte Akten und Archive bleiben also bei Ihnen. Nur die Sprachdaten werden einmal geholt und zwischengespeichert.

Das durchsuchbare Ergebnis nach Word

Über PDF-OCR

Ein gescanntes PDF ist ein Bild eines Dokuments. Sie können es lesen, sonst niemand: Die Suche findet nichts, das Kopieren liefert nichts, und jedes Werkzeug, das auf Text arbeitet, steht ohne Material da. Texterkennung behebt das, indem sie die Formen der Buchstaben liest und das Gefundene als unsichtbare Ebene genau über die gedruckten Wörter schreibt. Die Seite sieht identisch aus — der Scan bleibt unangetastet —, aber das Dokument ist nun durchsuchbar, markierbar und wandelbar. Die Erkennung läuft in Ihrem Browser, in einer von zwölf Sprachen.

Funktionen

So verwendest du PDF-OCR

  1. Das gescannte PDF auf die Seite ziehen
  2. Die Sprache auf der Seite und eine Scanqualität wählen
  3. Die Erkennung starten und beim Durchlauf zusehen
  4. Das durchsuchbare PDF oder nur den erkannten Text laden

Beispiel

Eingabe

1987-minutes.pdf — 8 scanned pages, typewritten English

Ausgabe

1987-minutes-searchable.pdf — same images, now with selectable text behind them.

Die sichtbare Seite ändert sich nicht; geändert hat sich, dass die Wörter nun in der Datei stehen.

Häufige Fehler & Fehlerbehebung

Häufig gestellte Fragen

Ersetzt der erkannte Text den Scan?
Nein. Das Bild bleibt genau, wie es war, und der Text kommt unsichtbar dahinter. Deshalb sieht ein durchsuchbares PDF aus wie das Original.
Werden meine gescannten Seiten zur Erkennung hochgeladen?
Nein. Die Erkennung läuft in Ihrem Browser. Geholt werden nur die Sprachdaten, einmal, und Ihr Browser hält sie danach vor.
Wie viele Seiten kann ich auf einmal erkennen lassen?
Bis zu dreißig je Durchgang, denn die Erkennung ist langsam genug, dass längere Dokumente stapelweise besser aufgehoben sind.
Welche Qualitätsstufe soll ich wählen?
Beginnen Sie mit der schnellen. Wechseln Sie zur höheren, wenn die Schrift klein oder der Scan alt ist.
Kann ich OCR auf ein PDF anwenden, das schon Text hat?
Sie können, aber es bringt nichts: Prüfen Sie zuerst, ob sich ein Wort markieren lässt.

Verwandte Tools

Alle ArrayKit-Tools