FreePDF logoFreePDF

Gescanntes PDF per OCR durchsuchbar machen und Text kopieren

Vom FreePDF-Team ·

Ein gescanntes PDF ist im Grunde nichts anderes als das Foto einer Seite, das man mit der Endung .pdf abgespeichert hat. Durchsuchen lässt es sich nicht, einen Satz zum Kopieren markieren auch nicht, und Screenreader können damit nichts anfangen. OCR (optische Zeichenerkennung) schafft Abhilfe: Sie liest den Text aus dem Bild aus und legt ihn im Hintergrund wieder in die Datei.

Was OCR wirklich verändert

Am Scan selbst ändert sich nichts – gleiches Layout, gleiche Handschrift, gleicher Kaffeefleck, falls einer da ist. Dazu kommt lediglich eine unsichtbare Schicht aus echtem, markierbarem Text, die exakt hinter den Wörtern im Bild liegt. Die Seite sieht also aus wie zuvor, verhält sich aber ab jetzt wie ein ganz normales Dokument.

OCR ausführen

  1. Öffne das Tool „OCR PDF“ und lade deine gescannte Datei hoch.
  2. Der Text jeder Seite wird erkannt und als durchsuchbare Ebene dahintergelegt.
  3. Lade das durchsuchbare PDF herunter.

Wann sich das wirklich lohnt

  • Wenn du einen langen gescannten Vertrag oder Bericht nach einer einzigen Klausel durchsuchen willst, statt Seite für Seite zu lesen.
  • Wenn du einen Absatz aus einem Scan kopieren willst, statt ihn von Hand abzutippen.
  • Wenn ein altes gescanntes Dokument für Screenreader zugänglich werden soll.
  • Wenn du einen Scan für eine weitere Umwandlung vorbereitest – Tabellen oder Text lassen sich erst herausziehen, sobald echter Text zum Auslesen da ist.

So wird das Ergebnis genau

Die Genauigkeit der OCR hängt unmittelbar von der Qualität des Scans ab:

  • Ein klarer, gerader und gut ausgeleuchteter Scan wird nahezu fehlerfrei erkannt.
  • Fotos mit niedriger Auflösung, stark schiefe Seiten oder Handschrift lassen sich schwerer zuverlässig erkennen – scanne die Vorlage flach und gut beleuchtet neu ein, wenn der erste Versuch daneben liegt.
  • Die Erkennung ist auf englischen Text ausgelegt; bei anderen Sprachen können mehr Fehler durchrutschen.

Häufige Fragen

Sieht die Seite hinterher anders aus?

Nein. Das Originalbild bleibt exakt so, wie es war – OCR legt nur eine unsichtbare Textebene dahinter und zeichnet oder ersetzt die Seite nicht.

Kann ich die Datei danach in Word oder Excel umwandeln?

Ja – und oft ist genau das der Sinn der Sache. Lass zuerst OCR laufen, damit echter Text oder echte Tabellendaten darunterliegen, und wandle die Datei anschließend wie gewohnt in Word, Excel oder reinen Text um.

Passende kostenlose Tools