Anleitung · Texterkennung

Gescanntes PDF durchsuchbar machen: Texterkennung (OCR) unter Windows

Ein eingescannter Vertrag ist für den Computer nur ein Bild: Suchen findet nichts, Kopieren geht nicht. FlinkPDF legt mit der in Windows eingebauten Texterkennung eine unsichtbare Textebene über die Seiten. Danach lässt sich der Text suchen, kopieren und exportieren, das Aussehen bleibt gleich. Alles läuft lokal: keine Cloud, keine Sprachpakete zum Nachladen.

Version 1.6.2 · Freeware für Windows 10 und 11 · die Erkennung läuft ohne Internet auf Ihrem PC

So machen Sie ein gescanntes PDF durchsuchbar

  1. Gescanntes PDF öffnen

    Starten Sie FlinkPDF und öffnen Sie den Scan über Datei > Öffnen (Strg+O). Liegen die Seiten quer oder auf dem Kopf, drehen Sie sie zuerst mit Strg+ oder Strg+.

  2. Texterkennung aufrufen

    Wählen Sie Werkzeuge > Texterkennung… (Strg+Umschalt+O).

  3. Sprache und Seiten wählen

    Stellen Sie die Sprache des Dokuments ein, damit Umlaute und Sonderzeichen stimmen, und wählen Sie die Seiten: die aktuelle, die in der Miniaturenleiste markierten oder alle. Seiten, die schon Text enthalten, überspringt FlinkPDF auf Wunsch. Ein Klick auf Erkennen startet den Vorgang; ein Fortschrittsfenster zeigt die Seite, an der gerade gearbeitet wird.

  4. Speichern

    FlinkPDF meldet, wie viele Seiten und Wörter erkannt wurden. Speichern Sie das PDF mit Strg+S oder unter neuem Namen. Es sieht aus wie vorher, aber der Text lässt sich jetzt in jedem PDF-Programm und im Browser mit Strg+F durchsuchen, markieren und kopieren.

FlinkPDF mit einer eingescannten Offerte in Graustufen, links die Miniaturen der zwei Seiten
Ein typischer Scan: Für den Computer sind diese Seiten zunächst nur Bilder.
Dialog Texterkennung (OCR) in FlinkPDF mit Sprachauswahl Deutsch, Seitenbereich und der Option, Seiten mit vorhandenem Text zu überspringen
Sprache und Seiten wählen. Zur Auswahl stehen die Sprachen, die in Windows installiert sind.
Meldung von FlinkPDF nach der Texterkennung: 2 Seiten erkannt, 92 Wörter, der Text ist jetzt durchsuchbar
Fertig: zwei Seiten, 92 Wörter. Jetzt noch speichern.

Rückgängig möglich

Mit Strg+Z nehmen Sie die Texterkennung zurück, solange das Dokument geöffnet ist. In der Datei ändert sich erst beim Speichern etwas.

Was Sie mit dem erkannten Text anfangen können

Sprachen: was Windows mitbringt

FlinkPDF nutzt die Texterkennung, die in Windows 10 und 11 eingebaut ist. Zur Auswahl stehen die OCR-Sprachen, die in Windows installiert sind; bei einem deutschen Windows ist Deutsch dabei, oft auch Englisch oder Französisch. Weitere Sprachen fügen Sie in Windows unter Einstellungen > Zeit und Sprache > Sprache und Region hinzu. FlinkPDF selbst lädt dafür nichts nach und schickt nichts ins Internet.

Ehrlich gesagt: Wie gut ist das Ergebnis?

Bei sauberen Scans von gedrucktem Text sehr gut. Fehler passieren bei ähnlichen Zeichen: In unserem Beispiel wurde aus «2'400.00» an einer Stelle «2'400.OO», mit dem Buchstaben O statt der Ziffer 0. Prüfen Sie Zahlen, bevor Sie sie weiterverwenden.

So wird es besser: mit 300 dpi scannen, das Blatt gerade einlegen, schwarz auf weiss statt blasser Kopien, Seiten vor der Erkennung richtig herum drehen. Handschrift wird nur schlecht erkannt.

Viele Dateien auf einmal

Für ganze Ordner gibt es die Texterkennung auch ohne Oberfläche, zum Beispiel in einem Skript:

FlinkPDF.exe --ocr eingabe.pdf ausgabe.pdf de-DE

Die Sprache am Schluss ist freiwillig. Der Rückgabewert ist 0 bei Erfolg, 1 bei Fehlern wie einer fehlenden oder passwortgeschützten Datei und 2 bei falschem Aufruf.

Häufige Fragen

Was bedeutet OCR?

OCR steht für «Optical Character Recognition», auf Deutsch Texterkennung: Ein Programm erkennt in einem Bild die Buchstaben und macht daraus Text, den der Computer suchen und kopieren kann.

Verändert die Texterkennung das Aussehen meines Dokuments?

Nein. Der erkannte Text liegt unsichtbar hinter dem Bild der Seite. Auch gedreht eingescannte Seiten werden richtig behandelt.

Werden meine Dokumente in eine Cloud geladen?

Nein. Die Erkennung übernimmt Windows auf Ihrem PC. FlinkPDF braucht dafür kein Internet und überträgt nichts.

Woran erkenne ich, ob mein PDF schon Text enthält?

Öffnen Sie es im Browser und suchen Sie mit Strg+F nach einem Wort, das sichtbar auf der Seite steht. Wird es nicht gefunden, ist es ein reiner Scan. FlinkPDF überspringt Seiten mit vorhandenem Text ohnehin, wenn die Option angekreuzt ist.

Im Dialog steht meine Sprache nicht zur Auswahl.

Dann ist sie in Windows nicht als OCR-Sprache installiert. Fügen Sie sie in den Windows-Einstellungen unter «Zeit und Sprache» hinzu und starten Sie FlinkPDF neu.

Wird die Datei durch die Texterkennung grösser?

Kaum. Dazu kommt nur der Text, die Bilder der Seiten bleiben, wie sie sind.

Weitere Anleitungen

Scans durchsuchbar machen, ohne sie hochzuladen

FlinkPDF herunterladen, installieren, Texterkennung starten. Ihre Dokumente bleiben auf Ihrem PC.

Gratis für Windows laden

Version 1.6.2 · Windows 10 & 11 · keine Registrierung