OCR für PDF

Gescannte Seiten durchsuchbar und markierbar machen.

Ziehen Sie Ihre Dateien hierher

Unterstützt: PDF, JPG, PNG

Dateien werden privat behandelt und automatisch entfernt. Interface-Vorschau - die Verarbeitung ist noch nicht aktiviert.

Über OCR für PDF

Die Texterkennung (OCR) liest den Text in Ihren Scans und legt eine unsichtbare Textebene unter das Bild, sodass Sie das Dokument durchsuchen, kopieren und indexieren können, während es weiterhin wie das Original aussieht.

  • Dutzende Sprachen
  • Behält das ursprüngliche Seitenbild
  • Ermöglicht Kopieren, Suchen und Indexieren

Anleitung ocr für pdf

  1. 1

    Scan hochladen

    Auch Fotos von Dokumenten funktionieren.

  2. 2

    Sprache wählen

    Mit der richtigen Sprache steigt die Erkennungsgenauigkeit deutlich.

  3. 3

    Herunterladen

    Sieht identisch aus, aber der Text ist nun durchsuchbar.

Ein praktischer Leitfaden für ocr für pdf

Was OCR Ihrem Scan tatsächlich hinzufügt

Eine gescannte Seite ist nur ein Bild von Text, sodass ein Computer Pixel sieht, keine Wörter, und darin weder suchen noch daraus kopieren kann. OCR liest dieses Bild, erkennt die Buchstaben und schreibt sie in eine unsichtbare Ebene, die direkt unter dem Bild positioniert ist. Die Seite sieht weiterhin genau wie der Originalscan aus, aber nun können Sie einen Satz auswählen, eine Suche laufen lassen, einen Absatz kopieren und Suchmaschinen sowie Dokumentsysteme den Inhalt indexieren lassen. Am sichtbaren Erscheinungsbild ändert sich nichts; der Wert liegt ganz in der durchsuchbaren Ebene darunter, die still ein flaches Bild in ein nutzbares Dokument verwandelt.

Die genaueste Erkennung erzielen

Die Genauigkeit folgt eng der Eingabequalität. Ein sauberer Scan in ordentlicher Auflösung, aufrecht und scharf, liest sich nahezu perfekt, während ein dunkles Handyfoto, eine schiefe Seite oder ein blasses Fax Zeichen verliert. Zwei Einstellungen helfen am meisten: Wählen Sie die richtige Sprache oder Sprachen, damit die Erkennung weiß, welches Alphabet und welche Akzente zu erwarten sind, und stellen Sie sicher, dass die Seite gerade ist, bevor Sie beginnen. Ist der Scan schief oder körnig, zahlt sich das vorherige Geraderichten und Verbessern der Quelle mehr aus als jede OCR-Option. Blasse oder ungewöhnliche Schriften und Handschrift bleiben die schwersten Fälle, lesen Sie also alles Kritische Korrektur.

Wo OCR zu anderen Tools passt

OCR ist oft der ermöglichende Schritt, der andere Aufgaben an einem Scan überhaupt möglich macht. Existiert einmal eine Textebene, können Sie sauberen Text extrahieren, das Dokument mit echtem bearbeitbarem Inhalt statt einem flachen Bild in Word oder Excel umwandeln oder einen Stapel Auszüge nach dem auf jeder Seite gedruckten Kundennamen teilen, was alles lesbaren Text braucht. Die Reihenfolge zählt: erst den Scan geraderichten und bereinigen, dann OCR und erst dann komprimieren, damit die Erkennung an den schärfsten Bildern läuft und die durchsuchbare Ebene in die endgültige, kleinere Datei übernommen wird.

Häufig gestellte Fragen

Wie erkenne ich, ob ein PDF wirklich OCR braucht?
Versuchen Sie, ein Wort auf der Seite auszuwählen oder danach zu suchen. Hebt sich nichts hervor und die Suche findet nichts, ist die Seite ein Bild und braucht OCR. Lässt sich der Text normal auswählen, ist er bereits digital und OCR würde nichts hinzufügen, sodass Sie es überspringen können.
Mein Dokument mischt zwei Sprachen. Kommt OCR damit zurecht?
Ja. Sie können mehr als eine Sprache auswählen, sodass die Erkennung auf derselben Seite beide Alphabete und Sonderzeichen erwartet, was für Buchstaben mit Akzent und nicht-lateinische Schriften wichtig ist. Auf einer zweisprachigen Seite nur eine Sprache zu wählen verzerrt meist die Wörter der anderen.
Macht OCR die Datei größer?
Geringfügig. Es fügt eine unsichtbare Textebene unter das vorhandene Bild ein, sodass das Seitenbild unverändert bleibt und nur der erkannte Text hinzukommt, der klein ist. Ist die Größe ein Anliegen, komprimieren Sie nach dem OCR statt davor.
Richtet OCR einen schiefen Scan gerade oder bereinigt es ihn?
Nein, OCR liest nur und fügt eine Textebene hinzu; es korrigiert das Bild nicht. Ein geneigter oder schiefer Scan senkt die Genauigkeit, lassen Sie also zuerst PDF begradigen laufen und stellen Sie sicher, dass die Seite aufrecht ist, dann liest OCR weit mehr davon korrekt.