PDF OCR

Mit PDF OCR machen Sie Scans durchsuchbar und kopierbar. Eine unsichtbare Textebene ergänzt Text, ohne Bild oder Seitengröße zu ändern.

Ihre Datei wird über eine sichere Verbindung hochgeladen und auf unserem Server verarbeitet. Das Original wird direkt nach der Verarbeitung gelöscht, das Ergebnis nach 1 Stunde (24 Stunden in Ihrem Konto).

Laden Sie PDF-Dateien hoch. JPG- und PNG-Bilder werden nicht unterstützt.

Wählen Sie bis zu drei der elf verfügbaren Sprachen aus. Seitensprache und Englisch sind standardmäßig vorausgewählt. Fehlt eine benötigte Sprache, kann der erkannte Text unverständlich sein.

Bei Bedarf aktivieren Sie die automatische Drehung und Begradigung schiefer Seiten. Seiten mit echtem Text werden standardmäßig übersprungen, erkannt werden gescannte Seiten. Eine vorhandene OCR-Textebene können Sie ersetzen lassen, ohne echten Text in ein Bild umzuwandeln.

Starten Sie die Erkennung und laden Sie das durchsuchbare PDF herunter. Optional erhalten Sie den erkannten Text zusätzlich als TXT-Datei. Bei mehreren PDFs steht auch ein ZIP-Archiv bereit.

Durchsuchbare PDFs erleichtern es, Textstellen in gescannten Verträgen, Rechnungen oder Protokollen später zu finden, auszuwählen und zu kopieren. Das Seitenbild bleibt unverändert. Die Erkennung eignet sich für gedruckten Text in gut lesbaren Scans, Handschrift, komplexe Tabellen und Formeln werden nicht zuverlässig erkannt.

Gäste verarbeiten bis zu zehn PDFs pro Durchgang, jeweils mit höchstens 50 MB und 20 Seiten. Registrierte Nutzer können je Dokument bis 100 MB und 100 Seiten verarbeiten. Gleichzeitig sind bis zu zwei Aufträge für Gäste und vier für registrierte Nutzer möglich.

Die Erkennung dauert etwa zwei bis zehn Sekunden je Seite. Die PDF wird sicher zum Server übertragen und direkt nach der Verarbeitung gelöscht. Ergebnisse werden nach einer Stunde bei Gästen beziehungsweise nach 24 Stunden bei registrierten Nutzern gelöscht. Das Tool ist kostenlos und fügt kein Wasserzeichen hinzu.

Nach der OCR ist eine digitale Signatur ungültig. Verwenden Sie das Ergebnis daher nicht, wenn die Signatur gültig bleiben muss.

FAQ

Was passiert, wenn eine PDF-Seite bereits Text enthält?

Im Standardmodus wird eine Seite mit echtem Text als Ganzes übersprungen. Wenn eine frühere, unsichtbare OCR-Textebene fehlerhaft ist, können Sie diese ersetzen lassen. Vorhandener echter Text wird dabei nicht in ein Bild umgewandelt.

Erkennt das Tool automatisch die Sprache im PDF?

Nein. Wählen Sie die im Dokument vorkommenden Sprachen selbst aus. Sie können bis zu drei der elf unterstützten Sprachen gleichzeitig festlegen. Ist eine benötigte Sprache nicht ausgewählt, kann der erkannte Text unverständlich sein.

Kann ich das Ergebnis als Word- oder Excel-Datei speichern?

Nein. Als Ergebnis erhalten Sie ein durchsuchbares PDF und auf Wunsch eine separate TXT-Datei. Eine bearbeitbare Word- oder Excel-Datei sowie eine PDF/A-Ausgabe werden nicht erstellt.

Kann ich nach der Verarbeitung sehen, was erkannt wurde?

Die Ergebnisseite zeigt die Zahl der erkannten Wörter und Seiten sowie eine Textvorschau der ersten Seite. Außerdem werden dort die erkannten Sprachen angezeigt.

Kann ich eine passwortgeschützte PDF verarbeiten?

Ja. Geben Sie das PDF-Passwort ein, wenn Sie dazu aufgefordert werden. Das Passwort wird nur für diesen Auftrag verwendet und nicht gespeichert. Das Ergebnis wird ohne Passwort gespeichert.