PDF in Word

Wandeln Sie eine PDF-Datei in ein bearbeitbares Word-Dokument (DOCX) um. Für Scans steht OCR zur Texterkennung bereit.

Ihre Datei wird über eine sichere Verbindung hochgeladen und auf unserem Server verarbeitet. Das Original wird direkt nach der Verarbeitung gelöscht, das Ergebnis nach 1 Stunde (24 Stunden in Ihrem Konto).

Laden Sie eine PDF-Datei hoch, jeweils wird eine Datei verarbeitet. Vor dem Upload prüft Ihr Browser Seitenzahl und Textebene.

Wählen Sie unter „Seiten“ die gesamte PDF oder bestimmte Seiten. Klicken Sie auf „Seiten auswählen“ und geben Sie Seitenbereiche ein, etwa 1-3, 5.

Wählen Sie den bearbeitbaren Textfluss oder Nur-Text. Der bearbeitbare Modus übernimmt Tabellen und Bilder, Nur-Text lässt diese und das Seitenlayout weg. Für Seiten ohne Textebene können Sie OCR nutzen oder die Seiten als Bilder übernehmen. Wählen Sie bei OCR die passenden Dokumentsprachen. Bei geschützten PDFs geben Sie das Passwort unter „PDF-Passwort“ ein, es wird nicht gespeichert.

Klicken Sie auf „PDF in Word“ und laden Sie die DOCX-Datei herunter.

Der bearbeitbare Modus übernimmt Absätze, Überschriften, Listen, Tabellen und Bilder, Seitengrößen und Ränder bleiben erhalten. Eine exakte Layoutkopie entsteht nicht: Komplexe Layouts werden vereinfacht, Spalten zu einem Textfluss und Originalschriften nicht übernommen. Im Nur-Text-Modus entfallen Tabellen, Bilder und Seitenlayout.

OCR ist in elf Sprachen verfügbar, davon können Sie bis zu drei gleichzeitig wählen. Wählen Sie die Scan-Sprachen aus, da nicht ausgewählte Sprachen unleserlich erkannt werden können. Ohne OCR werden Seiten ohne Textebene im bearbeitbaren Modus als Bilder eingefügt und im Nur-Text-Modus übersprungen. Das OCR-Limit liegt bei 20 Seiten für Gäste und 100 für registrierte Nutzer.

Gäste können PDFs bis 50 MB und 200 Seiten verarbeiten, registrierte Nutzer bis 100 MB und 500 Seiten. Registrierung ist nicht nötig, die DOCX-Ausgabe enthält kein Wasserzeichen. Die PDF wird direkt nach der Verarbeitung gelöscht, die DOCX-Datei nach einer Stunde für Gäste und nach 24 Stunden für registrierte Nutzer.

FAQ

Wie lange dauert die Texterkennung bei gescannten Seiten?

Die OCR-Erkennung benötigt etwa 2 bis 10 Sekunden pro Seite. Die tatsächliche Dauer der Umwandlung einer ganzen PDF-Datei hängt auch von weiteren Verarbeitungsschritten ab.

Was kann ich tun, wenn OCR nur wenige Wörter erkennt?

Prüfen Sie, ob alle Sprachen des Scans ausgewählt sind. Ist die Spracheinstellung passend, kann ein zu unscharfer Scan der Grund für die geringe Erkennung sein.

Werden mehrseitige Tabellen als eine einzige Tabelle übernommen?

Eine Tabelle, die sich über mehrere PDF-Seiten erstreckt, wird nicht als eine durchgehende Word-Tabelle rekonstruiert. Tabellen ohne Linien lassen sich ebenfalls nicht immer fehlerfrei übernehmen.

Werden Formulare, Kommentare und Lesezeichen in Word übernommen?

Formularfelder, Kommentare und Lesezeichen werden nicht als solche in das Word-Dokument übernommen. Auch Vektorgrafiken wie Linien oder Diagramme werden nicht zu bearbeitbaren Zeichnungen.