PDF OCR

OCR maakt scantekst doorzoekbaar en kopieerbaar. De afbeelding blijft gelijk, er komt een onzichtbare tekstlaag bij.

Je bestand wordt via een beveiligde verbinding geüpload en op onze server verwerkt. Het origineel wordt direct na de verwerking verwijderd, het resultaat na 1 uur (24 uur in je account).

Upload een PDF en kies handmatig de documenttalen. Standaard zijn de paginataal en Engels geselecteerd. De 11 talen zijn English, Español, Português, Italiano, Français, Deutsch, Polski, Русский, Türkçe, Čeština en Nederlands. Kies maximaal 3, inclusief alle talen in de PDF, niet-geselecteerde talen kunnen onleesbare tekst opleveren.

Pagina’s met echte tekst worden standaard overgeslagen. Wil je een bestaande OCR-tekstlaag vervangen, kies dan de instelling om OCR opnieuw uit te voeren. Echte tekst wordt daarbij niet omgezet in een afbeelding.

Scheve scans kunnen worden rechtgezet en pagina’s die zijwaarts of ondersteboven staan, automatisch rechtop gezet. Rechtzetten is niet beschikbaar als je een bestaande OCR-laag vervangt.

Start de herkenning zodra de instellingen kloppen. Na afloop zie je hoeveel woorden op hoeveel pagina’s zijn herkend. Download het resultaat voordat de downloadlink verloopt.

Per PDF geldt een limiet van 50 MB en 20 pagina’s voor gasten, geregistreerde gebruikers kunnen bestanden tot 100 MB en 100 pagina’s verwerken. Gasten hebben maximaal 2 gelijktijdige taken, geregistreerde gebruikers 4. Registreren is niet nodig en er wordt geen watermerk toegevoegd.

OCR duurt ongeveer 2–10 seconden per pagina. De herkenningskwaliteit hangt af van de scan, handschrift en complexe tabellen worden niet betrouwbaar herkend. Automatische taaldetectie is niet beschikbaar, dus controleer de gekozen talen als de tekst niet klopt.

De PDF wordt via een beveiligde verbinding geüpload en direct na verwerking verwijderd. Resultaten zijn 1 uur beschikbaar voor gasten en 24 uur voor geregistreerde gebruikers. Voor een met wachtwoord beveiligde PDF moet je het wachtwoord invoeren, de uitvoer is onbeveiligd. Verwerking maakt een digitale handtekening ongeldig.

Veelgestelde vragen

Kan ik de herkende tekst ook als TXT-bestand opslaan?

Ja. Je kunt naast de doorzoekbare PDF een apart TXT-bestand met de herkende tekst laten maken. Dat is handig als je de tekst buiten de PDF wilt doorzoeken of overnemen.

Kan ik OCR toepassen op meerdere PDF-bestanden tegelijk?

Ja, je kunt maximaal 10 PDF’s in één keer toevoegen. Dezelfde instellingen worden op alle bestanden toegepast. Bij meerdere bestanden is ook een ZIP-download beschikbaar.

Wat gebeurt er als een pagina al echte tekst bevat?

Standaard wordt zo’n pagina helemaal overgeslagen, ook als er daarnaast een scan op staat. Als je een bestaande onzichtbare OCR-tekstlaag wilt vervangen, kies je de instelling voor het opnieuw uitvoeren van OCR.

Blijft de afbeelding van elke pagina hetzelfde?

Ja. OCR voegt een onzichtbare tekstlaag toe, maar verandert de pagina-afbeelding of het paginaformaat niet.