OCR PDF

Pomocí OCR přidáte do skenovaného PDF neviditelnou textovou vrstvu, takže v něm můžete vyhledávat, označovat a kopírovat text. Obrázek stránky zůstane nezměněný, zachová se tedy původní vzhled dokumentu.

Váš soubor se nahraje přes zabezpečené připojení a zpracuje na našem serveru. Originál se smaže hned po zpracování, výsledek po 1 hodina (24 hodin ve vašem účtu).

Nahrajte jeden nebo více souborů PDF. Nástroj přijímá PDF, nikoli samostatné obrázky JPG či PNG. Zpracovat lze až 10 PDF najednou a pro všechny použít stejné nastavení.

Vyberte jazyky, které se v dokumentu skutečně vyskytují. Čeština je podporovaná a můžete zvolit až tři jazyky současně. Výchozí nastavení vybírá jazyk stránky a angličtinu. Text v nevybraném jazyce se může zobrazit jako nesmyslné znaky.

Podle potřeby ponechte zapnuté automatické otočení stránek naskenovaných bokem nebo vzhůru nohama a narovnání nakloněných stran. Stránky, které už obsahují skutečný text, se standardně přeskočí jako celek. Pokud potřebujete obnovit starou neviditelnou OCR vrstvu, zvolte opakované OCR. Skutečný text tím nebude nahrazen obrázkem, narovnání stránek však v tomto režimu není dostupné.

Spusťte zpracování a stáhněte prohledávatelné PDF. Volitelně lze uložit také rozpoznaný text jako TXT. Při zpracování více souborů je výsledek dostupný také jako ZIP.

Velikost a počet stran závisí na typu účtu. Bez přihlášení lze zpracovat PDF do 50 MB a 20 stran, přihlášení uživatelé mají limit 100 MB a 100 stran na dokument. Souběžně mohou běžet nejvýše dvě úlohy pro hosty a čtyři pro přihlášené uživatele. Zpracování jedné úlohy může na serveru trvat nejvýše 30 minut.

Rozpoznání obvykle zabere přibližně 2–10 sekund na stránku. Přesnost závisí na kvalitě skenu. Rukopis a složité tabulky nástroj nerozpoznává spolehlivě. Nástroj je zdarma a výsledek neobsahuje vodoznak. Registrace není nutná.

PDF se nahraje na server zabezpečeným připojením a po zpracování se smaže. Výsledné soubory jsou dostupné jednu hodinu pro hosty a 24 hodin pro přihlášené uživatele. PDF chráněné heslem lze zpracovat po zadání hesla, výstup se však uloží bez něj. Digitální podpis se po zpracování stane neplatným.

Časté dotazy

Jak poznám, že OCR text skutečně rozpoznalo?

Po dokončení se zobrazí počet rozpoznaných slov a stran i náhled textu z první strany. Pokud je slov málo, zkontrolujte zvolený jazyk a čitelnost skenu. Náhled se vytváří v prohlížeči z výsledného staženého souboru.

Co když dokument obsahuje text ve více jazycích?

Před spuštěním vyberte všechny jazyky, které se na stránkách objevují, nejvýše však tři. Automatické určení jazyka není k dispozici, proto se nespoléhejte na to, že nástroj sám doplní jazyk, který nebyl vybrán.

Zůstane heslo PDF uložené nebo se uchová v historii?

Ne. Heslo se použije pouze pro danou úlohu a po jejím dokončení se smaže. Historie zpracování může uchovat názvy a velikosti souborů i nastavení, nikoli samotné dokumenty, rozpoznaný text nebo hesla.

Lze výsledek převést na upravitelný dokument nebo PDF/A?

Ne. Výstupem je prohledávatelné PDF, případně samostatný soubor TXT. OCR zde nevytváří upravitelný dokument Word nebo tabulku Excel a výstup ve formátu PDF/A není k dispozici.