OCR PDF
Zamień zeskanowany PDF w dokument, w którym wyszukasz i skopiujesz tekst. OCR dodaje niewidoczną warstwę tekstową bez zmiany obrazu i rozmiaru stron.
Twój plik jest przesyłany przez bezpieczne połączenie i przetwarzany na naszym serwerze. Oryginał jest usuwany zaraz po przetworzeniu, a wynik po 1 godzina (24 godziny na koncie).
Prześlij jeden lub kilka plików PDF. Możesz dodać maksymalnie 10 dokumentów i zastosować te same ustawienia do wszystkich. Narzędzie przyjmuje tylko pliki PDF, nie obrazy JPG ani PNG.
Wybierz język lub języki dokumentu: maksymalnie trzy spośród jedenastu. Domyślnie ustawione są język strony i angielski. Jeśli dokument zawiera tekst w niewybranym języku, może on zostać rozpoznany błędnie.
W razie potrzeby włącz automatyczne obracanie stron zeskanowanych bokiem lub do góry nogami oraz prostowanie przekrzywionych stron. Domyślnie strony z istniejącym tekstem są pomijane, a OCR obejmuje strony zeskanowane. Możesz zastąpić starą, niewidoczną warstwę OCR nową, na przykład po zmianie języka. W tym trybie prostowanie jest niedostępne.
Uruchom OCR. Po zakończeniu pobierz przeszukiwalny PDF. Dodatkowy plik TXT jest tworzony domyślnie, chyba że wyłączysz jego zapis. Wyniki nazywają się „nazwa-ocr.pdf” i „nazwa.txt”, przy kilku dokumentach dostępne jest również archiwum ZIP.
OCR PDF po polsku ułatwia wyszukiwanie i kopiowanie tekstu ze skanów, nie zmieniając wyglądu stron. Dokładność zależy od jakości skanu, pismo odręczne i złożone tabele mogą być rozpoznane niedokładnie. Narzędzie nie poprawia jakości skanu ani nie czyści tła. Rozpoznawanie trwa około 2–10 sekund na stronę.
Bez logowania możesz przetwarzać pliki do 50 MB i 20 stron. Po zalogowaniu limity wynoszą 100 MB i 100 stron na plik. Wynik nie ma znaku wodnego. Przesłany PDF jest usuwany po przetworzeniu, wyniki są przechowywane godzinę dla gości i 24 godziny dla zalogowanych.
Podaj hasło, jeśli PDF jest chroniony. Wynik zostanie zapisany bez hasła, a OCR unieważnia podpis cyfrowy.
FAQ
Co się stanie, jeśli wszystkie strony PDF mają już tekst?
Narzędzie poinformuje, że nie rozpoznano tekstu, ponieważ wszystkie strony już go zawierają. Jeśli chcesz zastąpić wcześniejszą warstwę OCR, wybierz tryb ponownego rozpoznawania.
Czy zobaczę, ile tekstu udało się rozpoznać?
Po zakończeniu zobaczysz liczbę rozpoznanych słów i stron oraz podgląd tekstu z pierwszej strony. Jeśli wynik zawiera niewiele słów, sprawdź, czy wybrane języki pasują do dokumentu i czy skan nie jest zbyt rozmazany.
Czy mogę pobrać wynik ponownie?
Zalogowani użytkownicy mogą ponownie pobrać wynik z historii przetwarzania przez 24 godziny. Historia zawiera nazwy plików, ich rozmiary i ustawienia, ale nie przechowuje dokumentów, rozpoznanego tekstu ani haseł.
Czy mogę zapisać wynik w PDF/A albo edytować go w Wordzie?
Nie. Wynikiem jest przeszukiwalny PDF, a opcjonalnie także osobny plik TXT. Narzędzie nie udostępnia konwersji do edytowalnego dokumentu Word ani zapisu w formacie PDF/A.