OCR PDF

Rozpoznaj tekst koreański i angielski w zeskanowanych plikach PDF i utwórz przeszukiwalny PDF oraz plik tekstowy.

To narzędzie nie przesyła Twoich plików. Zamknij kartę i nic nie zostanie.

Przeciągnij i upuść pliki tutaj lub

Wybierz pliki

Obsługiwane: PDF · lub wklej za pomocą Ctrl+V

W skanie nic się nie wyszukuje

W folderze ze zeskanowanymi umowami leży trzydzieści plików, a wyszukiwanie numeru umowy nie zwraca niczego, bo w skanie nie ma zapisanych liter, są obrazy liter. Rozpoznawanie tekstu ogląda te obrazy i zapisuje, jakie znaki na nich widać. Dopiero potem dokument da się przeszukiwać, a tekst skopiować.

Ważne ograniczenie na wstępie: do wyboru są koreański z angielskim, sam angielski, sam koreański, japoński z angielskim oraz chiński uproszczony z angielskim, a polskiego na tej liście nie ma. Materiały po polsku nie są więc rozpoznawane wiarygodnie, a przy ogonkach, kreskowanych literach i nazwach własnych wynik bywa wręcz bezużyteczny. Tam, gdzie język pasuje, wszystko zależy od materiału wyjściowego: około 300 dpi, kartka prosto ułożona, równomiernie oświetlona, z wyraźnym kontrastem. Strony sfotografowane telefonem, z cieniem, wybrzuszeniem i skośną perspektywą, wypadają zauważalnie gorzej niż skan płaski, a pisma odręcznego narzędzie nie odczyta w ogóle.

Na wyjściu dostajesz albo sam tekst, albo przeszukiwalny PDF, w którym obraz strony pozostaje widoczny bez zmian, a rozpoznane znaki leżą pod nim niewidocznie; dokument wygląda więc jak wcześniej, ale reaguje na wyszukiwanie. Jeśli w pliku jest już prawdziwy tekst, zwykły eksport tekstu będzie dokładniejszy, szybszy i bezbłędny. Rozpoznawanie działa w całości w przeglądarce na twoim urządzeniu, dokument nie jest wysyłany do analizy w chmurze, co ma znaczenie przy dowodach, umowach i dokumentacji medycznej.

Jak używać

  1. 1

    Wybierz zeskanowany PDF.

  2. 2

    Sprawdź języki i kliknij Start.

  3. 3

    Pobierz przeszukiwalny PDF i plik .txt.

Najczęściej zadawane pytania

Ile to trwa?
Około 3–10 sekund na stronę. Pierwsze uruchomienie pobiera ~4 MB danych językowych.
Dokładność?
Wysoka dla czystych wydruków, niższa dla rozmytych skanów lub pisma odręcznego. Struktura tabel nie jest rozpoznawana.

Powiązane narzędzia