OCR PDF
Rozpoznaj tekst koreański i angielski w zeskanowanych plikach PDF i utwórz przeszukiwalny PDF oraz plik tekstowy.
To narzędzie nie przesyła Twoich plików. Zamknij kartę i nic nie zostanie.
Przeciągnij i upuść pliki tutaj lub
Wybierz plikiObsługiwane: PDF · lub wklej za pomocą Ctrl+V
W skanie nic się nie wyszukuje
W folderze ze zeskanowanymi umowami leży trzydzieści plików, a wyszukiwanie numeru umowy nie zwraca niczego, bo w skanie nie ma zapisanych liter, są obrazy liter. Rozpoznawanie tekstu ogląda te obrazy i zapisuje, jakie znaki na nich widać. Dopiero potem dokument da się przeszukiwać, a tekst skopiować.
Ważne ograniczenie na wstępie: do wyboru są koreański z angielskim, sam angielski, sam koreański, japoński z angielskim oraz chiński uproszczony z angielskim, a polskiego na tej liście nie ma. Materiały po polsku nie są więc rozpoznawane wiarygodnie, a przy ogonkach, kreskowanych literach i nazwach własnych wynik bywa wręcz bezużyteczny. Tam, gdzie język pasuje, wszystko zależy od materiału wyjściowego: około 300 dpi, kartka prosto ułożona, równomiernie oświetlona, z wyraźnym kontrastem. Strony sfotografowane telefonem, z cieniem, wybrzuszeniem i skośną perspektywą, wypadają zauważalnie gorzej niż skan płaski, a pisma odręcznego narzędzie nie odczyta w ogóle.
Na wyjściu dostajesz albo sam tekst, albo przeszukiwalny PDF, w którym obraz strony pozostaje widoczny bez zmian, a rozpoznane znaki leżą pod nim niewidocznie; dokument wygląda więc jak wcześniej, ale reaguje na wyszukiwanie. Jeśli w pliku jest już prawdziwy tekst, zwykły eksport tekstu będzie dokładniejszy, szybszy i bezbłędny. Rozpoznawanie działa w całości w przeglądarce na twoim urządzeniu, dokument nie jest wysyłany do analizy w chmurze, co ma znaczenie przy dowodach, umowach i dokumentacji medycznej.
Jak używać
- 1
Wybierz zeskanowany PDF.
- 2
Sprawdź języki i kliknij Start.
- 3
Pobierz przeszukiwalny PDF i plik .txt.
Najczęściej zadawane pytania
- Ile to trwa?
- Około 3–10 sekund na stronę. Pierwsze uruchomienie pobiera ~4 MB danych językowych.
- Dokładność?
- Wysoka dla czystych wydruków, niższa dla rozmytych skanów lub pisma odręcznego. Struktura tabel nie jest rozpoznawana.