OCR PDF
Riconosci testo coreano e inglese nei PDF scansionati e produci un PDF ricercabile più un file di testo.
Questo strumento non carica i tuoi file. Chiudi la scheda e non resta nulla.
Trascina qui i file, oppure
Scegli fileSupportati: PDF · oppure incolla con Ctrl+V
Una scansione dove la ricerca non trova nulla
Un contratto di dieci anni fa che esiste solo su carta, un fascicolo arrivato scansionato, una comunicazione digitalizzata e salvata in PDF: il documento si legge benissimo, ma Ctrl+F non restituisce niente. Per il computer quelle pagine sono fotografie, quindi non si può cercare una clausola, copiare un passaggio o controllare più file insieme.
Il riconoscimento si sceglie tra alcune combinazioni di lingue —coreano e inglese, inglese, coreano, giapponese e inglese, cinese semplificato e inglese— e l'italiano non è tra queste: da un documento in italiano non si ottiene un risultato utilizzabile. Nelle lingue supportate la precisione dipende quasi interamente dalla qualità della scansione, cioè circa 300 dpi, foglio dritto e illuminazione uniforme. Il risultato può essere testo semplice oppure un PDF con uno strato di testo invisibile sovrapposto all'immagine, che mantiene l'aspetto originale e diventa ricercabile.
Nessun OCR è infallibile: ricontrolla cifre, nomi propri e qualsiasi dato destinato a essere riutilizzato. Se il PDF contiene già testo vero, perché generato da un programma e non da uno scanner, l'estrazione di testo è più rapida e più esatta. Il riconoscimento viene eseguito nel browser, quindi i documenti riservati non escono dal tuo computer.
Come si usa
- 1
Seleziona un PDF scansionato.
- 2
Controlla le lingue e clicca su Avvia.
- 3
Scarica il PDF ricercabile e il file .txt.
Domande frequenti
- Quanto tempo ci vuole?
- Circa 3–10 secondi per pagina. La prima esecuzione scarica ~4 MB di dati linguistici.
- Precisione?
- Alta per stampe pulite, più bassa per scansioni sfocate o scrittura a mano. La struttura delle tabelle non viene riconosciuta.