PDF in testo
Estrai il livello di testo di un PDF in un file .txt. I PDF scansionati (solo immagini) non producono testo.
Questo strumento non carica i tuoi file. Chiudi la scheda e non resta nulla.
Trascina qui i file, oppure
Scegli fileSupportati: PDF · oppure incolla con Ctrl+V
Solo il testo, senza impaginazione
Ci sono lavori in cui la formattazione è solo d'intralcio: incollare un articolo di regolamento in una mail, contare le parole di una relazione, cercare un termine in venti documenti o portare il contenuto in un foglio di calcolo. Il PDF contiene quello che serve, ma copiarlo pagina per pagina è lento e trascina a capo indesiderati.
L'estrazione restituisce un file .txt codificato in UTF-8, quindi accenti e apostrofi vengono conservati. L'ordine di lettura dipende da come il PDF è stato generato: su un documento a due colonne o con note a margine le righe possono mescolarsi e vale la pena rileggere. Tabelle, grassetti e interruzioni di pagina non sopravvivono, perché il testo semplice non li prevede.
Su un PDF scansionato il risultato sarà un file vuoto: lì non ci sono caratteri, c'è l'immagine dei caratteri. Quel caso è di competenza dell'OCR, che riconosce le lettere e solo allora produce testo. Tutto viene eseguito nel browser, senza caricamenti e senza copie conservate.
Come si usa
- 1
Seleziona un PDF.
- 2
Imposta facoltativamente un intervallo di pagine.
- 3
Clicca su Avvia e scarica il risultato.
Domande frequenti
- Il risultato è vuoto.
- I PDF scansionati non hanno un livello di testo. Per questi usa lo strumento di conversione AI.
- Le interruzioni di riga sembrano strane.
- I PDF non memorizzano la struttura delle righe; viene dedotta dalle posizioni. I layout a più colonne possono mescolarsi.