PDF in testo

Estrai il livello di testo di un PDF in un file .txt. I PDF scansionati (solo immagini) non producono testo.

Questo strumento non carica i tuoi file. Chiudi la scheda e non resta nulla.

Trascina qui i file, oppure

Scegli file

Supportati: PDF · oppure incolla con Ctrl+V

Solo il testo, senza impaginazione

Ci sono lavori in cui la formattazione è solo d'intralcio: incollare un articolo di regolamento in una mail, contare le parole di una relazione, cercare un termine in venti documenti o portare il contenuto in un foglio di calcolo. Il PDF contiene quello che serve, ma copiarlo pagina per pagina è lento e trascina a capo indesiderati.

L'estrazione restituisce un file .txt codificato in UTF-8, quindi accenti e apostrofi vengono conservati. L'ordine di lettura dipende da come il PDF è stato generato: su un documento a due colonne o con note a margine le righe possono mescolarsi e vale la pena rileggere. Tabelle, grassetti e interruzioni di pagina non sopravvivono, perché il testo semplice non li prevede.

Su un PDF scansionato il risultato sarà un file vuoto: lì non ci sono caratteri, c'è l'immagine dei caratteri. Quel caso è di competenza dell'OCR, che riconosce le lettere e solo allora produce testo. Tutto viene eseguito nel browser, senza caricamenti e senza copie conservate.

Come si usa

  1. 1

    Seleziona un PDF.

  2. 2

    Imposta facoltativamente un intervallo di pagine.

  3. 3

    Clicca su Avvia e scarica il risultato.

Domande frequenti

Il risultato è vuoto.
I PDF scansionati non hanno un livello di testo. Per questi usa lo strumento di conversione AI.
Le interruzioni di riga sembrano strane.
I PDF non memorizzano la struttura delle righe; viene dedotta dalle posizioni. I layout a più colonne possono mescolarsi.

Strumenti correlati