PDF a texto
Extrae la capa de texto de un PDF a un archivo .txt. Los PDF escaneados (solo imagen) no producen texto.
Esta herramienta no sube tus archivos. Cierra la pestaña y no queda nada.
Arrastra y suelta archivos aquí, o
Elegir archivosCompatibles: PDF · o pega con Ctrl+V
Solo el texto, sin el formato
Hay tareas en las que el diseño estorba: pegar el articulado de una norma en un correo, contar las palabras de un informe, buscar un término en veinte documentos o alimentar una hoja de cálculo. El PDF tiene lo que se necesita, pero copiarlo página por página es lento y arrastra saltos de línea raros.
La extracción devuelve un archivo .txt codificado en UTF-8, así que acentos, eñes y signos de apertura se conservan. El orden de lectura depende de cómo se generó el PDF: en un documento a dos columnas o con notas al margen, las líneas pueden quedar entremezcladas y conviene revisarlo. Tablas, negritas y saltos de página no sobreviven, porque el texto plano no los contempla.
En un PDF escaneado el resultado será un archivo vacío: ahí no hay caracteres, hay una imagen de caracteres. Ese caso corresponde a la herramienta de OCR, que reconoce las letras y entonces sí entrega texto. Todo ocurre en el navegador, sin subir el documento y sin guardar copia alguna.
Cómo se usa
- 1
Selecciona un PDF.
- 2
Opcionalmente define un rango de páginas.
- 3
Pulsa Empezar y descarga el resultado.
Preguntas frecuentes
- El resultado está vacío.
- Los PDF escaneados no tienen capa de texto. Usa la herramienta de conversión con IA para esos.
- Los saltos de línea se ven raros.
- Los PDF no guardan la estructura de líneas; se infiere de las posiciones. Los diseños a varias columnas pueden mezclarse.