PDF a texto

Extrae la capa de texto de un PDF a un archivo .txt. Los PDF escaneados (solo imagen) no producen texto.

Esta herramienta no sube tus archivos. Cierra la pestaña y no queda nada.

Arrastra y suelta archivos aquí, o

Elegir archivos

Compatibles: PDF · o pega con Ctrl+V

Solo el texto, sin el formato

Hay tareas en las que el diseño estorba: pegar el articulado de una norma en un correo, contar las palabras de un informe, buscar un término en veinte documentos o alimentar una hoja de cálculo. El PDF tiene lo que se necesita, pero copiarlo página por página es lento y arrastra saltos de línea raros.

La extracción devuelve un archivo .txt codificado en UTF-8, así que acentos, eñes y signos de apertura se conservan. El orden de lectura depende de cómo se generó el PDF: en un documento a dos columnas o con notas al margen, las líneas pueden quedar entremezcladas y conviene revisarlo. Tablas, negritas y saltos de página no sobreviven, porque el texto plano no los contempla.

En un PDF escaneado el resultado será un archivo vacío: ahí no hay caracteres, hay una imagen de caracteres. Ese caso corresponde a la herramienta de OCR, que reconoce las letras y entonces sí entrega texto. Todo ocurre en el navegador, sin subir el documento y sin guardar copia alguna.

Cómo se usa

  1. 1

    Selecciona un PDF.

  2. 2

    Opcionalmente define un rango de páginas.

  3. 3

    Pulsa Empezar y descarga el resultado.

Preguntas frecuentes

El resultado está vacío.
Los PDF escaneados no tienen capa de texto. Usa la herramienta de conversión con IA para esos.
Los saltos de línea se ven raros.
Los PDF no guardan la estructura de líneas; se infiere de las posiciones. Los diseños a varias columnas pueden mezclarse.

Herramientas relacionadas