OCR
Reconoce texto en coreano e inglés en PDF escaneados y genera un PDF con texto buscable más un archivo de texto.
Esta herramienta no sube tus archivos. Cierra la pestaña y no queda nada.
Arrastra y suelta archivos aquí, o
Elegir archivosCompatibles: PDF · o pega con Ctrl+V
Un escaneo donde la búsqueda no encuentra nada
Un contrato de hace diez años que solo existe en papel, un expediente que llegó escaneado o un documento digitalizado y guardado en PDF: se lee perfectamente, pero Ctrl+F no devuelve ningún resultado. Para el equipo esas páginas son fotografías, así que no hay forma de buscar una cláusula, copiar un párrafo ni revisar varios archivos a la vez.
El reconocimiento se elige entre varias combinaciones de idiomas —coreano e inglés, inglés, coreano, japonés e inglés, chino simplificado e inglés— y el español no está entre ellas, así que de un documento en español no se obtiene un resultado aprovechable. Dentro de los idiomas admitidos, la precisión depende casi por completo de la calidad del escaneo: unos 300 ppp, la hoja recta y con luz uniforme. Puede obtener el resultado como texto plano o como un PDF con una capa de texto invisible sobre la imagen, que conserva el aspecto original y ya permite buscar.
Ningún OCR es infalible: conviene revisar cifras, nombres propios y cualquier dato que vaya a reutilizar. Si el PDF ya contiene texto real, porque se generó desde un programa y no desde un papel, la extracción de texto es más rápida y más exacta. El reconocimiento se ejecuta en su navegador, así que los documentos sensibles no salen del equipo.
Cómo se usa
- 1
Selecciona un PDF escaneado.
- 2
Comprueba los idiomas y pulsa Empezar.
- 3
Descarga el PDF buscable y el .txt.
Preguntas frecuentes
- ¿Cuánto tarda?
- Unos 3–10 segundos por página. La primera ejecución descarga ~4 MB de datos de idioma.
- ¿Precisión?
- Alta para impresiones limpias, menor para escaneos borrosos o texto manuscrito. No se reconoce la estructura de tablas.