CarePDF Logo
CarePDF Logo

PDF con OCR

Extraiga la capa de texto de un PDF para poder buscar, copiar o reutilizar el contenido.

Select PDF files

or drag and drop files here

Got a password-protected PDF? Unlock it here first

How to PDF OCR: extraer texto

1

Upload your scanned document

Select a PDF that consists of scanned pages or images of text.

2

Select output format

Choose whether you want a fully searchable PDF or a plain, editable text file.

3

Extract text

The Optical Character Recognition (OCR) engine reads the image and converts it back into machine-readable text.

Frequently Asked Questions

¿Funciona esto en documentos escaneados que son solo fotografías de texto?
Esta herramienta lee capas de texto que ya están incrustadas en un PDF utilizando el motor pdf.js, por lo que funciona mejor en archivos PDF que ya contienen texto real. Un escaneo de solo imagen sin capa de texto necesita reconocimiento óptico completo de caracteres, lo que requiere procesamiento del lado del servidor (como Tesseract OCR) en lugar de la extracción en el navegador que realiza esta herramienta.
¿Cómo sé si mi PDF ya tiene una capa de texto?
Intente seleccionar o resaltar texto en la página en un visor de PDF normal; si puede seleccionar palabras individuales, habrá una capa de texto presente y esta herramienta la extraerá limpiamente.
¿Qué formatos de salida puedo elegir?
Elija un PDF con capacidad de búsqueda si desea mantener el aspecto original y al mismo tiempo hacer que el contenido se pueda seleccionar y buscar, o un archivo de texto sin formato si solo necesita las palabras sin formato para pegarlas en otro lugar.
¿Esto maneja notas escritas a mano?
No, esta herramienta extrae capas de texto digital existentes en lugar de realizar un reconocimiento de caracteres basado en imágenes, por lo que la escritura a mano no es algo que se pueda leer.
¿Mi documento se procesa en sus servidores?
No, la extracción de texto ocurre completamente dentro de su navegador usando pdf.js, por lo que el contenido de su documento nunca se carga en ninguna parte.

Explore More PDF Tools