CarePDF Logo
CarePDF Logo

OCR PDF

Extreu la capa de text d'un PDF perquè pugueu cercar, copiar o reutilitzar el contingut.

Select PDF files

or drag and drop files here

Got a password-protected PDF? Unlock it here first

How to OCR PDF: extreu text

1

Upload your scanned document

Select a PDF that consists of scanned pages or images of text.

2

Select output format

Choose whether you want a fully searchable PDF or a plain, editable text file.

3

Extract text

The Optical Character Recognition (OCR) engine reads the image and converts it back into machine-readable text.

Frequently Asked Questions

Funciona això en documents escanejats que són només fotos de text?
Aquesta eina llegeix capes de text que ja estan incrustades en un PDF mitjançant el motor pdf.js, de manera que funciona millor en PDF que ja contenen text real. Una exploració d'imatge pura sense cap capa de text necessita un reconeixement òptic complet de caràcters, que requereix un processament del servidor (com Tesseract OCR) en lloc de l'extracció dins del navegador que realitza aquesta eina.
How do I know if my PDF already has a text layer?
Proveu de seleccionar o ressaltar text a la pàgina en un visualitzador de PDF normal; si podeu seleccionar paraules individuals, hi ha una capa de text present i aquesta eina l'extreurà netament.
What output formats can I choose?
Trieu un PDF cercable si voleu mantenir l'aspecte original mentre feu que el contingut es pugui seleccionar i cercar, o un fitxer de text senzill si només necessiteu les paraules en brut per enganxar-les a un altre lloc.
Does this handle handwritten notes?
No, aquesta eina extreu les capes de text digital existents en lloc de realitzar un reconeixement de caràcters basat en imatges, de manera que l'escriptura a mà no és una cosa que es pugui llegir.
Is my document processed on your servers?
No, text extraction happens entirely inside your browser using pdf.js, so your document's content is never uploaded anywhere.

Explore More PDF Tools