CarePDF Logo
CarePDF Logo

OCR PDF

Extraia a camada de texto de um PDF para pesquisar, copiar ou reutilizar o conteúdo.

Select PDF files

or drag and drop files here

Got a password-protected PDF? Unlock it here first

How to OCR PDF – Extrair Texto

1

Upload your scanned document

Select a PDF that consists of scanned pages or images of text.

2

Select output format

Choose whether you want a fully searchable PDF or a plain, editable text file.

3

Extract text

The Optical Character Recognition (OCR) engine reads the image and converts it back into machine-readable text.

Frequently Asked Questions

Does this work on scanned documents that are just photos of text?
Esta ferramenta lê camadas de texto que já estão incorporadas em um PDF usando o mecanismo pdf.js, por isso funciona melhor em PDFs que já contêm texto real. Uma digitalização pura apenas de imagem, sem camada de texto, precisa de reconhecimento óptico completo de caracteres, o que requer processamento no lado do servidor (como Tesseract OCR) em vez da extração no navegador que esta ferramenta executa.
How do I know if my PDF already has a text layer?
Try selecting or highlighting text on the page in a normal PDF viewer — if you can select individual words, there's a text layer present and this tool will extract it cleanly.
Quais formatos de saída posso escolher?
Pick a searchable PDF if you want to keep the original look while making the content selectable and searchable, or a plain text file if you just need the raw words to paste elsewhere.
Isso lida com notas manuscritas?
Não, esta ferramenta extrai camadas de texto digital existentes em vez de realizar o reconhecimento de caracteres baseado em imagem, portanto, a escrita à mão não é algo que possa ser lida.
Meu documento é processado em seus servidores?
No, text extraction happens entirely inside your browser using pdf.js, so your document's content is never uploaded anywhere.

Explore More PDF Tools