# Camada de texto OCR PDF

Adiciona camada OCR em PDF digitalizado para permitir busca e copia

> Página canônica: https://elysiatools.com/pt/tools/pdf-ocr-text-layer

- **Categoria:** PDF Tools

- **Palavras-chave:** pdf, ocr, tesseract, searchable, copyable, scan

## Visão geral

Rasteriza paginas em imagens, executa Tesseract por pagina e combina em um PDF com texto pesquisavel.

## Entradas

- **PDF de origem** (file): Upload scanned PDF
- **Idiomas OCR** (text): eng or eng+chi_sim
- **DPI de entrada** (number)
- **Modo do motor OCR** (number)
- **Modo de segmentacao da pagina** (number)

## Quando usar

- Quando você precisa pesquisar palavras-chave dentro de documentos digitalizados ou PDFs baseados em imagens.
- Ao precisar copiar e colar texto de contratos, recibos ou livros que foram escaneados.
- Para tornar arquivos PDF antigos ou arquivados compatíveis com sistemas de indexação e busca.

## Como funciona

- Envie seu arquivo PDF digitalizado para a plataforma.
- Configure os parâmetros de DPI e o idioma do documento para otimizar a precisão do reconhecimento.
- O sistema rasteriza as páginas em imagens e aplica o motor Tesseract para extrair o texto.
- Baixe o novo arquivo PDF que agora contém uma camada de texto sobreposta, pronta para busca e cópia.

## Casos de uso

- Digitalização de contratos e documentos jurídicos para busca rápida de cláusulas específicas.
- Conversão de livros e artigos acadêmicos escaneados em arquivos digitais acessíveis.
- Processamento de recibos e faturas para facilitar a extração de dados financeiros.

## Perguntas frequentes

### O que é OCR?

OCR significa Reconhecimento Óptico de Caracteres. É uma tecnologia que converte imagens de texto em texto editável e pesquisável.

### Quais idiomas são suportados?

A ferramenta suporta diversos idiomas através do motor Tesseract. Você pode especificar o idioma no campo de configuração, como 'eng' para inglês ou combinações como 'eng+por'.

### Qual DPI devo escolher?

Recomendamos 300 DPI para um equilíbrio ideal entre qualidade de reconhecimento e tamanho do arquivo. Use valores menores para documentos simples e maiores para textos pequenos ou complexos.

### O arquivo original é alterado?

Não, a ferramenta gera um novo arquivo PDF com a camada de texto adicionada, mantendo o seu arquivo original intacto.

### Existe limite de tamanho para o arquivo?

Sim, o limite para upload é de 500 MB por arquivo.

## Ferramentas relacionadas

- [Redução de Ruído PDF](https://elysiatools.com/pt/tools/pdf-denoise): Remove o ruído visual de páginas PDF digitalizadas — granulado tipo sal e pimenta, grão aleatório e velos de fundo pálidos — usando algoritmos reais de processamento de imagem. As páginas de texto são preservadas como conteúdo vetorial pesquisável.
- [OCR de PDF digitalizado para Word](https://elysiatools.com/pt/tools/scanned-pdf-ocr-to-word): Rasteriza páginas de PDF digitalizado, reconhece texto com Tesseract e exporta um DOCX editável.
- [Adicionar assinatura em PDF online](https://elysiatools.com/pt/tools/pdf-add-signature-online): Adiciona assinatura visivel em texto ou imagem a um PDF
- [Marca d'agua PDF em lote](https://elysiatools.com/pt/tools/pdf-batch-watermark): Aplica marcas d'agua de texto em varios PDFs com rotacao, opacidade e mosaico
- [Ponte de PDF (OCR) para JSON estruturado](https://elysiatools.com/pt/tools/ocr-pdf-to-structured-json-bridge): Extrai a camada de texto do PDF com geometria (linhas por posição y, tabelas por vaos de coluna, títulos por tamanho de fonte, pares chave-valor com dois pontos) e preenche campo a campo um JSON Schema do usuário — rótulos pareados por chaves normalizadas, valores coagidos aos tipos declarados e validados com ajv.
- [Endireitar PDF](https://elysiatools.com/pt/tools/pdf-deskew): Detecta e corrige automaticamente páginas PDF inclinadas. Preserva as páginas de texto como conteúdo vetorial pesquisável e rasteriza apenas as páginas de imagem (ex. digitalizações).
- [Removedor de ruido de cabecalho e rodape PDF](https://elysiatools.com/pt/tools/pdf-header-footer-noise-remover): Compara a extracao com e sem cabecalhos/rodapes para detectar ruido repetido no texto
- [HTML de email para PDF](https://elysiatools.com/pt/tools/libreoffice-html-mail-to-pdf): Renderiza conteudo HTML de email em PDF preservando formatacao basica

## Exemplos

- [Exemplos PDF](https://elysiatools.com/pt/samples/pdf-samples): Exemplos PDF gerados por ferramentas de 2026-02-01 a 2026-02-10
- [Exemplos de Apresentacoes Markdown](https://elysiatools.com/pt/samples/md-slide-deck-to-pdf): Decks Markdown estilo Remark/Marp para testar exportacao em PDF
- [Exemplos de Texto Misto Chinês-Inglês](https://elysiatools.com/pt/samples/text-chinese-english-mixed-samples): Arquivos de texto de amostra com conteúdo misto chinês-inglês para testar ferramentas de espaçamento automático
- [Amostras de Conversor de Maiúsculas/Minúsculas](https://elysiatools.com/pt/samples/text-case-formats): Amostras de teste para conversão de maiúsculas/minúsculas entre diferentes convenções de nomenclatura

## Conteúdo relacionado

- [Revisão de PDF para arquivo, acessibilidade e confianca](https://elysiatools.com/pt/hubs/pdf-archival-accessibility-trust): Limpe paginas digitalizadas, adicione OCR, prepare PDF/A, revise acessibilidade, crie marcadores e verifique assinaturas antes do arquivo.
- [Preparação de PDF para LLM e RAG](https://elysiatools.com/pt/hubs/pdf-llm-rag-prep): Transforme PDFs em entradas limpas, seguras e citaveis para resumo com LLM, embeddings, busca e RAG.
- [Extração OCR de documentos](https://elysiatools.com/pt/hubs/document-ocr-extraction): Extraia texto OCR de scans e converta páginas ou imagens em Markdown, JSON, tabelas, legendas e blocos prontos para recuperacao com verificacao de qualidade.
- [Fluxo de conversão, OCR e extração de PDF](https://elysiatools.com/pt/hubs/pdf-convert): Converta documentos, páginas wiki, comentarios e imagens em PDF, depois extraia texto, imagens, tabelas, estrutura ou OCR de PDFs existentes.
