# Extração OCR de documentos

Extraia texto OCR de scans e converta páginas ou imagens em Markdown, JSON, tabelas, legendas e blocos prontos para recuperacao com verificacao de qualidade.

> Página canônica: https://elysiatools.com/pt/hubs/document-ocr-extraction

- **Palavras-chave:** OCR de documentos, PDF escaneado para markdown, OCR para JSON, extracao de tabelas PDF, segmentacao documental para RAG

## Perguntas frequentes

### Todo PDF escaneado deve ir para OCR em Markdown?

Não. Se o PDF já tiver uma camada de texto confiavel, a extração direta costuma ser mais rapida e mais limpa.

### Quando um extrator especializado e melhor que OCR generico?

Quando campos especificos de recibos ou identidades importam mais que a fidelidade de paragrafos, porque a meta e JSON estruturado.

### Extração de tabelas substitui a revisao da pagina?

Não. Tabelas OCR costumam exigir verificacao na pagina original por causa de celulas mescladas, linhas quebradas, simbolos monetarios e cabecalhos deslocados.

### Por que segmentar depois da extração?

Segmentar OCR fraco cedo demais apenas espalha erros. Primeiro estabilize texto e estrutura, depois prepare para recuperacao.
