# Extrator de revisao com tachado em PDF

Detecta texto riscado em PDFs revisados e gera um relatorio para contratos e revisoes

> Página canônica: https://elysiatools.com/pt/tools/pdf-strikethrough-review-extractor

- **Categoria:** Developer Tools

- **Palavras-chave:** pdf, strikethrough, review

## Visão geral

Depois de enviar um PDF, a ferramenta ativa a deteccao de tachado do OpenDataLoader e extrai texto removido ou marcado para revisao das saidas JSON e Markdown para verificar diferencas rapidamente.

## Entradas

- **Arquivo PDF** (file)
- **Paginas** (text): e.g. 1,3,5-7
- **Usar arvore estrutural** (checkbox)

## Quando usar

- Ao revisar contratos jurídicos onde cláusulas foram removidas manualmente com marcações de tachado.
- Durante a auditoria de políticas internas para identificar trechos obsoletos marcados para exclusão em rascunhos.
- No fluxo editorial para comparar versões de manuscritos e verificar o que foi descartado pelo revisor antes da publicação.

## Como funciona

- Carregue o arquivo PDF que contém as marcações de texto riscado (strikethrough) na interface.
- Defina o intervalo de páginas específico ou processe o documento inteiro utilizando a árvore estrutural para maior precisão na detecção.
- O motor OpenDataLoader analisa as camadas do PDF para detectar a formatação de tachado aplicada aos caracteres.
- A ferramenta gera um relatório HTML consolidando todo o conteúdo removido para conferência rápida e precisa.

## Casos de uso

- Comparação de minutas contratuais para identificar termos removidos pela contraparte durante negociações.
- Revisão de manuais técnicos para validar a exclusão de procedimentos antigos marcados para remoção.
- Auditoria de conformidade em documentos regulatórios para rastrear mudanças em rascunhos de políticas.

## Perguntas frequentes

### O que a ferramenta extrai exatamente?

Ela extrai apenas o texto que possui a formatação visual de tachado (riscado) detectada nos metadados do PDF.

### Posso processar apenas algumas páginas do documento?

Sim, utilize o campo 'Páginas' para especificar números ou intervalos como '1, 3, 5-7'.

### O que é a opção 'Usar árvore estrutural'?

É um recurso que utiliza a hierarquia interna do PDF para melhorar a precisão da detecção e extração do texto.

### Qual o formato do resultado final?

O resultado é entregue em formato HTML, permitindo visualizar o texto extraído de forma organizada no navegador.

### A ferramenta funciona com PDFs digitalizados como imagem?

A detecção depende de metadados de texto; PDFs que são apenas imagens sem camada de texto OCR não são suportados.

## Ferramentas relacionadas

- [Gerador de relatorio de auditoria de acessibilidade](https://elysiatools.com/pt/tools/accessibility-audit-report-generator): Audita HTML ou URL em busca de problemas comuns de WCAG e exporta um PDF estruturado
- [Removedor de ruido de cabecalho e rodape PDF](https://elysiatools.com/pt/tools/pdf-header-footer-noise-remover): Compara a extracao com e sem cabecalhos/rodapes para detectar ruido repetido no texto
- [Inspetor de PDF marcado](https://elysiatools.com/pt/tools/tagged-pdf-inspector): Compara a extracao com e sem StructTree para ver se o PDF possui estrutura marcada util
- [Extrator de intervalo de paginas PDF](https://elysiatools.com/pt/tools/pdf-page-range-extractor): Extrai apenas um intervalo de paginas PDF e o exporta como Markdown, JSON ou texto
- [Analisador de PDF com formulas e graficos](https://elysiatools.com/pt/tools/formula-chart-heavy-pdf-analyzer): Compara a extracao local e hybrid do OpenDataLoader para identificar paginas que merecem parsing assistido por IA
- [Ponte de PDF (OCR) para JSON estruturado](https://elysiatools.com/pt/tools/ocr-pdf-to-structured-json-bridge): Extrai a camada de texto do PDF com geometria (linhas por posição y, tabelas por vaos de coluna, títulos por tamanho de fonte, pares chave-valor com dois pontos) e preenche campo a campo um JSON Schema do usuário — rótulos pareados por chaves normalizadas, valores coagidos aos tipos declarados e validados com ajv.
- [Extrator de imagens e captions PDF](https://elysiatools.com/pt/tools/pdf-image-caption-extractor): Extrai imagens PDF, relaciona captions proximas e gera um indice HTML navegavel
- [Validador de árvore de estrutura lógica PDF (mapeamento WCAG)](https://elysiatools.com/pt/tools/pdf-logical-structure-tree-validator): Audita a árvore de estrutura lógica PDF/UA-1: se o RoleMap termina em tipos padrão, se H1–H6 saltam níveis ou se o primeiro título não é H1, se Figure/Formula carecem de Alt, se a cadeia de idioma é determinável e se a ordem MCID estrutura/conteúdo diverge; inclui árvore e pontos de verificação Matterhorn.

## Exemplos

- [Exemplos PDF](https://elysiatools.com/pt/samples/pdf-samples): Exemplos PDF gerados por ferramentas de 2026-02-01 a 2026-02-10
- [Exemplos de Apresentacoes Markdown](https://elysiatools.com/pt/samples/md-slide-deck-to-pdf): Decks Markdown estilo Remark/Marp para testar exportacao em PDF
- [Amostras de Extrator de Log de Alterações](https://elysiatools.com/pt/samples/changelog-extractor): Vários formatos de log de alterações para testar ferramentas de análise e extração
- [Exemplos de Extrator de Números de Telefone](https://elysiatools.com/pt/samples/phone-number-extractor): Coleção de texto misto contendo números de telefone de vários países para testes de extração

## Conteúdo relacionado

- [Fluxos de extracao e depuracao de PDF](https://elysiatools.com/pt/hubs/pdf-extraction-debugging-workflows): Depure PDFs dificeis verificando criptografia, seguranca, paginas, ordem de leitura, OCR, tabelas e saidas estruturadas.
- [Preparação de PDF para LLM e RAG](https://elysiatools.com/pt/hubs/pdf-llm-rag-prep): Transforme PDFs em entradas limpas, seguras e citaveis para resumo com LLM, embeddings, busca e RAG.
