# Extractor de revision con tachado PDF

Detecta texto tachado en PDFs de revision y genera un informe para contratos, politicas y borradores

> Página canónica: https://elysiatools.com/es/tools/pdf-strikethrough-review-extractor

- **Categoría:** Developer Tools

- **Palabras clave:** pdf, strikethrough, review

## Descripción general

Tras subir un PDF, la herramienta activa la deteccion de tachado de OpenDataLoader y extrae texto marcado como eliminado desde JSON y Markdown para revisar cambios rapidamente.

## Entradas

- **Archivo PDF** (file)
- **Paginas** (text): e.g. 1,3,5-7
- **Usar arbol estructural** (checkbox)

## Cuándo usarlo

- Al auditar cambios en contratos legales donde las cláusulas eliminadas no están documentadas en un registro de cambios formal.
- Durante la revisión editorial de manuscritos o políticas internas para verificar qué contenido específico se ha descartado.
- Para comparar versiones de documentos técnicos cuando solo se dispone del archivo PDF con marcas de revisión visuales.

## Cómo funciona

- Sube el archivo PDF que contiene el texto con formato de tachado digital.
- Define el rango de páginas específico o procesa el documento completo utilizando el árbol estructural para mayor precisión.
- El motor de detección identifica los elementos de texto asociados al estilo de tachado mediante OpenDataLoader.
- Se genera un informe en formato HTML que lista de forma organizada todo el contenido extraído que fue marcado para eliminación.

## Casos de uso

- Revisión de contratos legales para identificar términos y condiciones eliminados durante la fase de negociación.
- Auditoría de cumplimiento normativo comparando borradores de políticas corporativas y procedimientos internos.
- Control de calidad editorial para consolidar cambios y descartes en la publicación de textos técnicos o académicos.

## Preguntas frecuentes

### ¿Qué tipos de archivos admite esta herramienta?

La herramienta admite exclusivamente archivos en formato PDF.

### ¿Es necesario que el PDF tenga etiquetas estructurales?

No es obligatorio, pero activar la opción de árbol estructural mejora significativamente la precisión en documentos complejos.

### ¿Puedo procesar solo una parte del documento?

Sí, puede especificar páginas individuales o rangos, por ejemplo: 1, 3, 5-10.

### ¿Qué formato tiene el informe de salida?

El resultado se entrega en un formato HTML que facilita la visualización y revisión del texto extraído.

### ¿Detecta tachados realizados con herramientas de dibujo a mano?

No, la herramienta detecta el atributo de texto tachado aplicado digitalmente mediante editores de PDF.

## Herramientas relacionadas

- [Generador de informes de auditoria de accesibilidad](https://elysiatools.com/es/tools/accessibility-audit-report-generator): Audita HTML o una URL para detectar problemas comunes de WCAG y exporta un PDF estructurado
- [Eliminador de ruido de encabezado y pie PDF](https://elysiatools.com/es/tools/pdf-header-footer-noise-remover): Compara la extraccion con y sin encabezados/pies para detectar ruido repetido en el texto
- [Inspector de PDF etiquetado](https://elysiatools.com/es/tools/tagged-pdf-inspector): Compara la extraccion con y sin StructTree para ver si el PDF tiene estructura etiquetada util
- [Extractor de rango de paginas PDF](https://elysiatools.com/es/tools/pdf-page-range-extractor): Extrae solo un rango de paginas PDF y lo exporta como Markdown, JSON o texto
- [Analizador de PDF con formulas y graficos](https://elysiatools.com/es/tools/formula-chart-heavy-pdf-analyzer): Compara la extraccion local e hybrid de OpenDataLoader para identificar paginas que requieren ayuda de IA
- [Puente de PDF (OCR) a JSON estructurado](https://elysiatools.com/es/tools/ocr-pdf-to-structured-json-bridge): Extrae la capa de texto del PDF con geometría (líneas por posición y, tablas por huecos de columna, títulos por tamaño de fuente, pares clave-valor con dos puntos) y rellena campo a campo un JSON Schema del usuario — etiquetas emparejadas por claves normalizadas, valores coaccionados a los tipos declarados y validados con ajv.
- [Extractor de imagenes y captions PDF](https://elysiatools.com/es/tools/pdf-image-caption-extractor): Extrae imagenes PDF, empareja captions cercanos y genera un indice HTML navegable
- [Validador de árbol estructural lógico PDF (mapa de roles WCAG)](https://elysiatools.com/es/tools/pdf-logical-structure-tree-validator): Audita el árbol de estructura lógica PDF/UA-1: si el RoleMap termina en tipos estándar, si H1–H6 saltan niveles o el primer título no es H1, si Figure/Formula carecen de texto Alt, si la cadena de idioma es determinable y si el orden MCID estructura/contenido diverge; incluye el árbol con puntos de control Matterhorn.

## Ejemplos

- [Muestras PDF](https://elysiatools.com/es/samples/pdf-samples): Muestras PDF generadas por herramientas 2026-02-01 a 2026-02-10
- [Ejemplos de Presentaciones Markdown](https://elysiatools.com/es/samples/md-slide-deck-to-pdf): Mazos Markdown estilo Remark/Marp para probar la exportacion a PDF
- [Muestras de Extractor de Registro de Cambios](https://elysiatools.com/es/samples/changelog-extractor): Varios formatos de registro de cambios para probar herramientas de análisis y extracción
- [Ejemplos de Extractor de Números de Teléfono](https://elysiatools.com/es/samples/phone-number-extractor): Colección de texto mixto que contiene números de teléfono de varios países para pruebas de extracción

## Contenido relacionado

- [Flujos de extraccion y depuracion de PDF](https://elysiatools.com/es/hubs/pdf-extraction-debugging-workflows): Depura casos dificiles de PDF revisando cifrado, seguridad, paginas, orden de lectura, OCR, tablas y salidas estructuradas.
- [Preparacion de PDF para LLM y RAG](https://elysiatools.com/es/hubs/pdf-llm-rag-prep): Convierte PDFs en entradas limpias, seguras y citables para resumen con LLM, embeddings, busqueda y RAG.
