# Экстрактор зачеркиваний из PDF-ревью

Находит зачеркнутый текст в PDF-документах ревью и формирует отчет для договоров и редакций

> Каноническая страница: https://elysiatools.com/ru/tools/pdf-strikethrough-review-extractor

- **Категория:** Developer Tools

- **Ключевые слова:** pdf, strikethrough, review

## Обзор

После загрузки PDF инструмент включает детекцию зачеркивания OpenDataLoader и извлекает удаленный или отмеченный для ревью текст из JSON и Markdown, чтобы быстро проверять различия.

## Входные данные

- **PDF файл** (file)
- **Страницы** (text): e.g. 1,3,5-7
- **Использовать структуру тегов** (checkbox)

## Когда использовать

- При проверке юридических договоров, где изменения и удаления отмечены зачеркиванием.
- Для анализа редакционных правок в книгах или статьях перед их финальной публикацией.
- При сравнении версий внутренних регламентов компании для быстрого выявления исключенных пунктов.

## Как это работает

- Загрузите PDF-файл, содержащий текстовые пометки или исправления в виде зачеркиваний.
- Укажите номера страниц или диапазоны, если требуется обработать только определенную часть документа.
- Система сканирует структуру документа и выявляет текст с атрибутом форматирования 'strikethrough'.
- Инструмент генерирует HTML-отчет, в котором собраны все найденные удаленные фрагменты текста.

## Сценарии использования

- Сверка финальной версии контракта с черновиками для контроля удаленных юридических условий.
- Подготовка сводного отчета о правках для авторов и корректоров в издательском процессе.
- Аудит изменений в технической документации для быстрого поиска устаревших и исключенных инструкций.

## Частые вопросы

### Какие типы PDF-файлов поддерживаются?

Инструмент работает с цифровыми PDF-документами, содержащими текстовый слой и метаданные форматирования.

### Можно ли обработать только конкретные страницы?

Да, вы можете указать отдельные страницы или диапазоны, например '1, 3, 5-10', в поле настроек.

### Что делает опция «Использовать структуру тегов»?

Она позволяет инструменту опираться на внутреннюю иерархию PDF (StructTree) для более точного определения контекста зачеркнутого текста.

### В каком формате я получу извлеченный текст?

Результат предоставляется в виде HTML-файла, который удобно просматривать в любом браузере.

### Распознает ли инструмент зачеркивания, сделанные от руки?

Нет, инструмент предназначен для обнаружения программного форматирования текста (strikethrough) в электронных документах.

## Связанные инструменты

- [Генератор отчета по аудиту доступности](https://elysiatools.com/ru/tools/accessibility-audit-report-generator): Проверяет HTML или URL на распространенные проблемы WCAG и экспортирует структурированный PDF-отчет
- [Очиститель шума колонтитулов PDF](https://elysiatools.com/ru/tools/pdf-header-footer-noise-remover): Сравнивает извлечение с колонтитулами и без них, чтобы найти повторяющийся шум в тексте
- [Инспектор Tagged PDF](https://elysiatools.com/ru/tools/tagged-pdf-inspector): Сравнивает извлечение с StructTree и без него, чтобы понять, содержит ли PDF полезную tagged-структуру
- [Извлечение диапазона страниц PDF](https://elysiatools.com/ru/tools/pdf-page-range-extractor): Извлекает только выбранный диапазон страниц PDF и экспортирует его в Markdown, JSON или текст
- [Анализатор PDF с формулами и графиками](https://elysiatools.com/ru/tools/formula-chart-heavy-pdf-analyzer): Сравнивает локальное и hybrid-извлечение OpenDataLoader, чтобы найти страницы, где нужен AI-assisted parsing
- [Мост OCR PDF → структурированный JSON](https://elysiatools.com/ru/tools/ocr-pdf-to-structured-json-bridge): Извлекает текстовый слой PDF с геометрией (строки по y-координате, таблицы по промежуткам колонок, заголовки по кеглю, пары ключ-значение через двоеточие) и заполняет пользовательскую JSON-схему поле за полем — метки сопоставляются по нормализованным ключам, значения приводятся к объявленным типам и проверяются ajv.
- [Извлечение изображений и captions из PDF](https://elysiatools.com/ru/tools/pdf-image-caption-extractor): Извлекает изображения PDF, сопоставляет ближайшие captions и создает HTML-индекс
- [Валидатор логического дерева структуры PDF (роли WCAG)](https://elysiatools.com/ru/tools/pdf-logical-structure-tree-validator): Аудит логического дерева структуры PDF/UA-1: завершается ли RoleMap стандартными типами, не пропускают ли H1–H6 уровни и не начинается ли документ не с H1, нет ли у Figure/Formula отсутствующего Alt, определима ли цепочка языка, расходятся ли порядок MCID структуры и потока контента; с деревом и контрольными точками Matterhorn.

## Примеры

- [PDF Примеры](https://elysiatools.com/ru/samples/pdf-samples): PDF примеры, созданные инструментами 2026-02-01..2026-02-10
- [Примеры Markdown Презентаций](https://elysiatools.com/ru/samples/md-slide-deck-to-pdf): Markdown колоды в стиле Remark/Marp для тестирования экспорта в PDF
- [Образцы Извлечения Журнала Изменений](https://elysiatools.com/ru/samples/changelog-extractor): Различные форматы журналов изменений для тестирования инструментов синтаксического анализа и извлечения
- [Примеры Извлечения Номеров Телефонов](https://elysiatools.com/ru/samples/phone-number-extractor): Коллекция смешанного текста, содержащего номера телефонов из различных стран для тестирования извлечения

## Связанные материалы

- [Рабочие процессы извлечения и отладки PDF](https://elysiatools.com/ru/hubs/pdf-extraction-debugging-workflows): Отлаживайте сложное извлечение PDF: шифрование, безопасность, страницы, порядок чтения, OCR, таблицы и структурированный вывод.
- [Подготовка PDF для LLM и RAG](https://elysiatools.com/ru/hubs/pdf-llm-rag-prep): Преобразуйте PDF в чистые, безопасные и цитируемые входные данные для LLM, эмбеддингов, поиска и RAG.
