# OCR текстовый слой PDF

Добавляет OCR текстовый слой в сканированный PDF для поиска и копирования

> Каноническая страница: https://elysiatools.com/ru/tools/pdf-ocr-text-layer

- **Категория:** PDF Tools

- **Ключевые слова:** pdf, ocr, tesseract, searchable, copyable, scan

## Обзор

Растрирует страницы PDF в изображения, выполняет OCR Tesseract по страницам и объединяет в поисковый PDF.

## Входные данные

- **Исходный PDF** (file): Upload scanned PDF
- **Языки OCR** (text): eng or eng+chi_sim
- **Входной DPI** (number)
- **Режим OCR-движка** (number)
- **Режим сегментации страницы** (number)

## Когда использовать

- Когда у вас есть сканированный документ или изображение в формате PDF, из которого невозможно скопировать текст.
- Когда необходимо сделать архив бумажных документов доступным для полнотекстового поиска.
- Когда нужно подготовить PDF-файл для цитирования или обработки данных, извлекая информацию из нередактируемых сканов.

## Как это работает

- Загрузите ваш PDF-файл в систему.
- Выберите язык документа и настройте параметры DPI для оптимального распознавания.
- Выберите режим сегментации страницы и движка OCR для повышения точности.
- Система растрирует страницы, распознает текст и создает новый PDF-файл с невидимым текстовым слоем поверх изображений.

## Сценарии использования

- Оцифровка архивных договоров и счетов для быстрого поиска по ключевым словам.
- Преобразование сканированных книг и статей в формат, удобный для цитирования.
- Подготовка юридических документов к автоматизированной обработке данных.

## Частые вопросы

### Что такое OCR-слой?

Это невидимый слой текста, наложенный на изображение страницы, который позволяет выделять, копировать и искать текст в PDF.

### Какие языки поддерживает инструмент?

Инструмент поддерживает любые языки, совместимые с Tesseract, включая многоязычные документы (например, eng+rus).

### Как выбрать правильный DPI?

Для стандартных документов рекомендуется 300 DPI. Более низкие значения ускоряют процесс, но могут снизить точность распознавания.

### Можно ли обрабатывать защищенные паролем PDF?

Инструмент работает с открытыми PDF-файлами. Если файл защищен, предварительно снимите ограничение.

### Изменяется ли внешний вид исходного документа?

Нет, визуально документ остается прежним, добавляется только возможность взаимодействия с текстом.

## Связанные инструменты

- [Очистка PDF от шума](https://elysiatools.com/ru/tools/pdf-denoise): Удаляет визуальный шум со страниц отсканированных PDF — «соль и перец», случайное зерно и слабую фоновую дымку — с помощью реальных алгоритмов обработки изображений. Текстовые страницы сохраняются как доступный для поиска векторный контент.
- [OCR сканированного PDF в Word](https://elysiatools.com/ru/tools/scanned-pdf-ocr-to-word): Растеризует страницы сканированного PDF, распознаёт текст Tesseract и экспортирует редактируемый DOCX.
- [Добавить подпись в PDF онлайн](https://elysiatools.com/ru/tools/pdf-add-signature-online): Добавляет видимую текстовую подпись или изображение подписи в PDF
- [Пакетные водяные знаки PDF](https://elysiatools.com/ru/tools/pdf-batch-watermark): Добавляет текстовые водяные знаки на несколько PDF с поворотом, прозрачностью и плиткой
- [Мост OCR PDF → структурированный JSON](https://elysiatools.com/ru/tools/ocr-pdf-to-structured-json-bridge): Извлекает текстовый слой PDF с геометрией (строки по y-координате, таблицы по промежуткам колонок, заголовки по кеглю, пары ключ-значение через двоеточие) и заполняет пользовательскую JSON-схему поле за полем — метки сопоставляются по нормализованным ключам, значения приводятся к объявленным типам и проверяются ajv.
- [Выравнивание PDF](https://elysiatools.com/ru/tools/pdf-deskew): Автоматически обнаруживает и исправляет перекошенные страницы PDF. Сохраняет текстовые страницы как доступный для поиска векторный контент и растеризует только страницы-изображения (например, сканы).
- [Очиститель шума колонтитулов PDF](https://elysiatools.com/ru/tools/pdf-header-footer-noise-remover): Сравнивает извлечение с колонтитулами и без них, чтобы найти повторяющийся шум в тексте
- [HTML письма в PDF](https://elysiatools.com/ru/tools/libreoffice-html-mail-to-pdf): Рендерит HTML письма в PDF с сохранением базовой верстки

## Примеры

- [PDF Примеры](https://elysiatools.com/ru/samples/pdf-samples): PDF примеры, созданные инструментами 2026-02-01..2026-02-10
- [Примеры Markdown Презентаций](https://elysiatools.com/ru/samples/md-slide-deck-to-pdf): Markdown колоды в стиле Remark/Marp для тестирования экспорта в PDF
- [Примеры Текста на Китайско-Английском Языке](https://elysiatools.com/ru/samples/text-chinese-english-mixed-samples): Примеры текстовых файлов со смешанным китайско-английским содержимым для тестирования инструментов автоматического добавления пробелов
- [Примеры Конвертера Регистра](https://elysiatools.com/ru/samples/text-case-formats): Тестовые примеры для конвертации регистра между различными соглашениями об именовании

## Связанные материалы

- [Проверка PDF для архива, доступности и доверия](https://elysiatools.com/ru/hubs/pdf-archival-accessibility-trust): Очистите сканы, добавьте OCR, подготовьте PDF/A, проверьте доступность, закладки, структуру тегов и подписи перед передачей в архив.
- [Подготовка PDF для LLM и RAG](https://elysiatools.com/ru/hubs/pdf-llm-rag-prep): Преобразуйте PDF в чистые, безопасные и цитируемые входные данные для LLM, эмбеддингов, поиска и RAG.
- [OCR-извлечение документов](https://elysiatools.com/ru/hubs/document-ocr-extraction): Извлекайте OCR-текст из сканов и преобразуйте страницы или изображения в Markdown, JSON, таблицы, описания и блоки для поиска с проверкой качества.
- [PDF: конвертация, OCR и извлечение данных](https://elysiatools.com/ru/hubs/pdf-convert): Преобразуйте офисные файлы, wiki-страницы, комментарии и изображения в PDF, а затем извлекайте текст, изображения, таблицы, структуру или OCR из готовых PDF.
