# Извлечение таблиц PDF в CSV/JSON

Извлекает таблицы из PDF через OpenDataLoader и экспортирует в JSON, CSV или HTML

> Каноническая страница: https://elysiatools.com/ru/tools/pdf-table-extractor-to-csv-json

- **Категория:** Data Processing

- **Ключевые слова:** pdf, table, csv, json

## Обзор

После загрузки PDF инструмент использует OpenDataLoader для поиска семантических таблиц, а затем экспортирует их в выбранном формате. JSON сохраняет страницу, bbox и структуру; CSV разворачивает ячейки; HTML строит визуальные таблицы.

## Входные данные

- **PDF файл** (file)
- **Формат экспорта** (select)
- **Метод распознавания таблиц** (select)
- **Страницы** (text): e.g. 1,3,5-7
- **Использовать структуру тегов** (checkbox)

## Когда использовать

- Когда нужно перенести финансовые или статистические данные из PDF-отчетов в Excel или базы данных.
- Для парсинга научных статей и извлечения структурированных данных для последующего машинного анализа.
- При необходимости конвертировать нередактируемые PDF-таблицы в веб-формат (HTML) для публикации на сайте.

## Как это работает

- Загрузите исходный PDF-файл в инструмент.
- Выберите нужный формат экспорта: JSON для сохранения структуры, CSV для плоских данных или HTML для визуализации.
- При необходимости укажите конкретные страницы для обработки и выберите метод распознавания (например, кластерный).
- Скачайте готовый файл с извлеченными таблицами.

## Сценарии использования

- Извлечение данных из ежеквартальных финансовых отчетов для загрузки в BI-системы.
- Конвертация прайс-листов из PDF в CSV для импорта в интернет-магазин или ERP-систему.
- Преобразование таблиц из отсканированных или сгенерированных PDF-документов в HTML-код для вставки в блог.

## Частые вопросы

### Какие форматы экспорта поддерживаются?

Вы можете выгрузить извлеченные таблицы в форматах JSON, CSV и HTML.

### Можно ли извлечь таблицы только с определенных страниц?

Да, в поле «Страницы» можно указать конкретные номера или диапазоны, например, 1,3,5-7.

### Что делает опция «Использовать структуру тегов»?

Она помогает точнее определять границы таблиц в PDF-файлах, которые содержат внутреннюю разметку (Tagged PDF).

### В чем разница между методами распознавания?

Метод «По умолчанию» подходит для стандартных таблиц, а «Кластерный» лучше справляется со сложной или нестандартной версткой ячеек.

### Сохраняются ли координаты таблиц при экспорте?

Да, при экспорте в формат JSON сохраняются номера страниц, координаты (bbox) и полная структура строк и столбцов.

## Связанные инструменты

- [Генератор PDF-плана тренировок](https://elysiatools.com/ru/tools/fitness-workout-pdf-generator): Создает печатный PDF-план тренировок из JSON или CSV с таблицами, ячейками прогресса и QR-кодами
- [Генератор PDF-счетов](https://elysiatools.com/ru/tools/pdf-invoice-generator): Создает брендированный PDF-счет из структурированных позиций
- [Генератор Data URI](https://elysiatools.com/ru/tools/data-uri-generator): Преобразует файлы в Data URI (Base64 или процентное кодирование) для встраивания изображений, шрифтов и ресурсов прямо в HTML, CSS или Markdown
- [Инструмент сравнения CSV / Excel](https://elysiatools.com/ru/tools/csv-excel-diff-tool): Сравнивает два CSV или XLSX и экспортирует PDF-отчет с различиями по строкам, столбцам и ячейкам
- [Мост OCR PDF → структурированный JSON](https://elysiatools.com/ru/tools/ocr-pdf-to-structured-json-bridge): Извлекает текстовый слой PDF с геометрией (строки по y-координате, таблицы по промежуткам колонок, заголовки по кеглю, пары ключ-значение через двоеточие) и заполняет пользовательскую JSON-схему поле за полем — метки сопоставляются по нормализованным ключам, значения приводятся к объявленным типам и проверяются ajv.
- [Экспорт аннотаций PDF](https://elysiatools.com/ru/tools/pdf-annotation-export): Извлекает существующие аннотации (выделения, комментарии, штампы, ссылки) из PDF в строку JSON
- [Экспорт данных формы PDF](https://elysiatools.com/ru/tools/pdf-form-data-export): Читает имена, типы и текущие значения полей AcroForm из PDF и экспортирует их как строку JSON
- [Проводник структуры JSON из PDF](https://elysiatools.com/ru/tools/pdf-to-json-structure-explorer): Извлекает JSON-структуру OpenDataLoader из PDF и показывает заголовки, абзацы, таблицы, списки и bounding box

## Примеры

- [PDF Примеры](https://elysiatools.com/ru/samples/pdf-samples): PDF примеры, созданные инструментами 2026-02-01..2026-02-10
- [CSV Примеры](https://elysiatools.com/ru/samples/csv-samples): Примеры CSV-файлов с различными типами данных, размерами и уровнями сложности
- [Примеры Python](https://elysiatools.com/ru/samples/python): Примеры кода Python и демонстрации Hello World
- [JSON Примеры Terraform Plan](https://elysiatools.com/ru/samples/terraform-plan-json-samples): Файлы Terraform plan JSON для визуализации зависимостей и проверки изменений, похожие на terraform show -json

## Связанные материалы

- [OCR-извлечение документов](https://elysiatools.com/ru/hubs/document-ocr-extraction): Извлекайте OCR-текст из сканов и преобразуйте страницы или изображения в Markdown, JSON, таблицы, описания и блоки для поиска с проверкой качества.
- [PDF: конвертация, OCR и извлечение данных](https://elysiatools.com/ru/hubs/pdf-convert): Преобразуйте офисные файлы, wiki-страницы, комментарии и изображения в PDF, а затем извлекайте текст, изображения, таблицы, структуру или OCR из готовых PDF.
- [Рабочие процессы извлечения и отладки PDF](https://elysiatools.com/ru/hubs/pdf-extraction-debugging-workflows): Отлаживайте сложное извлечение PDF: шифрование, безопасность, страницы, порядок чтения, OCR, таблицы и структурированный вывод.
- [Подготовка PDF для LLM и RAG](https://elysiatools.com/ru/hubs/pdf-llm-rag-prep): Преобразуйте PDF в чистые, безопасные и цитируемые входные данные для LLM, эмбеддингов, поиска и RAG.
