# Extractor de tablas PDF a CSV/JSON

Extrae tablas de PDF con OpenDataLoader y las exporta como JSON estructurado, CSV o HTML

> Página canónica: https://elysiatools.com/es/tools/pdf-table-extractor-to-csv-json

- **Categoría:** Data Processing

- **Palabras clave:** pdf, tabla, csv, json

## Descripción general

Tras subir un PDF, la herramienta usa OpenDataLoader para detectar tablas semanticas y luego exportarlas segun el formato elegido. JSON conserva pagina, bbox y estructura; CSV aplana cada celda; HTML genera tablas visuales.

## Entradas

- **Archivo PDF** (file)
- **Formato de exportacion** (select)
- **Metodo de deteccion de tablas** (select)
- **Paginas** (text): e.g. 1,3,5-7
- **Usar arbol estructural** (checkbox)

## Cuándo usarlo

- Cuando necesitas analizar datos financieros o estadísticos atrapados en documentos PDF.
- Para migrar tablas de informes en PDF a bases de datos o hojas de cálculo sin copiar y pegar manualmente.
- Al procesar documentos estructurados donde se requiere extraer información tabular específica filtrando por páginas.

## Cómo funciona

- Sube tu archivo PDF al sistema.
- Selecciona el formato de exportación deseado (JSON estructurado, CSV plano o tabla HTML visual).
- Opcionalmente, define las páginas específicas a procesar y ajusta el método de detección de tablas (Predeterminado o Cluster).
- Descarga el archivo resultante con los datos tabulares extraídos y listos para usar.

## Casos de uso

- Extracción de balances y estados de resultados desde informes anuales en PDF a formato CSV para análisis en Excel.
- Conversión de catálogos de productos en PDF a JSON estructurado para alimentar una tienda online o base de datos.
- Transformación de tablas de datos científicos en PDF a HTML para publicarlas directamente en una página web.

## Preguntas frecuentes

### ¿Qué formatos de exportación admite la herramienta?

Puedes exportar las tablas extraídas en formato JSON (conserva estructura y metadatos), CSV (datos aplanados) o HTML (visualización web).

### ¿Puedo extraer tablas solo de páginas específicas?

Sí, puedes indicar los números de página exactos o rangos (por ejemplo, 1,3,5-7) en el campo de configuración de páginas.

### ¿Qué es el método de detección Cluster?

Es un algoritmo de OpenDataLoader que agrupa elementos de texto cercanos para formar celdas y tablas, útil para PDFs con diseños complejos o sin líneas divisorias claras.

### ¿Qué hace la opción 'Usar árbol estructural'?

Intenta utilizar las etiquetas de estructura internas del PDF (si el documento fue creado con ellas) para identificar las tablas con mayor precisión.

### ¿El formato CSV mantiene la estructura visual de la tabla?

El formato CSV aplana los datos, organizándolos por tabla, página, fila, columna y valor, lo que es ideal para importar a bases de datos o procesar mediante scripts.

## Herramientas relacionadas

- [Generador PDF de entrenamiento fitness](https://elysiatools.com/es/tools/fitness-workout-pdf-generator): Genera un PDF imprimible de entrenamiento desde JSON o CSV con tablas, casillas de progreso y QR opcionales
- [Generador de Facturas PDF](https://elysiatools.com/es/tools/pdf-invoice-generator): Genera una factura PDF con marca desde partidas estructuradas
- [Generador de Data URI](https://elysiatools.com/es/tools/data-uri-generator): Convierte archivos en Data URIs (Base64 o porcentaje-codificado) para incrustar imágenes, fuentes y recursos directamente en HTML, CSS o Markdown
- [Herramienta de diferencias CSV / Excel](https://elysiatools.com/es/tools/csv-excel-diff-tool): Compara dos fuentes CSV o XLSX y exporta un informe PDF con diferencias por fila, columna y celda
- [Puente de PDF (OCR) a JSON estructurado](https://elysiatools.com/es/tools/ocr-pdf-to-structured-json-bridge): Extrae la capa de texto del PDF con geometría (líneas por posición y, tablas por huecos de columna, títulos por tamaño de fuente, pares clave-valor con dos puntos) y rellena campo a campo un JSON Schema del usuario — etiquetas emparejadas por claves normalizadas, valores coaccionados a los tipos declarados y validados con ajv.
- [Exportación de anotaciones PDF](https://elysiatools.com/es/tools/pdf-annotation-export): Extrae anotaciones existentes (resaltados, comentarios, sellos, enlaces) de un PDF a una cadena JSON
- [Exportación de datos de formulario PDF](https://elysiatools.com/es/tools/pdf-form-data-export): Lee nombres, tipos y valores actuales de los campos AcroForm de un PDF y los exporta como cadena JSON
- [Explorador de estructura JSON desde PDF](https://elysiatools.com/es/tools/pdf-to-json-structure-explorer): Extrae la estructura JSON de OpenDataLoader desde un PDF y muestra encabezados, parrafos, tablas, listas y bounding boxes

## Ejemplos

- [Muestras PDF](https://elysiatools.com/es/samples/pdf-samples): Muestras PDF generadas por herramientas 2026-02-01 a 2026-02-10
- [Ejemplos CSV](https://elysiatools.com/es/samples/csv-samples): Archivos CSV de muestra con varios tipos de datos, tamaños y niveles de complejidad
- [Ejemplos Python](https://elysiatools.com/es/samples/python): Ejemplos de código Python y demostraciones Hello World
- [Muestras JSON de Terraform Plan](https://elysiatools.com/es/samples/terraform-plan-json-samples): Archivos Terraform plan JSON para visualizacion de dependencias y revision de cambios, similares a terraform show -json

## Contenido relacionado

- [Extracción OCR de documentos](https://elysiatools.com/es/hubs/document-ocr-extraction): Extrae texto OCR de escaneos y convierte páginas o imágenes en Markdown, JSON, tablas, captions y fragmentos listos para recuperación con control de calidad.
- [Flujo de conversion, OCR y extraccion PDF](https://elysiatools.com/es/hubs/pdf-convert): Convierte documentos, paginas wiki, comentarios e imagenes a PDF, y extrae texto, imagenes, tablas, estructura u OCR desde PDFs existentes.
- [Flujos de extraccion y depuracion de PDF](https://elysiatools.com/es/hubs/pdf-extraction-debugging-workflows): Depura casos dificiles de PDF revisando cifrado, seguridad, paginas, orden de lectura, OCR, tablas y salidas estructuradas.
- [Preparacion de PDF para LLM y RAG](https://elysiatools.com/es/hubs/pdf-llm-rag-prep): Convierte PDFs en entradas limpias, seguras y citables para resumen con LLM, embeddings, busqueda y RAG.
