# Explorador de estructura JSON desde PDF

Extrae la estructura JSON de OpenDataLoader desde un PDF y muestra encabezados, parrafos, tablas, listas y bounding boxes

> Página canónica: https://elysiatools.com/es/tools/pdf-to-json-structure-explorer

- **Categoría:** Developer Tools

- **Palabras clave:** pdf, json, estructura, explorador

## Descripción general

Tras subir un PDF, la herramienta genera JSON con OpenDataLoader y lo convierte en un explorador de encabezados, parrafos, listas, tablas, paginas y bounding boxes. Es util para depurar la calidad del parser y revisar la capa semantica.

## Entradas

- **Archivo PDF** (file)
- **Usar arbol estructural** (checkbox)
- **Sanitizar datos sensibles** (checkbox)
- **Paginas** (text): e.g. 1,3,5-7
- **Filtro de nodos** (select)
- **Termino de busqueda** (text): e.g. revenue or heading

## Cuándo usarlo

- Cuando necesitas depurar la calidad de extracción de un parser de PDF y verificar la jerarquía de los encabezados.
- Para inspeccionar visualmente las coordenadas (bounding boxes) de elementos específicos como tablas o listas dentro de una página.
- Al auditar la estructura semántica de un documento antes de integrarlo en flujos de trabajo de procesamiento de datos o modelos de lenguaje.

## Cómo funciona

- Sube tu archivo PDF utilizando el campo principal de carga.
- Configura opciones adicionales como el uso del árbol estructural, la sanitización de datos sensibles o el rango de páginas a procesar.
- Aplica filtros de nodos (por ejemplo, solo tablas o encabezados) o ingresa un término de búsqueda si deseas aislar elementos específicos.
- La herramienta procesa el documento y devuelve una vista exploradora en HTML con los nodos semánticos, metadatos de página y el JSON generado.

## Casos de uso

- Validación de la extracción de tablas financieras en reportes anuales para asegurar que las filas y columnas se detecten correctamente.
- Revisión de la jerarquía de títulos y subtítulos en manuales técnicos antes de su indexación en bases de datos vectoriales.
- Depuración de coordenadas de bounding boxes en documentos escaneados para ajustar plantillas de extracción de datos.

## Preguntas frecuentes

### ¿Qué tipos de elementos puedo explorar con esta herramienta?

Puedes explorar encabezados, párrafos, tablas, listas, metadatos de páginas y las coordenadas (bounding boxes) de cada elemento detectado en el PDF.

### ¿Puedo analizar solo páginas específicas de mi PDF?

Sí, puedes usar el campo de páginas para definir rangos específicos, como '1,3,5-7', y procesar únicamente esas secciones del documento.

### ¿Es posible filtrar los resultados para ver solo las tablas?

Sí, el filtro de nodos te permite seleccionar 'Solo tablas', 'Solo encabezados', 'Solo listas' o 'Todos los nodos' según lo que necesites revisar.

### ¿Qué hace la opción de usar el árbol estructural?

Activa la lectura de la estructura interna del PDF (si el documento está etiquetado) para mejorar la precisión en la detección de la jerarquía semántica y el orden de lectura.

### ¿En qué formato se entregan los resultados?

El resultado es un reporte interactivo en formato HTML que muestra la vista del explorador con los nodos semánticos y una vista previa del JSON estructurado.

## Herramientas relacionadas

- [Puente de PDF (OCR) a JSON estructurado](https://elysiatools.com/es/tools/ocr-pdf-to-structured-json-bridge): Extrae la capa de texto del PDF con geometría (líneas por posición y, tablas por huecos de columna, títulos por tamaño de fuente, pares clave-valor con dos puntos) y rellena campo a campo un JSON Schema del usuario — etiquetas emparejadas por claves normalizadas, valores coaccionados a los tipos declarados y validados con ajv.
- [Exportación de anotaciones PDF](https://elysiatools.com/es/tools/pdf-annotation-export): Extrae anotaciones existentes (resaltados, comentarios, sellos, enlaces) de un PDF a una cadena JSON
- [Exportación de datos de formulario PDF](https://elysiatools.com/es/tools/pdf-form-data-export): Lee nombres, tipos y valores actuales de los campos AcroForm de un PDF y los exporta como cadena JSON
- [Extractor de tablas PDF a CSV/JSON](https://elysiatools.com/es/tools/pdf-table-extractor-to-csv-json): Extrae tablas de PDF con OpenDataLoader y las exporta como JSON estructurado, CSV o HTML
- [Convertidor de PDF cifrado](https://elysiatools.com/es/tools/encrypted-pdf-converter): Abre PDF protegidos con la contrasena correcta y los exporta como Markdown, JSON o texto
- [Extractor de rango de paginas PDF](https://elysiatools.com/es/tools/pdf-page-range-extractor): Extrae solo un rango de paginas PDF y lo exporta como Markdown, JSON o texto
- [Generador PDF de entrenamiento fitness](https://elysiatools.com/es/tools/fitness-workout-pdf-generator): Genera un PDF imprimible de entrenamiento desde JSON o CSV con tablas, casillas de progreso y QR opcionales
- [Relleno y fusion de plantilla LibreOffice](https://elysiatools.com/es/tools/libreoffice-template-fill-merge): Reemplaza marcadores en DOCX y renderiza PDF estilo mail merge

## Ejemplos

- [Muestras PDF](https://elysiatools.com/es/samples/pdf-samples): Muestras PDF generadas por herramientas 2026-02-01 a 2026-02-10
- [Muestras JSON de Terraform Plan](https://elysiatools.com/es/samples/terraform-plan-json-samples): Archivos Terraform plan JSON para visualizacion de dependencias y revision de cambios, similares a terraform show -json
- [Ejemplos de JSON](https://elysiatools.com/es/samples/json): Ejemplos de formato JSON (JavaScript Object Notation) desde estructuras simples hasta complejas
- [Ejemplos JSON de Chat](https://elysiatools.com/es/samples/chat-transcript-json): Ejemplos JSON para transcripciones de chat multirrol

## Contenido relacionado

- [Extracción OCR de documentos](https://elysiatools.com/es/hubs/document-ocr-extraction): Extrae texto OCR de escaneos y convierte páginas o imágenes en Markdown, JSON, tablas, captions y fragmentos listos para recuperación con control de calidad.
- [Flujo de conversion, OCR y extraccion PDF](https://elysiatools.com/es/hubs/pdf-convert): Convierte documentos, paginas wiki, comentarios e imagenes a PDF, y extrae texto, imagenes, tablas, estructura u OCR desde PDFs existentes.
- [Flujos de extraccion y depuracion de PDF](https://elysiatools.com/es/hubs/pdf-extraction-debugging-workflows): Depura casos dificiles de PDF revisando cifrado, seguridad, paginas, orden de lectura, OCR, tablas y salidas estructuradas.
- [Preparacion de PDF para LLM y RAG](https://elysiatools.com/es/hubs/pdf-llm-rag-prep): Convierte PDFs en entradas limpias, seguras y citables para resumen con LLM, embeddings, busqueda y RAG.
