# PDF-zu-JSON-Struktur-Explorer

Extrahiert OpenDataLoader-JSON aus einem PDF und zeigt Ueberschriften, Absaetze, Tabellen, Listen und Bounding Boxes

> Kanonische Seite: https://elysiatools.com/de/tools/pdf-to-json-structure-explorer

- **Kategorie:** Developer Tools

- **Schlagwörter:** pdf, json, struktur, explorer

## Überblick

Nach dem Upload eines PDFs erzeugt das Tool OpenDataLoader-JSON und stellt Ueberschriften, Absaetze, Listen, Tabellen, Seiten und Bounding Boxes in einer Explorer-Ansicht dar. Das ist hilfreich zur Parser-Debugging und zur Pruefung der semantischen Ebene.

## Eingaben

- **PDF-Datei** (file)
- **Strukturbaum verwenden** (checkbox)
- **Sensible Daten maskieren** (checkbox)
- **Seiten** (text): e.g. 1,3,5-7
- **Knotenfilter** (select)
- **Suchbegriff** (text): e.g. revenue or heading

## Wann verwenden

- Wenn Sie die semantische Hierarchie (Überschriften, Absätze) eines PDF-Dokuments für das Debugging analysieren möchten.
- Um zu überprüfen, ob Tabellen und Listen von einem Parser korrekt erkannt und strukturiert wurden.
- Wenn Sie gezielt nach bestimmten Knotenarten filtern oder Bounding-Box-Koordinaten für die Weiterverarbeitung auslesen müssen.

## Funktionsweise

- Laden Sie Ihre PDF-Datei hoch und geben Sie bei Bedarf bestimmte Seitenbereiche an.
- Wählen Sie Filteroptionen aus, um beispielsweise nur Tabellen oder Überschriften anzuzeigen, und aktivieren Sie bei Bedarf die Maskierung sensibler Daten.
- Das Tool verarbeitet das Dokument und generiert ein OpenDataLoader-JSON.
- Das Ergebnis wird als interaktive HTML-Explorer-Ansicht gerendert, in der Sie die semantischen Knoten und Metadaten im Detail betrachten können.

## Anwendungsfälle

- Debugging von PDF-Parsern durch visuelle Überprüfung der erkannten Dokumentenstruktur und Bounding Boxes.
- Qualitätssicherung bei der automatisierten Datenextraktion aus Rechnungen, Berichten oder Handbüchern.
- Vorbereitung von Trainingsdaten für Machine-Learning-Modelle durch Validierung der semantischen PDF-Ebenen.

## Häufig gestellte Fragen

### Welche Elemente werden aus der PDF extrahiert?

Das Tool extrahiert semantische Knoten wie Überschriften, Absätze, Tabellen und Listen inklusive ihrer Bounding-Box-Koordinaten und Seitenmetadaten.

### Kann ich die Analyse auf bestimmte Seiten beschränken?

Ja, Sie können im Feld 'Seiten' spezifische Seiten oder Bereiche (z. B. 1,3,5-7) angeben, um nur diese zu analysieren.

### Was bewirkt der Knotenfilter?

Mit dem Knotenfilter können Sie die Explorer-Ansicht auf bestimmte Elementtypen wie 'Nur Tabellen', 'Nur Überschriften' oder 'Nur Listen' reduzieren.

### Werden sensible Daten geschützt?

Ja, durch Aktivierung der Option 'Sensible Daten maskieren' werden vertrauliche Informationen im generierten JSON-Output unkenntlich gemacht.

### In welchem Format wird das Ergebnis angezeigt?

Das Ergebnis wird als interaktive HTML-Ansicht dargestellt, die eine einfache Navigation durch die extrahierte JSON-Struktur ermöglicht.

## Ähnliche Tools

- [OCR-PDF-zu-strukturiertes-JSON-Brücke](https://elysiatools.com/de/tools/ocr-pdf-to-structured-json-bridge): Extrahiert die PDF-Textebene mit Geometrie (Zeilen nach y-Position, Tabellen nach Spaltenlücken, Überschriften nach Schriftgröße, Doppelpunkt-Schlüsselwerte) und füllt Feld für Feld ein benutzerdefiniertes JSON Schema — Labels werden über normalisierte Schlüssel gepaart, Werte zu deklarierten Typen konvertiert und mit ajv validiert.
- [PDF-Anmerkungs-Export](https://elysiatools.com/de/tools/pdf-annotation-export): Extrahiert bestehende Anmerkungen (Hervorhebungen, Kommentare, Stempel, Links) aus einem PDF als JSON-Zeichenkette
- [PDF-Formulardaten-Export](https://elysiatools.com/de/tools/pdf-form-data-export): Liest Namen, Typen und aktuelle Werte der AcroForm-Felder aus einem PDF und exportiert sie als JSON-Zeichenkette
- [PDF-Tabellenextraktor zu CSV/JSON](https://elysiatools.com/de/tools/pdf-table-extractor-to-csv-json): Extrahiert Tabellen aus PDFs mit OpenDataLoader und exportiert sie als JSON, CSV oder HTML
- [Konverter fuer verschluesseltes PDF](https://elysiatools.com/de/tools/encrypted-pdf-converter): Oeffnet geschuetzte PDFs mit dem richtigen Passwort und exportiert sie als Markdown, JSON oder Text
- [PDF-Seitenbereich-Extraktor](https://elysiatools.com/de/tools/pdf-page-range-extractor): Extrahiert nur ausgewaehlte PDF-Seiten und exportiert sie als Markdown, JSON oder Text
- [Fitness-Workout-PDF-Generator](https://elysiatools.com/de/tools/fitness-workout-pdf-generator): Erstellt einen druckbaren Trainingsplan als PDF aus JSON oder CSV mit Tabellen, Fortschrittsfeldern und optionalen QR-Codes
- [LibreOffice Vorlagen-Fullung und Merge](https://elysiatools.com/de/tools/libreoffice-template-fill-merge): Ersetzt Platzhalter in DOCX und rendert PDF im Mail-Merge-Stil

## Beispiele

- [PDF-Beispiele](https://elysiatools.com/de/samples/pdf-samples): Generierte PDF-Beispiele von Tools zwischen 2026-02-01 und 2026-02-10
- [Terraform-Plan-JSON-Beispiele](https://elysiatools.com/de/samples/terraform-plan-json-samples): Terraform-Plan-JSON-Dateien fuer Abhaengigkeitsvisualisierung und Change-Review, passend zu terraform show -json
- [JSON-Beispiele](https://elysiatools.com/de/samples/json): JSON (JavaScript Object Notation)-Formatbeispiele von einfachen bis komplexen Strukturen
- [Chat-JSON-Beispiele](https://elysiatools.com/de/samples/chat-transcript-json): JSON-Beispiele für Chat-Transkripte mit mehreren Rollen

## Verwandte Inhalte

- [Dokumenten-OCR-Extraktion](https://elysiatools.com/de/hubs/document-ocr-extraction): Extrahieren Sie OCR-Text aus Scans und wandeln Sie Dokumentseiten oder Bilder in Markdown, JSON, Tabellen, Bildbeschreibungen und retrieval-fertige Segmente mit Qualitätsprüfung um.
- [PDF-Konvertierung, OCR und Extraktion](https://elysiatools.com/de/hubs/pdf-convert): Wandeln Sie Office-Dateien, Wiki-Seiten, Kommentare und Bilder in PDFs um und extrahieren Sie Text, Bilder, Tabellen, Struktur oder OCR aus bestehenden PDFs.
- [PDF-Extraktion und Debugging-Workflows](https://elysiatools.com/de/hubs/pdf-extraction-debugging-workflows): Debuggen Sie schwierige PDF-Extraktion mit Verschlusselung, Sicherheit, Seitenbereich, Lesereihenfolge, OCR, Tabellen und Struktur.
- [PDF-Vorbereitung fur LLM und RAG](https://elysiatools.com/de/hubs/pdf-llm-rag-prep): PDFs in saubere, sichere und zitierbare Eingaben fur LLM-Zusammenfassung, Embeddings, Suche und RAG verwandeln.
