# Explorateur de structure JSON PDF

Extrait la structure JSON OpenDataLoader dun PDF et affiche titres, paragraphes, tableaux, listes et bounding boxes

> Page canonique: https://elysiatools.com/fr/tools/pdf-to-json-structure-explorer

- **Catégorie:** Developer Tools

- **Mots-clés:** pdf, json, structure, explorateur

## Présentation

Apres le chargement dun PDF, loutil genere le JSON OpenDataLoader puis affiche les titres, paragraphes, listes, tableaux, pages et bounding boxes dans une vue dexploration. Cela aide a verifier la qualite du parsing et la couche semantique.

## Entrées

- **Fichier PDF** (file)
- **Utiliser larbre de structure** (checkbox)
- **Assainir les donnees sensibles** (checkbox)
- **Pages** (text): e.g. 1,3,5-7
- **Filtre de noeuds** (select)
- **Terme de recherche** (text): e.g. revenue or heading

## Quand l'utiliser

- Pour déboguer et vérifier la qualité de l'extraction des données d'un fichier PDF avant de l'intégrer dans un pipeline de traitement automatisé.
- Lors de l'analyse de la hiérarchie sémantique d'un document complexe pour s'assurer que les titres, paragraphes et listes sont correctement identifiés.
- Pour inspecter visuellement les tableaux et leurs boîtes de délimitation afin de valider la précision de la reconnaissance structurelle.

## Fonctionnement

- Importez votre fichier PDF dans l'outil et spécifiez éventuellement les pages à analyser (par exemple : 1,3,5-7).
- Configurez les options d'extraction, telles que l'utilisation de l'arbre de structure, l'assainissement des données sensibles ou le filtrage par type de nœud (titres, tableaux, listes).
- L'outil traite le document et génère une structure JSON OpenDataLoader en arrière-plan.
- Explorez le résultat via une interface HTML interactive affichant les nœuds sémantiques, les métadonnées des pages et les boîtes de délimitation.

## Cas d'usage

- Audit de la qualité de conversion PDF vers JSON pour les développeurs intégrant des solutions d'extraction de données.
- Vérification de la structure des tableaux financiers ou des rapports de données avant leur traitement automatisé.
- Analyse de la hiérarchie des titres et des listes dans des documents juridiques ou des manuels techniques.

## Questions fréquentes

### Quels types d'éléments puis-je explorer avec cet outil ?

Vous pouvez explorer les titres, les paragraphes, les listes, les tableaux, ainsi que les métadonnées de page et les boîtes de délimitation (bounding boxes).

### Puis-je filtrer les résultats pour ne voir que les tableaux ?

Oui, l'option 'Filtre de nœuds' vous permet d'isoler spécifiquement les tableaux, les titres ou les listes pour une inspection ciblée.

### Est-il possible d'analyser seulement certaines pages du PDF ?

Absolument. Vous pouvez utiliser le champ 'Pages' pour définir des pages spécifiques ou des plages de pages (par exemple : 1, 3, 5-7).

### À quoi sert l'option 'Assainir les données sensibles' ?

Cette option permet de masquer ou de nettoyer les informations potentiellement confidentielles lors de la génération de la vue d'exploration JSON.

### Quel est le format de sortie de cet outil ?

L'outil génère un rapport interactif au format HTML qui présente visuellement la structure JSON OpenDataLoader extraite de votre PDF.

## Outils associés

- [Pont PDF (OCR) vers JSON structuré](https://elysiatools.com/fr/tools/ocr-pdf-to-structured-json-bridge): Extrait la couche texte du PDF avec la géométrie (lignes par position y, tableaux par écarts de colonnes, titres par taille de police, paires clé-valeur à deux-points) puis remplit champ par champ un JSON Schema fourni — libellés appariés par clés normalisées, valeurs coercées vers les types déclarés et validées par ajv.
- [Export d'annotations PDF](https://elysiatools.com/fr/tools/pdf-annotation-export): Extrait les annotations existantes (surlignages, commentaires, tampons, liens) d'un PDF en une chaîne JSON
- [Export de données de formulaire PDF](https://elysiatools.com/fr/tools/pdf-form-data-export): Lit les noms, types et valeurs actuelles des champs AcroForm d'un PDF et les exporte en chaîne JSON
- [Extracteur de tableaux PDF vers CSV/JSON](https://elysiatools.com/fr/tools/pdf-table-extractor-to-csv-json): Extrait des tableaux PDF avec OpenDataLoader et les exporte en JSON, CSV ou HTML
- [Convertisseur de PDF chiffre](https://elysiatools.com/fr/tools/encrypted-pdf-converter): Ouvre des PDF proteges avec le bon mot de passe et les exporte en Markdown, JSON ou texte
- [Extracteur de plage de pages PDF](https://elysiatools.com/fr/tools/pdf-page-range-extractor): Extrait uniquement une plage de pages PDF et lexporte en Markdown, JSON ou texte
- [Generateur PDF de programme fitness](https://elysiatools.com/fr/tools/fitness-workout-pdf-generator): Genere un PDF imprimable dentrainement depuis JSON ou CSV avec tableaux, cases de suivi et QR optionnels
- [Fusion de modele LibreOffice](https://elysiatools.com/fr/tools/libreoffice-template-fill-merge): Remplace les placeholders DOCX et rend en PDF style publipostage

## Exemples

- [Exemples PDF](https://elysiatools.com/fr/samples/pdf-samples): Exemples PDF generes par les outils du 2026-02-01 au 2026-02-10
- [Exemples JSON de Terraform Plan](https://elysiatools.com/fr/samples/terraform-plan-json-samples): Fichiers Terraform plan JSON pour visualiser les dependances et revoir les changements, proches de terraform show -json
- [Exemples JSON](https://elysiatools.com/fr/samples/json): Exemples de format JSON (JavaScript Object Notation) de structures simples à complexes
- [Exemples JSON de Chat](https://elysiatools.com/fr/samples/chat-transcript-json): Exemples JSON pour transcriptions de chat multi-rôles

## Contenu associé

- [Extraction OCR de documents](https://elysiatools.com/fr/hubs/document-ocr-extraction): Extrayez le texte OCR de scans et convertissez des pages ou images en Markdown, JSON, tableaux, légendes et segments prêts pour la recherche avec contrôle qualité.
- [Workflow de conversion, OCR et extraction PDF](https://elysiatools.com/fr/hubs/pdf-convert): Convertissez documents, pages wiki, commentaires et images en PDF, puis extrayez texte, images, tableaux, structure ou OCR depuis des PDFs existants.
- [Flux d'extraction et de diagnostic PDF](https://elysiatools.com/fr/hubs/pdf-extraction-debugging-workflows): Diagnostiquez les extractions PDF difficiles: chiffrement, securite, pages, ordre de lecture, OCR, tableaux et sorties structurees.
- [Preparation PDF pour LLM et RAG](https://elysiatools.com/fr/hubs/pdf-llm-rag-prep): Transformer des PDF en entrees propres, sures et citables pour resume LLM, embeddings, recherche et RAG.
