# Debogueur dordre de lecture PDF

Compare lordre brut dun PDF et XY-Cut++ pour reperer les problemes de lecture sur des mises en page complexes

> Page canonique: https://elysiatools.com/fr/tools/pdf-reading-order-debugger

- **Catégorie:** Developer Tools

- **Mots-clés:** pdf, reading order, xycut

## Présentation

Chargez un PDF et loutil executera OpenDataLoader avec `readingOrder=off` puis `readingOrder=xycut` afin de produire une comparaison page par page. Cest utile pour les rapports multi-colonnes, brochures et mises en page complexes.

## Entrées

- **Fichier PDF** (file)
- **Utiliser larbre de structure** (checkbox)
- **Inclure en-tetes et pieds** (checkbox)
- **Pages** (text): e.g. 1,3,5-7

## Quand l'utiliser

- Lors de l'extraction de texte de documents PDF comportant plusieurs colonnes ou des encadrés.
- Pour vérifier si l'activation de l'algorithme XY-Cut++ améliore la cohérence du flux de lecture.
- Avant d'automatiser le traitement de documents complexes pour s'assurer que le texte est lu dans le bon ordre.

## Fonctionnement

- Téléchargez votre fichier PDF et sélectionnez les pages spécifiques à analyser.
- L'outil traite le document deux fois : une fois sans ordre de lecture et une fois avec XY-Cut++.
- Il compare les résultats textuels page par page pour détecter les divergences structurelles.
- Un rapport HTML est généré, mettant en évidence les zones où l'ordre de lecture diffère.

## Cas d'usage

- Analyse de rapports financiers multi-colonnes pour éviter le mélange des données entre les sections.
- Vérification de l'ordre de lecture des articles de recherche scientifique contenant des graphiques et des notes latérales.
- Audit de brochures marketing complexes pour garantir une extraction de texte fluide pour les outils de traduction.

## Questions fréquentes

### Qu'est-ce que l'algorithme XY-Cut++ ?

C'est une méthode de segmentation récursive qui analyse la mise en page pour ordonner le texte logiquement.

### Pourquoi l'ordre de lecture brut est-il parfois incorrect ?

Les PDF enregistrent souvent le texte selon l'ordre de création des objets, pas selon leur position visuelle.

### Puis-je analyser seulement certaines pages ?

Oui, vous pouvez spécifier des numéros de pages ou des plages (ex: 1, 3-5) dans les options.

### L'outil modifie-t-il mon fichier PDF original ?

Non, il analyse le contenu et génère un rapport de comparaison séparé sans altérer le fichier source.

### À quoi sert l'option 'Arbre de structure' ?

Elle permet d'utiliser les balises internes du PDF, si elles existent, pour guider l'ordre de lecture.

## Outils associés

- [Analyseur de PDF riches en formules et graphiques](https://elysiatools.com/fr/tools/formula-chart-heavy-pdf-analyzer): Compare lextraction locale et hybrid dOpenDataLoader afin didentifier les pages qui meritent une aide IA
- [Nettoyeur de bruit den-tete/pied PDF](https://elysiatools.com/fr/tools/pdf-header-footer-noise-remover): Compare lextraction avec et sans en-tetes/pieds pour reperer le bruit repetitif dans le texte
- [Inspecteur de PDF balise](https://elysiatools.com/fr/tools/tagged-pdf-inspector): Compare lextraction avec et sans StructTree pour voir si le PDF contient une structure balisee utile
- [Explorateur de structure JSON PDF](https://elysiatools.com/fr/tools/pdf-to-json-structure-explorer): Extrait la structure JSON OpenDataLoader dun PDF et affiche titres, paragraphes, tableaux, listes et bounding boxes
- [Pont PDF (OCR) vers JSON structuré](https://elysiatools.com/fr/tools/ocr-pdf-to-structured-json-bridge): Extrait la couche texte du PDF avec la géométrie (lignes par position y, tableaux par écarts de colonnes, titres par taille de police, paires clé-valeur à deux-points) puis remplit champ par champ un JSON Schema fourni — libellés appariés par clés normalisées, valeurs coercées vers les types déclarés et validées par ajv.
- [Scanner de prompt injection PDF](https://elysiatools.com/fr/tools/pdf-prompt-injection-scanner): Compare des extractions securisees et non securisees pour detecter le texte cache, le contenu hors page et dautres risques PDF
- [Convertisseur PDF vers Markdown](https://elysiatools.com/fr/tools/pdf-to-markdown): Convertit les documents PDF au format Markdown avec extraction de texte et préservation du formatage
- [PDF vers Texte Avancé](https://elysiatools.com/fr/tools/pdf-to-text-advanced): Convertisseur PDF vers texte avancé avec sélection de pages, options de format et extraction de métadonnées

## Exemples

- [Exemples PDF](https://elysiatools.com/fr/samples/pdf-samples): Exemples PDF generes par les outils du 2026-02-01 au 2026-02-10
- [Exemples de Slides Markdown](https://elysiatools.com/fr/samples/md-slide-deck-to-pdf): Presentations Markdown style Remark/Marp pour tester l export PDF
- [Exemples ICS du Planificateur Multi-Fuseaux](https://elysiatools.com/fr/samples/time-zone-workflow-scheduler-ics-samples): Fichiers ICS reprenant la meme structure que Time Zone Workflow Scheduler, avec plusieurs VEVENT de creneaux candidats
- [Echantillons OFD](https://elysiatools.com/fr/samples/ofd-samples): Echantillons OFD pour tests d analyse de documents a mise en page fixe GB/T 33190

## Contenu associé

- [Flux d'extraction et de diagnostic PDF](https://elysiatools.com/fr/hubs/pdf-extraction-debugging-workflows): Diagnostiquez les extractions PDF difficiles: chiffrement, securite, pages, ordre de lecture, OCR, tableaux et sorties structurees.
