# Extracteur de texte barre PDF

Detecte le texte barre dans les PDF de revision et genere un rapport pour contrats et brouillons

> Page canonique: https://elysiatools.com/fr/tools/pdf-strikethrough-review-extractor

- **Catégorie:** Developer Tools

- **Mots-clés:** pdf, strikethrough, review

## Présentation

Apres le chargement dun PDF, loutil active la detection de texte barre dOpenDataLoader et extrait le texte supprime ou marque pour revision depuis JSON et Markdown afin de verifier rapidement les differences.

## Entrées

- **Fichier PDF** (file)
- **Pages** (text): e.g. 1,3,5-7
- **Utiliser larbre de structure** (checkbox)

## Quand l'utiliser

- Lors de la révision de contrats juridiques pour identifier précisément les clauses supprimées par une contrepartie.
- Pour auditer des documents de conformité où les anciennes règles ont été barrées au profit de nouvelles versions.
- Dans un flux de travail éditorial pour extraire les corrections et les suppressions suggérées dans un manuscrit.

## Fonctionnement

- Téléchargez votre fichier PDF contenant du texte barré ou des annotations de révision.
- Spécifiez les pages à analyser et choisissez d'utiliser l'arbre de structure pour une détection contextuelle précise.
- L'outil active l'algorithme OpenDataLoader pour isoler les caractères et mots formatés avec un trait de suppression.
- Un rapport HTML est généré, listant l'intégralité du texte supprimé pour une vérification rapide.

## Cas d'usage

- Comparaison de versions de contrats pour lister les suppressions effectuées par le service juridique.
- Extraction de corrections dans des épreuves de mise en page avant la publication finale.
- Audit de politiques internes pour archiver les anciennes mentions invalidées par un trait de suppression.

## Questions fréquentes

### Quels types de fichiers sont supportés ?

L'outil traite exclusivement les fichiers au format PDF.

### Puis-je limiter l'extraction à certaines pages ?

Oui, vous pouvez définir des pages spécifiques ou des plages de pages comme '1, 3, 5-7' dans les options.

### À quoi sert l'option 'Arbre de structure' ?

Elle utilise les métadonnées internes du PDF pour améliorer la précision de la détection du texte barré.

### Le texte barré manuellement avec un crayon est-il détecté ?

L'outil détecte le texte possédant l'attribut de formatage 'barré' ou marqué via les outils de révision PDF standards.

### Sous quel format le résultat est-il fourni ?

Le résultat est exporté sous forme d'un rapport HTML structuré.

## Outils associés

- [Generateur de rapport daudit daccessibilite](https://elysiatools.com/fr/tools/accessibility-audit-report-generator): Audite du HTML ou une URL pour detecter des problemes WCAG courants et exporte un PDF structure
- [Nettoyeur de bruit den-tete/pied PDF](https://elysiatools.com/fr/tools/pdf-header-footer-noise-remover): Compare lextraction avec et sans en-tetes/pieds pour reperer le bruit repetitif dans le texte
- [Inspecteur de PDF balise](https://elysiatools.com/fr/tools/tagged-pdf-inspector): Compare lextraction avec et sans StructTree pour voir si le PDF contient une structure balisee utile
- [Extracteur de plage de pages PDF](https://elysiatools.com/fr/tools/pdf-page-range-extractor): Extrait uniquement une plage de pages PDF et lexporte en Markdown, JSON ou texte
- [Analyseur de PDF riches en formules et graphiques](https://elysiatools.com/fr/tools/formula-chart-heavy-pdf-analyzer): Compare lextraction locale et hybrid dOpenDataLoader afin didentifier les pages qui meritent une aide IA
- [Pont PDF (OCR) vers JSON structuré](https://elysiatools.com/fr/tools/ocr-pdf-to-structured-json-bridge): Extrait la couche texte du PDF avec la géométrie (lignes par position y, tableaux par écarts de colonnes, titres par taille de police, paires clé-valeur à deux-points) puis remplit champ par champ un JSON Schema fourni — libellés appariés par clés normalisées, valeurs coercées vers les types déclarés et validées par ajv.
- [Extracteur dimages et captions PDF](https://elysiatools.com/fr/tools/pdf-image-caption-extractor): Extrait les images PDF, associe les captions voisines et genere un index HTML navigable
- [Validateur d'arbre de structure logique PDF (rôles WCAG)](https://elysiatools.com/fr/tools/pdf-logical-structure-tree-validator): Audite l'arbre de structure logique PDF/UA-1 : le RoleMap aboutit-il à des types standard, H1–H6 sautent-ils des niveaux ou le premier titre n'est-il pas H1, Figure/Formula manquent-ils d'Alt, la chaîne de langue est-elle déterminable, l'ordre MCID structure/contenu diverge-t-il ; arbre et points de contrôle Matterhorn inclus.

## Exemples

- [Exemples PDF](https://elysiatools.com/fr/samples/pdf-samples): Exemples PDF generes par les outils du 2026-02-01 au 2026-02-10
- [Exemples de Slides Markdown](https://elysiatools.com/fr/samples/md-slide-deck-to-pdf): Presentations Markdown style Remark/Marp pour tester l export PDF
- [Échantillons d'Extracteur de Journal des Changements](https://elysiatools.com/fr/samples/changelog-extractor): Différents formats de journaux des changements pour tester les outils d'analyse et d'extraction
- [Exemples d'Extracteur de Numéros de Téléphone](https://elysiatools.com/fr/samples/phone-number-extractor): Collection de texte mixte contenant des numéros de téléphone de divers pays pour les tests d'extraction

## Contenu associé

- [Flux d'extraction et de diagnostic PDF](https://elysiatools.com/fr/hubs/pdf-extraction-debugging-workflows): Diagnostiquez les extractions PDF difficiles: chiffrement, securite, pages, ordre de lecture, OCR, tableaux et sorties structurees.
- [Preparation PDF pour LLM et RAG](https://elysiatools.com/fr/hubs/pdf-llm-rag-prep): Transformer des PDF en entrees propres, sures et citables pour resume LLM, embeddings, recherche et RAG.
