# Couche texte OCR PDF

Ajoute une couche OCR a un PDF scanne pour le rendre recherchable et copiable

> Page canonique: https://elysiatools.com/fr/tools/pdf-ocr-text-layer

- **Catégorie:** PDF Tools

- **Mots-clés:** pdf, ocr, tesseract, searchable, copyable, scan

## Présentation

Convertit les pages PDF en images, lance Tesseract page par page puis fusionne en PDF OCR recherchable.

## Entrées

- **PDF source** (file): Upload scanned PDF
- **Langues OCR** (text): eng or eng+chi_sim
- **DPI d'entree** (number)
- **Mode moteur OCR** (number)
- **Mode de segmentation de page** (number)

## Quand l'utiliser

- Rendre des documents numérisés ou des archives papier indexables par les moteurs de recherche.
- Extraire facilement du texte depuis des factures, contrats ou rapports scannés.
- Faciliter la copie de passages spécifiques dans des documents PDF qui ne sont que des images.

## Fonctionnement

- Téléversez votre fichier PDF scanné dans l'outil.
- Configurez les paramètres de langue et de résolution (DPI) pour optimiser la précision de la reconnaissance.
- Le moteur Tesseract analyse chaque page, identifie les caractères et génère une nouvelle version du PDF avec une couche texte intégrée.

## Cas d'usage

- Numérisation d'archives administratives pour faciliter la recherche documentaire.
- Conversion de contrats scannés en documents éditables pour extraire des clauses spécifiques.
- Indexation de livres ou de revues anciennes pour permettre la recherche par mots-clés.

## Questions fréquentes

### Qu'est-ce qu'une couche texte OCR ?

C'est une couche invisible ajoutée au-dessus de l'image de votre PDF qui contient le texte reconnu, permettant ainsi de le sélectionner, de le copier et de faire des recherches.

### Quelle résolution DPI dois-je choisir ?

Une résolution de 300 DPI est recommandée pour un équilibre optimal entre la qualité de la reconnaissance et la taille du fichier final.

### Puis-je traiter des documents dans plusieurs langues ?

Oui, vous pouvez spécifier plusieurs langues dans le champ dédié en utilisant le format approprié (ex: eng+fra).

### Le fichier original est-il modifié ?

L'outil génère un nouveau fichier PDF enrichi ; votre document source reste intact.

### Quelles sont les limites de taille de fichier ?

L'outil accepte des fichiers PDF jusqu'à 500 Mo pour le traitement.

## Outils associés

- [Réduction de Bruit PDF](https://elysiatools.com/fr/tools/pdf-denoise): Supprime le bruit visuel des pages PDF numérisées — bruit poivre et sel, grain aléatoire et voiles d'arrière-plan — à l'aide d'algorithmes réels de traitement d'image. Les pages de texte sont conservées en tant que contenu vectoriel consultable.
- [OCR de PDF numérisé vers Word](https://elysiatools.com/fr/tools/scanned-pdf-ocr-to-word): Rasterise les pages d’un PDF numérisé, reconnaît le texte avec Tesseract et exporte un DOCX modifiable.
- [Ajouter une signature PDF en ligne](https://elysiatools.com/fr/tools/pdf-add-signature-online): Ajoute une signature visible texte ou image sur un PDF
- [Filigrane PDF par lot](https://elysiatools.com/fr/tools/pdf-batch-watermark): Applique des filigranes texte a plusieurs PDF avec rotation, opacite et mosaïque
- [Pont PDF (OCR) vers JSON structuré](https://elysiatools.com/fr/tools/ocr-pdf-to-structured-json-bridge): Extrait la couche texte du PDF avec la géométrie (lignes par position y, tableaux par écarts de colonnes, titres par taille de police, paires clé-valeur à deux-points) puis remplit champ par champ un JSON Schema fourni — libellés appariés par clés normalisées, valeurs coercées vers les types déclarés et validées par ajv.
- [Redresser PDF](https://elysiatools.com/fr/tools/pdf-deskew): Détecte et corrige automatiquement les pages PDF inclinées. Préserve les pages de texte en tant que contenu vectoriel consultable et ne rasterise que les pages d'image (ex. numérisations).
- [Nettoyeur de bruit den-tete/pied PDF](https://elysiatools.com/fr/tools/pdf-header-footer-noise-remover): Compare lextraction avec et sans en-tetes/pieds pour reperer le bruit repetitif dans le texte
- [HTML d email vers PDF](https://elysiatools.com/fr/tools/libreoffice-html-mail-to-pdf): Rend le contenu HTML d un email en PDF en conservant la mise en forme de base

## Exemples

- [Exemples PDF](https://elysiatools.com/fr/samples/pdf-samples): Exemples PDF generes par les outils du 2026-02-01 au 2026-02-10
- [Exemples de Slides Markdown](https://elysiatools.com/fr/samples/md-slide-deck-to-pdf): Presentations Markdown style Remark/Marp pour tester l export PDF
- [Exemples de Texte Mixte Chinois-Anglais](https://elysiatools.com/fr/samples/text-chinese-english-mixed-samples): Fichiers texte d'échantillon avec contenu mixte chinois-anglais pour tester les outils d'espacement automatique
- [Échantillons de Convertisseur de Casse](https://elysiatools.com/fr/samples/text-case-formats): Échantillons de test pour la conversion de casse entre différentes conventions de nommage

## Contenu associé

- [Revision PDF pour archivage, accessibilite et confiance](https://elysiatools.com/fr/hubs/pdf-archival-accessibility-trust): Nettoyer les scans, ajouter l'OCR, preparer le PDF/A, verifier l'accessibilite, ajouter des signets et controler les signatures.
- [Preparation PDF pour LLM et RAG](https://elysiatools.com/fr/hubs/pdf-llm-rag-prep): Transformer des PDF en entrees propres, sures et citables pour resume LLM, embeddings, recherche et RAG.
- [Extraction OCR de documents](https://elysiatools.com/fr/hubs/document-ocr-extraction): Extrayez le texte OCR de scans et convertissez des pages ou images en Markdown, JSON, tableaux, légendes et segments prêts pour la recherche avec contrôle qualité.
- [Workflow de conversion, OCR et extraction PDF](https://elysiatools.com/fr/hubs/pdf-convert): Convertissez documents, pages wiki, commentaires et images en PDF, puis extrayez texte, images, tableaux, structure ou OCR depuis des PDFs existants.
