# PDF OCR-Textebene

Fuegt gescannten PDFs eine OCR-Textebene fuer Suche und Kopieren hinzu

> Kanonische Seite: https://elysiatools.com/de/tools/pdf-ocr-text-layer

- **Kategorie:** PDF Tools

- **Schlagwörter:** pdf, ocr, tesseract, searchable, copyable, scan

## Überblick

Rastert PDF-Seiten zu Bildern, fuehrt Tesseract pro Seite aus und fuegt alles als durchsuchbares OCR-PDF zusammen.

## Eingaben

- **Quell-PDF** (file): Upload scanned PDF
- **OCR-Sprachen** (text): eng or eng+chi_sim
- **Eingabe-DPI** (number)
- **OCR-Engine-Modus** (number)
- **Seitensegmentierungsmodus** (number)

## Wann verwenden

- Wenn Sie Text aus einem reinen Bild-PDF kopieren oder zitieren müssen.
- Wenn Sie große Mengen gescannter Dokumente nach bestimmten Begriffen durchsuchen möchten.
- Wenn Sie Archiv-Scans für eine digitale Dokumentenverwaltung aufbereiten wollen.

## Funktionsweise

- Laden Sie Ihr gescanntes PDF-Dokument hoch.
- Passen Sie bei Bedarf die DPI-Auflösung und den Segmentierungsmodus (PSM) an.
- Das Tool rastert die Seiten, erkennt den Text mittels Tesseract und bettet eine durchsuchbare Ebene ein.
- Laden Sie Ihr neues, OCR-optimiertes PDF direkt herunter.

## Anwendungsfälle

- Digitalisierung von alten Papierakten für die Volltextsuche.
- Extrahieren von Daten aus gescannten Rechnungen oder Verträgen.
- Vorbereitung von wissenschaftlichen Scans für die Zitat-Erstellung.

## Häufig gestellte Fragen

### Was ist eine OCR-Textebene?

Es ist eine unsichtbare Schicht über dem Bild Ihres Scans, die den erkannten Text enthält und so das Suchen und Markieren ermöglicht.

### Welche DPI-Einstellung ist empfehlenswert?

Für eine präzise Texterkennung sind 300 DPI der Standardwert, der ein optimales Gleichgewicht zwischen Qualität und Verarbeitungszeit bietet.

### Kann ich mehrere Sprachen gleichzeitig erkennen?

Ja, Sie können Sprachen kombinieren, indem Sie diese im Feld 'OCR-Sprachen' mit einem Pluszeichen trennen (z. B. 'deu+eng').

### Warum ist die Dateigröße nach der OCR-Verarbeitung anders?

Die Dateigröße kann sich leicht ändern, da eine zusätzliche Textebene in das PDF eingebettet wird.

### Gibt es eine Begrenzung für die Dateigröße?

Ja, das Tool unterstützt PDF-Dateien bis zu einer Größe von 500 MB.

## Ähnliche Tools

- [PDF Entrauschen](https://elysiatools.com/de/tools/pdf-denoise): Entfernt visuelles Rauschen aus eingescannten PDF-Seiten — Salz-und-Pfeffer-Flecken, zufälliges Korn und schwache Hintergrundschleier — mit echten Bildverarbeitungsalgorithmen. Textseiten bleiben als durchsuchbarer Vektorinhalt erhalten.
- [OCR von gescanntem PDF zu Word](https://elysiatools.com/de/tools/scanned-pdf-ocr-to-word): Rasterisiert gescannte PDF-Seiten, erkennt Text mit Tesseract und exportiert ein bearbeitbares DOCX.
- [PDF online signieren](https://elysiatools.com/de/tools/pdf-add-signature-online): Fuegt einem PDF eine sichtbare Text- oder Bildsignatur hinzu
- [PDF-Batch-Wasserzeichen](https://elysiatools.com/de/tools/pdf-batch-watermark): Wendet Textwasserzeichen auf mehrere PDFs mit Rotation, Deckkraft und Kachelung an
- [OCR-PDF-zu-strukturiertes-JSON-Brücke](https://elysiatools.com/de/tools/ocr-pdf-to-structured-json-bridge): Extrahiert die PDF-Textebene mit Geometrie (Zeilen nach y-Position, Tabellen nach Spaltenlücken, Überschriften nach Schriftgröße, Doppelpunkt-Schlüsselwerte) und füllt Feld für Feld ein benutzerdefiniertes JSON Schema — Labels werden über normalisierte Schlüssel gepaart, Werte zu deklarierten Typen konvertiert und mit ajv validiert.
- [PDF Begradigen](https://elysiatools.com/de/tools/pdf-deskew): Erkennt und korrigiert automatisch geneigte PDF-Seiten. Erhält Textseiten als durchsuchbaren Vektorinhalt und rasterisiert nur Bildseiten (z. B. Scans).
- [PDF-Header-Footer-Rauschfilter](https://elysiatools.com/de/tools/pdf-header-footer-noise-remover): Vergleicht Extraktion mit und ohne Header/Footer, um wiederkehrendes Textrauschen zu erkennen
- [E-Mail-HTML zu PDF](https://elysiatools.com/de/tools/libreoffice-html-mail-to-pdf): Rendert E-Mail-HTML zu PDF und erhalt die grundlegende Formatierung

## Beispiele

- [PDF-Beispiele](https://elysiatools.com/de/samples/pdf-samples): Generierte PDF-Beispiele von Tools zwischen 2026-02-01 und 2026-02-10
- [Markdown Foliensatz Beispiele](https://elysiatools.com/de/samples/md-slide-deck-to-pdf): Remark/Marp Markdown Decks zum Testen des PDF Exports
- [Beispiele für Gemischten Chinesisch-Englischen Text](https://elysiatools.com/de/samples/text-chinese-english-mixed-samples): Beispieltextdateien mit gemischtem chinesisch-englischem Inhalt zum Testen von Tools für automatisches Spacing
- [Großschreibungs-Konverter Beispiele](https://elysiatools.com/de/samples/text-case-formats): Testbeispiele für die Konvertierung der Groß-/Kleinschreibung zwischen verschiedenen Benennungskonventionen

## Verwandte Inhalte

- [PDF-Pruefung fuer Archivierung, Barrierefreiheit und Vertrauen](https://elysiatools.com/de/hubs/pdf-archival-accessibility-trust): Scans bereinigen, OCR ergaenzen, PDF/A vorbereiten, Barrierefreiheit pruefen, Lesezeichen anlegen und Signaturen verifizieren.
- [PDF-Vorbereitung fur LLM und RAG](https://elysiatools.com/de/hubs/pdf-llm-rag-prep): PDFs in saubere, sichere und zitierbare Eingaben fur LLM-Zusammenfassung, Embeddings, Suche und RAG verwandeln.
- [Dokumenten-OCR-Extraktion](https://elysiatools.com/de/hubs/document-ocr-extraction): Extrahieren Sie OCR-Text aus Scans und wandeln Sie Dokumentseiten oder Bilder in Markdown, JSON, Tabellen, Bildbeschreibungen und retrieval-fertige Segmente mit Qualitätsprüfung um.
- [PDF-Konvertierung, OCR und Extraktion](https://elysiatools.com/de/hubs/pdf-convert): Wandeln Sie Office-Dateien, Wiki-Seiten, Kommentare und Bilder in PDFs um und extrahieren Sie Text, Bilder, Tabellen, Struktur oder OCR aus bestehenden PDFs.
