Gescannte PDF in Text umwandeln
Text auf gescannten PDF-Seiten lokal in Ihrem Browser erkennen; Ihr PDF wird nicht hochgeladen.
Ihre Dateien bleiben in diesem Browser. Kein Upload, kein Konto, keine gespeicherten Dokumentdaten.
Bis zu 50 Einträge in der Warteschlange, darunter bis zu 50 PDF-Seiten. Bilder über 40 Megapixel werden vor der OCR verkleinert. GIF: nur das erste Einzelbild.
Gedruckter Text funktioniert am besten. Handschrift, unscharfer oder sehr kleiner Text, Tabellen und komplexe Layouts können schlecht oder in anderer Reihenfolge gelesen werden. Sprachdateien werden bei der ersten Verwendung heruntergeladen (je ein bis einige MB); Ihr Browser kann sie zwischenspeichern.
Die meisten ausgewählten Seiten in einem PDF enthalten bereits Text. Sie können mit OCR fortfahren oder den vorhandenen Text direkt extrahieren: PDF zu Text öffnen
Prüfen und speichern
Die Konfidenz ist eine Schätzung der Engine, kein Maß für Korrektheit. Vergleichen Sie wichtige Details mit dem Original.
Alle kopieren und TXT herunterladen verwenden diesen bearbeiteten Text. Das Bearbeiten eines Eintrags, das Hinzufügen oder Entfernen von Einträgen oder erneutes Erkennen baut dieses Feld aus den Eintragstexten neu auf.
Manuelle Textkorrekturen fließen nur in die TXT ein. Das durchsuchbare PDF behält die ursprüngliche Textebene der Engine; vergleichen Sie es mit den Seitenbildern.
So führen Sie OCR für ein PDF aus
- Um eine gescannte PDF in Text umzuwandeln, fügen Sie Ihr Dokument hinzu und geben Sie das Passwort ein, falls es geschützt ist.
- Geben Sie Seitenzahlen wie 1–3, 5 ein oder lassen Sie den Bereich leer, um alle Seiten auszuwählen.
- Prüfen Sie den Hinweis zur Textebene. Wenn die meisten ausgewählten Seiten bereits Text enthalten, folgen Sie dem Link PDF zu Text, um ohne OCR zu extrahieren.
- Wählen Sie die Dokumentsprache, eine optionale zweite Sprache und ein passendes Layout. Passen Sie eine Seitenvorschau an, wenn Ausrichtung oder Zuschnitt Aufmerksamkeit benötigen.
- Erkennen Sie die ausgewählten Seiten, korrigieren Sie den bearbeitbaren Text und laden Sie TXT herunter. Lassen Sie das durchsuchbare PDF aktiviert, wenn Sie diese Datei ebenfalls benötigen.
Wann PDF OCR hilft
- Machen Sie die Wörter in einem gescannten Vertrag, Brief oder Archivblatt zum Kopieren verfügbar.
- Führen Sie die Erkennung nur für relevante Seiten aus, statt das gesamte Dokument zu verarbeiten.
- Prüfen Sie jede Seite neben ihrem Ergebnis und korrigieren Sie Namen oder Zahlen vor dem Speichern.
- Verwenden Sie ein durchsuchbares PDF, wenn Sie Wörter finden möchten und gleichzeitig die Seitenbilder behalten wollen.
- Ändern Sie Zuschnitt oder Leselayout und erkennen Sie eine schwierige Seite erneut.
Fragen zu PDF OCR
Braucht ein PDF mit auswählbarem Text OCR?
Normalerweise nicht. Das Tool prüft ausgewählte Seiten auf eine Textebene und verweist Sie auf PDF zu Text, wenn die meisten bereits eine haben. Sie können trotzdem mit OCR fortfahren.
Was beeinflusst die Erkennung auf gescannten Seiten?
Scharfe gedruckte Seiten funktionieren in der Regel besser als Handschrift, unscharfe Scans oder komplizierte Tabellen. Ein Scan mit etwa 300 DPI ist ein nützlicher Richtwert; das Vergrößern eines schlechten Scans kann fehlende Details nicht wiederherstellen. Die Konfidenz ist nur eine Schätzung der Engine.
Wie viele Seiten kann ich auswählen?
Sie können bis zu 50 PDF-Seiten in einem Durchlauf verarbeiten, mit insgesamt nicht mehr als 50 Einträgen in der Warteschlange. Große Dokumente können auch durch den Speicher Ihres Geräts eingeschränkt sein.
Kann das PDF mehr als eine Sprache enthalten?
Wählen Sie aus 20 Sprachmodellen. Eine Dokumentsprache ist erforderlich, eine zweite optional. Wählen Sie die auf den Seiten verwendeten Sprachen, da die Erkennung nicht automatisch erfolgt.
Wird das PDF zur Erkennung hochgeladen?
Das PDF wird lokal in Ihrem Browser verarbeitet und nicht hochgeladen. Sprachdateien werden beim ersten Bedarf heruntergeladen und können zwischengespeichert bleiben. Diese Website zeigt Werbung an.
Was enthält das durchsuchbare PDF?
Es kombiniert den erkannten Text mit den ursprünglichen Seitenbildern, was den Download groß machen kann. Sie können korrigierten Text auch kopieren oder als TXT speichern.