Zurück zu AllToolio

Gescannte PDF in Text umwandeln

Text auf gescannten PDF-Seiten lokal in Ihrem Browser erkennen; Ihr PDF wird nicht hochgeladen.

Bilder in bearbeitbaren Text umwandeln Bilder oder PDFs hier ablegen oder ein Bild an beliebiger Stelle dieser Seite einfügen.

Ihre Dateien bleiben in diesem Browser. Kein Upload, kein Konto, keine gespeicherten Dokumentdaten.

Bis zu 50 Einträge in der Warteschlange, darunter bis zu 50 PDF-Seiten. Bilder über 40 Megapixel werden vor der OCR verkleinert. GIF: nur das erste Einzelbild.

Gedruckter Text funktioniert am besten. Handschrift, unscharfer oder sehr kleiner Text, Tabellen und komplexe Layouts können schlecht oder in anderer Reihenfolge gelesen werden. Sprachdateien werden bei der ersten Verwendung heruntergeladen (je ein bis einige MB); Ihr Browser kann sie zwischenspeichern.

Erkennungseinstellungen

Prüfen Sie die ausgewählten Sprachen. Das Tool erkennt die Dokumentsprache nicht automatisch.

Kontrast und dunkle Hintergründe anpassen; kleine Bilder vergrößern. Vergrößern bringt keine Details hinzu. Ihr Quellbild bleibt für einen weiteren Versuch erhalten.

Das PDF speichert Seitenbilder, daher kann es groß sein. Es enthält den erkannten Zuschnitt und die Drehung. Alle Einträge der Warteschlange müssen ein PDF-Ergebnis haben, bevor der Download möglich ist.

Legen Sie Seitenbereich und Passwort fest, bevor Sie PDFs hinzufügen. Ein leerer Bereich bedeutet alle Seiten; 8- bedeutet Seite 8 bis zum Ende. Die Einstellungen gelten für jedes hinzugefügte PDF. Bei einem fehlgeschlagenen PDF korrigieren Sie sie und wählen Sie Erneut erkennen. Das Passwort wird nach dem Öffnen gelöscht.

So führen Sie OCR für ein PDF aus

  1. Um eine gescannte PDF in Text umzuwandeln, fügen Sie Ihr Dokument hinzu und geben Sie das Passwort ein, falls es geschützt ist.
  2. Geben Sie Seitenzahlen wie 1–3, 5 ein oder lassen Sie den Bereich leer, um alle Seiten auszuwählen.
  3. Prüfen Sie den Hinweis zur Textebene. Wenn die meisten ausgewählten Seiten bereits Text enthalten, folgen Sie dem Link PDF zu Text, um ohne OCR zu extrahieren.
  4. Wählen Sie die Dokumentsprache, eine optionale zweite Sprache und ein passendes Layout. Passen Sie eine Seitenvorschau an, wenn Ausrichtung oder Zuschnitt Aufmerksamkeit benötigen.
  5. Erkennen Sie die ausgewählten Seiten, korrigieren Sie den bearbeitbaren Text und laden Sie TXT herunter. Lassen Sie das durchsuchbare PDF aktiviert, wenn Sie diese Datei ebenfalls benötigen.

Wann PDF OCR hilft

  • Machen Sie die Wörter in einem gescannten Vertrag, Brief oder Archivblatt zum Kopieren verfügbar.
  • Führen Sie die Erkennung nur für relevante Seiten aus, statt das gesamte Dokument zu verarbeiten.
  • Prüfen Sie jede Seite neben ihrem Ergebnis und korrigieren Sie Namen oder Zahlen vor dem Speichern.
  • Verwenden Sie ein durchsuchbares PDF, wenn Sie Wörter finden möchten und gleichzeitig die Seitenbilder behalten wollen.
  • Ändern Sie Zuschnitt oder Leselayout und erkennen Sie eine schwierige Seite erneut.

Fragen zu PDF OCR

Braucht ein PDF mit auswählbarem Text OCR?

Normalerweise nicht. Das Tool prüft ausgewählte Seiten auf eine Textebene und verweist Sie auf PDF zu Text, wenn die meisten bereits eine haben. Sie können trotzdem mit OCR fortfahren.

Was beeinflusst die Erkennung auf gescannten Seiten?

Scharfe gedruckte Seiten funktionieren in der Regel besser als Handschrift, unscharfe Scans oder komplizierte Tabellen. Ein Scan mit etwa 300 DPI ist ein nützlicher Richtwert; das Vergrößern eines schlechten Scans kann fehlende Details nicht wiederherstellen. Die Konfidenz ist nur eine Schätzung der Engine.

Wie viele Seiten kann ich auswählen?

Sie können bis zu 50 PDF-Seiten in einem Durchlauf verarbeiten, mit insgesamt nicht mehr als 50 Einträgen in der Warteschlange. Große Dokumente können auch durch den Speicher Ihres Geräts eingeschränkt sein.

Kann das PDF mehr als eine Sprache enthalten?

Wählen Sie aus 20 Sprachmodellen. Eine Dokumentsprache ist erforderlich, eine zweite optional. Wählen Sie die auf den Seiten verwendeten Sprachen, da die Erkennung nicht automatisch erfolgt.

Wird das PDF zur Erkennung hochgeladen?

Das PDF wird lokal in Ihrem Browser verarbeitet und nicht hochgeladen. Sprachdateien werden beim ersten Bedarf heruntergeladen und können zwischengespeichert bleiben. Diese Website zeigt Werbung an.

Was enthält das durchsuchbare PDF?

Es kombiniert den erkannten Text mit den ursprünglichen Seitenbildern, was den Download groß machen kann. Sie können korrigierten Text auch kopieren oder als TXT speichern.

Weitere Optionen für PDF-Text