Wróć do AllToolio

OCR PDF: zeskanowany PDF na tekst

Odczytaj tekst z wybranych stron skanu PDF lokalnie w przeglądarce; dokument nie jest przesyłany.

Zamień obraz na tekst do edycji Przeciągnij tutaj obrazy lub pliki PDF albo wklej obraz w dowolnym miejscu tej strony.

Pliki pozostają w tej przeglądarce. Bez wysyłania na serwer, konta i zapisywania danych dokumentu.

Maksymalnie 50 pozycji w kolejce, w tym do 50 stron PDF. Obrazy powyżej 40 megapikseli są zmniejszane przed OCR. GIF: tylko pierwsza klatka.

Najlepiej sprawdza się tekst drukowany. Pismo odręczne, niewyraźny lub bardzo drobny tekst, tabele i złożony układ mogą zostać odczytane błędnie lub w innej kolejności. Przy pierwszym użyciu pobierane są modele językowe (od jednego do kilku MB każdy); przeglądarka może zachować je w pamięci podręcznej.

Ustawienia rozpoznawania

Sprawdź wybrane języki. Narzędzie nie wykrywa automatycznie języka dokumentu.

Koryguje kontrast i ciemne tło oraz powiększa małe obrazy. Powiększanie nie dodaje szczegółów. Obraz źródłowy pozostaje dostępny do kolejnej próby.

PDF zawiera obrazy stron, więc może być duży. Uwzględnia rozpoznany kadr i obrót. Pobieranie jest dostępne, gdy każda pozycja kolejki ma gotowy wynik PDF.

Ustaw zakres stron i hasło przed dodaniem plików PDF. Pusty zakres oznacza wszystkie strony; 8- oznacza od strony 8 do końca. Ustawienia dotyczą każdego dodawanego PDF. Jeśli otwarcie się nie uda, popraw je i wybierz Rozpoznaj ponownie. Hasło jest usuwane z pola po otwarciu.

Jak odczytać zeskanowany dokument PDF

  1. Aby zamienić zeskanowany PDF na tekst, dodaj dokument i podaj hasło, jeśli plik jest nim zabezpieczony.
  2. Wpisz zakres, na przykład 1–3, 5, albo pozostaw pole puste, jeśli chcesz objąć wszystkie strony.
  3. Sprawdź informację o warstwie tekstowej. Gdy większość wybranych stron już ją ma, przejdź do narzędzia PDF na tekst.
  4. Wskaż język dokumentu, opcjonalny drugi język i układ strony. W razie potrzeby obróć lub przytnij podgląd.
  5. Uruchom OCR, popraw odczyt w polu tekstowym i pobierz TXT. Włączona opcja utworzy także przeszukiwalny PDF.

Do czego przydaje się OCR PDF

  • Skopiuj treść ze skanu pisma, którego słów nie da się zaznaczyć myszą.
  • Wybierz tylko potrzebne strony długiego dokumentu przed rozpoczęciem odczytu.
  • Porównaj wynik z obrazem strony i popraw nazwiska, daty lub liczby.
  • Utwórz PDF, w którym można wyszukiwać słowa, zachowując wygląd zeskanowanych stron.
  • Ponów odczyt trudnej strony po zmianie kadru, obrotu albo sposobu analizy układu.

Pytania o OCR dokumentów PDF

Czy potrzebuję OCR, jeśli mogę zaznaczyć tekst w PDF-ie?

Zwykle wystarczy wtedy zwykłe wydobycie tekstu. Narzędzie sprawdza wybrane strony i, gdy większość ma warstwę tekstową, pokazuje odnośnik do PDF na tekst. Nadal możesz uruchomić OCR.

Dlaczego skan może zostać odczytany błędnie?

Ostry tekst drukowany daje lepsze wyniki niż pismo ręczne, rozmazane strony lub skomplikowane tabele. Dla skanu dokumentu rozsądnym punktem wyjścia jest około 300 DPI. Powiększenie nie odzyska brakujących szczegółów; confidence to tylko ocena silnika.

Ile stron mogę przetworzyć naraz?

W jednym przebiegu wybierzesz najwyżej 50 stron PDF, a cała kolejka może mieć do 50 pozycji. Bardzo duży dokument może też przekroczyć dostępną pamięć urządzenia.

Co zrobić z dokumentem w dwóch językach?

Wybierz język główny i opcjonalnie drugi spośród 20 dostępnych modeli. Dopasuj je do treści stron, ponieważ narzędzie nie wykrywa języka automatycznie.

Czy mój dokument trafia na serwer?

PDF jest przetwarzany lokalnie w Twojej przeglądarce i nie jest przesyłany. Pliki językowe pobierają się przy pierwszym użyciu i mogą być zapisane w pamięci podręcznej. Witryna pokazuje reklamy.

Co zawiera wynikowy przeszukiwalny PDF?

Plik łączy rozpoznany tekst z obrazami stron, więc może być duży. Poprawiony tekst możesz również skopiować albo zapisać jako TXT.

Inne sposoby pracy z PDF