Späť na AllToolio

PDF OCR: naskenované PDF na text

Rozpoznajte text na naskenovaných stranách PDF lokálne vo vašom prehliadači; vaše PDF sa nenahráva.

Premeňte obrázky na upraviteľný text Presuňte sem obrázky alebo PDF súbory, prípadne vložte obrázok kamkoľvek na tejto stránke.

Vaše súbory zostávajú v tomto prehliadači. Žiadne nahrávanie, účty ani ukladanie údajov dokumentu.

Maximálne 50 položiek v poradí, vrátane až 50 strán PDF. Obrázky nad 40 megapixelov sa pred OCR zmenšia. GIF: iba prvý snímok.

Najlepšie funguje tlačený text. Rukopis, rozmazaný alebo veľmi malý text, tabuľky a zložité rozloženie sa môžu prečítať nesprávne alebo v inom poradí. Jazykové súbory sa pri prvom použití stiahnu (jeden až niekoľko MB každý); prehliadač ich môže uložiť do vyrovnávacej pamäte.

Nastavenia rozpoznávania

Skontrolujte vybrané jazyky. Nástroj automaticky nezisťuje jazyk dokumentu.

Upraví kontrast a tmavé pozadie; zväčší malé obrázky. Zväčšenie nepridá detaily. Pôvodný obrázok zostáva k dispozícii pre ďalší pokus.

PDF ukladá obrázky strán, takže môže byť veľké. Obsahuje rozpoznaný výrez a otočenie. Všetky položky v poradí musia mať výsledok PDF pred stiahnutím.

Nastavte rozsah strán a heslo pred pridaním PDF. Prázdny rozsah znamená všetky strany; 8- znamená od strany 8 po koniec. Nastavenia sa vzťahujú na každé pridané PDF. Ak sa PDF nepodarí otvoriť, opravte ich a zvoľte Rozpoznať znova. Heslo sa po otvorení vymaže.

Ako spustiť OCR na PDF

  1. Ak chcete previesť naskenované PDF na text, pridajte dokument a zadajte jeho heslo, ak je chránený.
  2. Zadajte čísla strán, napríklad 1–3, 5, alebo pole nechajte prázdne, ak chcete vybrať všetky strany.
  3. Skontrolujte upozornenie na textovú vrstvu. Ak väčšina vybraných strán už obsahuje text, použite odkaz na PDF na text na extrakciu bez OCR.
  4. Vyberte jazyk dokumentu, voliteľný druhý jazyk a vhodné rozloženie. Upravte náhľad strany, ak si vyžaduje orientácia alebo výrez pozornosť.
  5. Rozpoznajte vybrané strany, opravte upraviteľný text a stiahnite TXT. Ak potrebujete aj tento súbor, nechajte zapnuté prehľadávateľné PDF.

Kedy PDF OCR pomáha

  • Sprístupnite slová na kopírovanie z naskenovanej zmluvy, listu alebo archívnej strany.
  • Spustite rozpoznávanie iba na relevantných stranách namiesto spracovania celého dokumentu.
  • Skontrolujte každú stranu vedľa jej výsledku a pred uložením opravte mená alebo čísla.
  • Použite prehľadávateľné PDF, ak chcete vyhľadávať slová a zároveň zachovať obrázky strán.
  • Zmeňte výrez alebo rozloženie čítania a znova rozpoznajte náročnú stranu.

Otázky o PDF OCR

Potrebuje PDF s vyberateľným textom OCR?

Zvyčajne nie. Nástroj skontroluje vybrané strany na textovú vrstvu a ak väčšina už nejakú má, odkáže vás na PDF na text. Stále môžete pokračovať s OCR.

Čo ovplyvňuje rozpoznávanie na naskenovaných stranách?

Ostré tlačené strany zvyčajne fungujú lepšie ako rukopis, rozmazané skeny alebo zložité tabuľky. Sken okolo 300 DPI je užitočný cieľ; zväčšenie slabého skenu nedokáže obnoviť chýbajúce detaily. Istota je iba odhad nástroja.

Koľko strán môžem vybrať?

V jednom spustení môžete spracovať až 50 strán PDF, pričom celkové poradie môže mať najviac 50 položiek. Veľké dokumenty môžu byť obmedzené aj pamäťou vášho zariadenia.

Môže PDF obsahovať viac ako jeden jazyk?

Vyberte si z 20 jazykových modelov. Jeden jazyk dokumentu je povinný a druhý je voliteľný. Vyberte jazyky použité na stranách, pretože zisťovanie nie je automatické.

Nahráva sa PDF na rozpoznávanie?

PDF sa spracúva lokálne vo vašom prehliadači a nenahráva sa. Jazykové súbory sa stiahnu pri prvom použití a môžu zostať vo vyrovnávacej pamäti. Táto stránka zobrazuje reklamy.

Čo obsahuje prehľadávateľné PDF?

Spája rozpoznaný text s pôvodnými obrázkami strán, čo môže spôsobiť veľké sťahovanie. Môžete tiež skopírovať opravený text alebo ho uložiť ako TXT.

Ďalšie možnosti práce s textom v PDF