PDF OCR: naskenované PDF na text
Rozpoznajte text na naskenovaných stranách PDF lokálne vo vašom prehliadači; vaše PDF sa nenahráva.
Vaše súbory zostávajú v tomto prehliadači. Žiadne nahrávanie, účty ani ukladanie údajov dokumentu.
Maximálne 50 položiek v poradí, vrátane až 50 strán PDF. Obrázky nad 40 megapixelov sa pred OCR zmenšia. GIF: iba prvý snímok.
Najlepšie funguje tlačený text. Rukopis, rozmazaný alebo veľmi malý text, tabuľky a zložité rozloženie sa môžu prečítať nesprávne alebo v inom poradí. Jazykové súbory sa pri prvom použití stiahnu (jeden až niekoľko MB každý); prehliadač ich môže uložiť do vyrovnávacej pamäte.
Väčšina vybraných strán v PDF už obsahuje text. Môžete pokračovať s OCR alebo priamo extrahovať existujúci text: Otvoriť PDF na text
Skontrolovať a uložiť
Istota rozpoznania je odhad samotného nástroja, nie miera správnosti. Dôležité detaily porovnajte s originálom.
Kopírovať všetko a Stiahnuť TXT používajú tento upravený text. Úprava položky, pridanie alebo odstránenie položiek alebo opätovné rozpoznanie obnoví toto pole z textov jednotlivých položiek.
Ručné opravy textu sa zahrnú iba do TXT. Prehľadávateľné PDF zachováva pôvodnú textovú vrstvu nástroja; porovnajte ju s obrázkami strán.
Ako spustiť OCR na PDF
- Ak chcete previesť naskenované PDF na text, pridajte dokument a zadajte jeho heslo, ak je chránený.
- Zadajte čísla strán, napríklad 1–3, 5, alebo pole nechajte prázdne, ak chcete vybrať všetky strany.
- Skontrolujte upozornenie na textovú vrstvu. Ak väčšina vybraných strán už obsahuje text, použite odkaz na PDF na text na extrakciu bez OCR.
- Vyberte jazyk dokumentu, voliteľný druhý jazyk a vhodné rozloženie. Upravte náhľad strany, ak si vyžaduje orientácia alebo výrez pozornosť.
- Rozpoznajte vybrané strany, opravte upraviteľný text a stiahnite TXT. Ak potrebujete aj tento súbor, nechajte zapnuté prehľadávateľné PDF.
Kedy PDF OCR pomáha
- Sprístupnite slová na kopírovanie z naskenovanej zmluvy, listu alebo archívnej strany.
- Spustite rozpoznávanie iba na relevantných stranách namiesto spracovania celého dokumentu.
- Skontrolujte každú stranu vedľa jej výsledku a pred uložením opravte mená alebo čísla.
- Použite prehľadávateľné PDF, ak chcete vyhľadávať slová a zároveň zachovať obrázky strán.
- Zmeňte výrez alebo rozloženie čítania a znova rozpoznajte náročnú stranu.
Otázky o PDF OCR
Potrebuje PDF s vyberateľným textom OCR?
Zvyčajne nie. Nástroj skontroluje vybrané strany na textovú vrstvu a ak väčšina už nejakú má, odkáže vás na PDF na text. Stále môžete pokračovať s OCR.
Čo ovplyvňuje rozpoznávanie na naskenovaných stranách?
Ostré tlačené strany zvyčajne fungujú lepšie ako rukopis, rozmazané skeny alebo zložité tabuľky. Sken okolo 300 DPI je užitočný cieľ; zväčšenie slabého skenu nedokáže obnoviť chýbajúce detaily. Istota je iba odhad nástroja.
Koľko strán môžem vybrať?
V jednom spustení môžete spracovať až 50 strán PDF, pričom celkové poradie môže mať najviac 50 položiek. Veľké dokumenty môžu byť obmedzené aj pamäťou vášho zariadenia.
Môže PDF obsahovať viac ako jeden jazyk?
Vyberte si z 20 jazykových modelov. Jeden jazyk dokumentu je povinný a druhý je voliteľný. Vyberte jazyky použité na stranách, pretože zisťovanie nie je automatické.
Nahráva sa PDF na rozpoznávanie?
PDF sa spracúva lokálne vo vašom prehliadači a nenahráva sa. Jazykové súbory sa stiahnu pri prvom použití a môžu zostať vo vyrovnávacej pamäti. Táto stránka zobrazuje reklamy.
Čo obsahuje prehľadávateľné PDF?
Spája rozpoznaný text s pôvodnými obrázkami strán, čo môže spôsobiť veľké sťahovanie. Môžete tiež skopírovať opravený text alebo ho uložiť ako TXT.