PDF OCR: naskenované PDF na text
Rozpoznejte text na naskenovaných stránkách PDF místně v prohlížeči; PDF se nenahrává.
Soubory zůstávají v tomto prohlížeči. Žádné nahrávání, účty ani ukládání dat dokumentu.
Až 50 položek ve frontě, včetně až 50 stránek PDF. Obrázky nad 40 megapixelů se před OCR zmenší. GIF: pouze první snímek.
Nejlépe funguje tištěný text. Rukopis, rozmazaný nebo velmi malý text, tabulky a složité rozvržení mohou být přečteny špatně nebo v jiném pořadí. Jazykové soubory se stahují při prvním použití (jeden až několik MB každý); prohlížeč je může uložit do mezipaměti.
Většina vybraných stránek v PDF už obsahuje text. Můžete pokračovat s OCR, nebo rovnou extrahovat existující text: Otevřít PDF na text
Zkontrolovat a uložit
Přesnost rozpoznání je odhad enginu, nikoli míra správnosti. Důležité podrobnosti porovnejte s originálem.
Kopírovat vše a Stáhnout TXT používají tento upravený text. Úprava položky, přidání nebo odebrání položek či nové rozpoznání znovu sestaví toto pole z textů položek.
Ruční opravy textu se zahrnou pouze do TXT. Prohledávatelné PDF zachovává původní textovou vrstvu enginu; porovnejte ji s obrázky stránek.
Jak spustit OCR na PDF
- Chcete-li převést naskenované PDF na text, přidejte dokument a zadejte heslo, pokud je chráněný.
- Zadejte čísla stránek, například 1–3, 5, nebo ponechte rozsah prázdný pro výběr všech stránek.
- Zkontrolujte upozornění na textovou vrstvu. Pokud většina vybraných stránek už text obsahuje, použijte odkaz PDF na text pro extrakci bez OCR.
- Zvolte jazyk dokumentu, volitelný druhý jazyk a vhodné rozvržení. Upravte náhled stránky, pokud potřebuje pozornost kvůli orientaci nebo ořezu.
- Rozpoznejte vybrané stránky, opravte upravitelný text a stáhněte TXT. Pokud potřebujete i tento soubor, ponechte prohledávatelné PDF zapnuté.
Kdy PDF OCR pomáhá
- Zpřístupněte slova z naskenované smlouvy, dopisu nebo archivní stránky pro kopírování.
- Spusťte rozpoznávání jen na relevantních stránkách místo zpracování celého dokumentu.
- Prohlédněte si každou stránku vedle jejího výsledku a před uložením opravte jména nebo čísla.
- Použijte prohledávatelné PDF, když chcete vyhledávat slova a zároveň zachovat obrázky stránek.
- Změňte ořez nebo rozvržení čtení a obtížnou stránku rozpoznejte znovu.
Otázky k PDF OCR
Potřebuje PDF s vybíratelným textem OCR?
Obvykle ne. Nástroj zkontroluje vybrané stránky na textovou vrstvu a když ji většina už má, odkáže vás na PDF na text. S OCR můžete přesto pokračovat.
Co ovlivňuje rozpoznávání na naskenovaných stránkách?
Ostré tištěné stránky obvykle fungují lépe než rukopis, rozmazané skeny nebo složité tabulky. Užitečným cílem je sken kolem 300 DPI; zvětšení špatného skenu nemůže obnovit chybějící detaily. Přesnost rozpoznání je pouze odhad enginu.
Kolik stránek mohu vybrat?
V jednom běhu můžete zpracovat až 50 stránek PDF, celkově maximálně 50 položek fronty. Velké dokumenty mohou být také omezeny pamětí vašeho zařízení.
Může PDF obsahovat více než jeden jazyk?
Vyberte z 20 jazykových modelů. Jeden jazyk dokumentu je povinný a druhý je volitelný. Zvolte jazyky použité na stránkách, protože detekce není automatická.
Nahrává se PDF pro rozpoznávání?
PDF se zpracovává místně ve vašem prohlížeči a nenahrává se. Jazykové soubory se stahují při prvním použití a mohou zůstat v mezipaměti. Tento web zobrazuje reklamy.
Co obsahuje prohledávatelné PDF?
Kombinuje rozpoznaný text s původními obrázky stránek, což může zvětšit velikost stahování. Můžete také zkopírovat opravený text nebo jej uložit jako TXT.