Zpět na AllToolio

PDF OCR: naskenované PDF na text

Rozpoznejte text na naskenovaných stránkách PDF místně v prohlížeči; PDF se nenahrává.

Převeďte obrázky na upravitelný text Přetáhněte sem obrázky nebo PDF, případně vložte obrázek kamkoli na této stránce.

Soubory zůstávají v tomto prohlížeči. Žádné nahrávání, účty ani ukládání dat dokumentu.

Až 50 položek ve frontě, včetně až 50 stránek PDF. Obrázky nad 40 megapixelů se před OCR zmenší. GIF: pouze první snímek.

Nejlépe funguje tištěný text. Rukopis, rozmazaný nebo velmi malý text, tabulky a složité rozvržení mohou být přečteny špatně nebo v jiném pořadí. Jazykové soubory se stahují při prvním použití (jeden až několik MB každý); prohlížeč je může uložit do mezipaměti.

Nastavení rozpoznávání

Zkontrolujte zvolené jazyky. Nástroj jazyk dokumentu nerozpoznává automaticky.

Upraví kontrast a tmavé pozadí; zvětší malé obrázky. Zvětšení nepřidá detaily. Zdrojový obrázek zůstává pro další pokus.

PDF ukládá obrázky stránek, takže může být velké. Obsahuje rozpoznaný ořez a otočení. Všechny položky fronty musí mít výsledek PDF, než je možné stahovat.

Nastavte rozsah stránek a heslo před přidáním PDF. Prázdný rozsah znamená všechny stránky; 8- znamená od 8. stránky do konce. Nastavení platí pro každé přidané PDF. U neúspěšného PDF je opravte a zvolte Znovu rozpoznat. Heslo se po otevření vymaže.

Jak spustit OCR na PDF

  1. Chcete-li převést naskenované PDF na text, přidejte dokument a zadejte heslo, pokud je chráněný.
  2. Zadejte čísla stránek, například 1–3, 5, nebo ponechte rozsah prázdný pro výběr všech stránek.
  3. Zkontrolujte upozornění na textovou vrstvu. Pokud většina vybraných stránek už text obsahuje, použijte odkaz PDF na text pro extrakci bez OCR.
  4. Zvolte jazyk dokumentu, volitelný druhý jazyk a vhodné rozvržení. Upravte náhled stránky, pokud potřebuje pozornost kvůli orientaci nebo ořezu.
  5. Rozpoznejte vybrané stránky, opravte upravitelný text a stáhněte TXT. Pokud potřebujete i tento soubor, ponechte prohledávatelné PDF zapnuté.

Kdy PDF OCR pomáhá

  • Zpřístupněte slova z naskenované smlouvy, dopisu nebo archivní stránky pro kopírování.
  • Spusťte rozpoznávání jen na relevantních stránkách místo zpracování celého dokumentu.
  • Prohlédněte si každou stránku vedle jejího výsledku a před uložením opravte jména nebo čísla.
  • Použijte prohledávatelné PDF, když chcete vyhledávat slova a zároveň zachovat obrázky stránek.
  • Změňte ořez nebo rozvržení čtení a obtížnou stránku rozpoznejte znovu.

Otázky k PDF OCR

Potřebuje PDF s vybíratelným textem OCR?

Obvykle ne. Nástroj zkontroluje vybrané stránky na textovou vrstvu a když ji většina už má, odkáže vás na PDF na text. S OCR můžete přesto pokračovat.

Co ovlivňuje rozpoznávání na naskenovaných stránkách?

Ostré tištěné stránky obvykle fungují lépe než rukopis, rozmazané skeny nebo složité tabulky. Užitečným cílem je sken kolem 300 DPI; zvětšení špatného skenu nemůže obnovit chybějící detaily. Přesnost rozpoznání je pouze odhad enginu.

Kolik stránek mohu vybrat?

V jednom běhu můžete zpracovat až 50 stránek PDF, celkově maximálně 50 položek fronty. Velké dokumenty mohou být také omezeny pamětí vašeho zařízení.

Může PDF obsahovat více než jeden jazyk?

Vyberte z 20 jazykových modelů. Jeden jazyk dokumentu je povinný a druhý je volitelný. Zvolte jazyky použité na stránkách, protože detekce není automatická.

Nahrává se PDF pro rozpoznávání?

PDF se zpracovává místně ve vašem prohlížeči a nenahrává se. Jazykové soubory se stahují při prvním použití a mohou zůstat v mezipaměti. Tento web zobrazuje reklamy.

Co obsahuje prohledávatelné PDF?

Kombinuje rozpoznaný text s původními obrázky stránek, což může zvětšit velikost stahování. Můžete také zkopírovat opravený text nebo jej uložit jako TXT.

Další možnosti textu z PDF