PDF OCR: szkennelt PDF szövegfelismerés
Ismerd fel a szöveget a szkennelt PDF-oldalakon helyben a böngésződben; a PDF nem kerül feltöltésre.
A fájlok ebben a böngészőben maradnak. Nincs feltöltés, fiók és mentett dokumentumadat.
Legfeljebb 50 sorban álló elem, ebből legfeljebb 50 PDF-oldal. A 40 megapixelnél nagyobb képek az OCR előtt kicsinyítésre kerülnek. GIF: csak az első képkocka.
A nyomtatott szöveg működik a legjobban. A kézírás, az elmosódott vagy nagyon kicsi szöveg, a táblázatok és a bonyolult elrendezések gyengén vagy más sorrendben olvashatók. A nyelvi fájlok első használatkor töltődnek le (egyenként egy-két MB); a böngésződ gyorsítótárazhatja őket.
Egy PDF kiválasztott oldalainak többsége már tartalmaz szöveget. Folytathatod az OCR-rel, vagy közvetlenül kinyerheted a meglévő szöveget: PDF megnyitása szövegként
Ellenőrzés és mentés
A felismerési bizonyosság a motor saját becslése, nem a helyesség mértéke. Hasonlítsd össze a fontos részleteket az eredetivel.
Az Összes másolása és a TXT letöltése ezt a szerkesztett szöveget használja. Egy elem szerkesztése, elemek hozzáadása vagy eltávolítása, illetve az újra felismerés az elemek szövegeiből építi újra ezt a mezőt.
A kézi szövegjavítások csak a TXT-be kerülnek bele. A kereshető PDF megtartja a motor eredeti szövegrétegét; hasonlítsd össze az oldalképekkel.
Hogyan futtass OCR-t egy PDF-en
- Szkennelt PDF szöveggé alakításához add hozzá a dokumentumot, és írd be a jelszavát, ha védett.
- Írj be oldalszámokat, például 1–3, 5, vagy hagyd üresen a tartományt az összes oldal kiválasztásához.
- Ellenőrizd a szövegrétegre vonatkozó figyelmeztetést. Ha a kiválasztott oldalak többsége már tartalmaz szöveget, kövesd a PDF szövegként hivatkozást az OCR nélküli kinyeréshez.
- Válaszd ki a dokumentum nyelvét, egy opcionális második nyelvet és a megfelelő elrendezést. Állítsd be az oldal előnézetét, ha a tájolása vagy a kivágása figyelmet igényel.
- Ismerd fel a kiválasztott oldalakat, javítsd a szerkeszthető szöveget, és töltsd le a TXT-t. Hagyd bekapcsolva a kereshető PDF-et, ha arra a fájlra is szükséged van.
Amikor a PDF OCR segít
- Tedd a szkennelt szerződés, levél vagy archív oldal szavait másolhatóvá.
- Csak a releváns oldalakon futtass felismerést a teljes dokumentum feldolgozása helyett.
- Vizsgáld meg az egyes oldalakat az eredményük mellett, és javítsd a neveket vagy számokat mentés előtt.
- Használj kereshető PDF-et, ha szavakat szeretnél keresni az oldalképek megtartása mellett.
- Változtasd meg a kivágást vagy az olvasási elrendezést, és ismerd fel újra a nehéz oldalt.
PDF OCR kérdések
Szükség van OCR-re, ha a PDF szövege kijelölhető?
Általában nem. Az eszköz ellenőrzi a kiválasztott oldalakon a szövegréteget, és a PDF szövegként lehetőségre irányít, ha a többségük már rendelkezik vele. Az OCR-rel ettől függetlenül folytathatod.
Mi befolyásolja a felismerést a szkennelt oldalakon?
Az éles nyomtatott oldalak általában jobban működnek, mint a kézírás, az elmosódott szkennelések vagy a bonyolult táblázatok. Egy körülbelül 300 DPI-s szkennelés hasznos cél; egy gyenge szkennelés nagyítása nem állítja vissza a hiányzó részleteket. A bizonyosság csak a motor becslése.
Hány oldalt választhatok ki?
Egy futtatásban legfeljebb 50 PDF-oldalt dolgozhatsz fel, összesen legfeljebb 50 sorban álló elemmel. A nagy dokumentumokat az eszközöd memóriája is korlátozhatja.
Tartalmazhat a PDF több nyelvet?
20 nyelvi modell közül választhatsz. Egy dokumentumnyelv kötelező, a második opcionális. Válaszd ki az oldalakon használt nyelveket, mert a felismerés nem automatikus.
Feltöltésre kerül a PDF a felismeréshez?
A PDF helyben, a böngésződben kerül feldolgozásra, és nem kerül feltöltésre. A nyelvi fájlok első szükségletkor töltődnek le, és gyorsítótárazva maradhatnak. Ez az oldal reklámokat jelenít meg.
Mit tartalmaz a kereshető PDF?
A felismert szöveget az eredeti oldalképekkel kombinálja, ami naggyá teheti a letöltést. A javított szöveget másolhatod, vagy TXT-ként mentheted.