PDF OCR: skannatun PDF:n tekstintunnistus
Tunnista tekstiä skannatuilta PDF-sivuilta paikallisesti selaimessasi; PDF-tiedostoasi ei lähetetä.
Tiedostosi pysyvät tässä selaimessa. Ei lähetyksiä, tilejä tai tallennettuja asiakirjatietoja.
Enintään 50 jonossa olevaa kohdetta, mukaan lukien enintään 50 PDF-sivua. Yli 40 megapikselin kuvat pienennetään ennen OCR:ää. GIF: vain ensimmäinen ruutu.
Painettu teksti toimii parhaiten. Käsinkirjoitus, epätarkka tai hyvin pieni teksti, taulukot ja monimutkaiset asettelut voivat tulla luetuiksi huonosti tai eri järjestyksessä. Kielitiedostot ladataan ensimmäisellä käyttökerralla (yhdestä muutamaan megatavuun kukin); selaimesi voi tallentaa ne välimuistiin.
Useimmat valitut sivut yhdessä PDF-tiedostossa sisältävät jo tekstiä. Voit jatkaa OCR:llä tai poimia olemassa olevan tekstin suoraan: Avaa PDF tekstiksi
Tarkista ja tallenna
Tunnistuksen varmuus on moottorin oma arvio, ei mittari oikeellisuudesta. Vertaa tärkeitä yksityiskohtia alkuperäiseen.
Kopioi kaikki ja Lataa TXT käyttävät tätä muokattua tekstiä. Kohteen muokkaaminen, kohteiden lisääminen tai poistaminen tai uudelleen tunnistaminen rakentaa tämän kentän uudelleen kohteiden teksteistä.
Manuaaliset tekstikorjaukset sisältyvät vain TXT-tiedostoon. Hakukelpoinen PDF säilyttää moottorin alkuperäisen tekstikerroksen; vertaa sitä sivujen kuviin.
Näin suoritat OCR:n PDF-tiedostolle
- Skannatun PDF:n tekstintunnistusta varten lisää asiakirjasi ja syötä sen salasana, jos se on suojattu.
- Syötä sivunumerot, kuten 1–3, 5, tai jätä alue tyhjäksi, jos haluat valita kaikki sivut.
- Tarkista tekstikerrosta koskeva ilmoitus. Jos useimmat valitut sivut sisältävät jo tekstiä, seuraa sen PDF tekstiksi -linkkiä poimiaksesi tekstin ilman OCR:ää.
- Valitse asiakirjan kieli, valinnainen toinen kieli ja sopiva asettelu. Säädä sivun esikatselua, jos sen suunta tai rajaus vaatii huomiota.
- Tunnista valitut sivut, korjaa muokattava teksti ja lataa TXT. Jätä hakukelpoinen PDF käyttöön, jos tarvitset myös sen tiedoston.
Milloin PDF OCR auttaa
- Tee skannatun sopimuksen, kirjeen tai arkistosivun sanoista kopioitavia.
- Suorita tunnistus vain olennaisille sivuille sen sijaan, että käsittelisit koko asiakirjan.
- Tarkastele jokaista sivua tuloksensa vieressä ja korjaa nimet tai numerot ennen tallentamista.
- Käytä hakukelpoista PDF-tiedostoa, kun haluat etsiä sanoja säilyttäen sivujen kuvat.
- Muuta rajausta tai lukuasettelua ja tunnista vaikea sivu uudelleen.
PDF OCR -kysymyksiä
Tarvitseeko PDF, jossa on valittavaa tekstiä, OCR:ää?
Yleensä ei. Työkalu tarkistaa valituilta sivuilta tekstikerroksen ja ohjaa sinut PDF tekstiksi -työkaluun, kun useimmilla sellainen jo on. Voit silti jatkaa OCR:llä.
Mikä vaikuttaa tunnistukseen skannatuilla sivuilla?
Terävät painetut sivut toimivat yleensä paremmin kuin käsinkirjoitus, epätarkat skannaukset tai monimutkaiset taulukot. Noin 300 DPI:n skannaus on hyvä tavoite; huonon skannauksen suurentaminen ei palauta puuttuvia yksityiskohtia. Varmuus on vain moottorin arvio.
Kuinka monta sivua voin valita?
Voit käsitellä enintään 50 PDF-sivua yhdellä suorituksella, ja jonossa saa olla yhteensä enintään 50 kohdetta. Suuret asiakirjat voivat myös rajoittua laitteesi muistin mukaan.
Voiko PDF sisältää useamman kuin yhden kielen?
Valitse 20 kielimallista. Yksi asiakirjakieli vaaditaan ja toinen on valinnainen. Valitse sivuilla käytetyt kielet, koska tunnistus ei ole automaattista.
Lähetetäänkö PDF tunnistusta varten?
PDF käsitellään paikallisesti selaimessasi, eikä sitä lähetetä. Kielitiedostot ladataan ensimmäisellä käyttökerralla ja voivat jäädä välimuistiin. Tämä sivusto näyttää mainoksia.
Mitä hakukelpoinen PDF sisältää?
Se yhdistää tunnistetun tekstin alkuperäisiin sivukuviin, mikä voi tehdä latauksesta suuren. Voit myös kopioida korjatun tekstin tai tallentaa sen TXT-muodossa.