Tilbake til AllToolio

OCR skannet PDF: skannet PDF til tekst

Gjenkjenn tekst på skannede PDF-sider lokalt i nettleseren; PDF-en lastes ikke opp.

Gjør bilder om til redigerbar tekst Slipp bilder eller PDF-er her, eller lim inn et bilde hvor som helst på denne siden.

Filene dine blir i denne nettleseren. Ingen opplasting, konto eller lagrede dokumentdata.

Opptil 50 elementer i køen, inkludert opptil 50 PDF-sider. Bilder over 40 megapiksler blir nedskalert før OCR. GIF: bare første bilde.

Trykt tekst fungerer best. Håndskrift, uskarp eller svært liten tekst, tabeller og komplekse oppsett kan bli lest dårlig eller i feil rekkefølge. Språkfiler lastes ned ved første bruk (én til noen få MB hver); nettleseren kan mellomlagre dem.

Innstillinger for gjenkjenning

Kontroller de valgte språkene. Verktøyet oppdager ikke dokumentspråket automatisk.

Justerer kontrast og mørk bakgrunn; forstørrer små bilder. Forstørring gir ingen nye detaljer. Kildebildet beholdes for et nytt forsøk.

PDF-en lagrer sidebilder, så den kan bli stor. Den inneholder det gjenkjente utsnittet og rotasjonen. Alle elementer i køen må ha et PDF-resultat før nedlasting.

Angi sideområde og passord før du legger til PDF-er. Tomt område betyr alle sider; 8- betyr fra side 8 til slutten. Innstillingene gjelder for hver PDF du legger til. Hvis en PDF ikke åpnes, retter du dem og velger Gjenkjenn på nytt. Passordet tømmes etter åpning.

Slik kjører du OCR på en PDF

  1. For skannet PDF til tekst legger du til dokumentet og skriver inn passordet hvis det er beskyttet.
  2. Skriv inn sidetall som 1–3, 5, eller la området stå tomt for å velge alle sider.
  3. Sjekk meldingen om tekstlag. Hvis de fleste valgte sidene allerede inneholder tekst, følger du lenken PDF til tekst for å hente den ut uten OCR.
  4. Velg dokumentspråk, eventuelt et andrespråk og et passende oppsett. Juster en sideforhåndsvisning hvis retningen eller beskjæringen bør endres.
  5. Gjenkjenn de valgte sidene, rett den redigerbare teksten og last ned TXT. La søkbar PDF stå på hvis du også trenger den filen.

Når PDF OCR hjelper

  • Gjør ordene i en skannet kontrakt, et brev eller en arkivside tilgjengelige for kopiering.
  • Kjør gjenkjenning bare på relevante sider i stedet for å behandle hele dokumentet.
  • Se gjennom hver side ved siden av resultatet og rett navn eller tall før du lagrer.
  • Bruk en søkbar PDF når du vil finne ord og samtidig beholde sidebildene.
  • Endre beskjæringen eller leseoppsettet og gjenkjenn en vanskelig side på nytt.

Spørsmål om PDF OCR

Trenger en PDF med merkbar tekst OCR?

Vanligvis ikke. Verktøyet sjekker valgte sider for et tekstlag og viser deg til PDF til tekst når de fleste allerede har ett. Du kan likevel fortsette med OCR.

Hva påvirker gjenkjenningen på skannede sider?

Skarpe trykte sider fungerer vanligvis bedre enn håndskrift, uskarpe skanninger eller kompliserte tabeller. En skanning på rundt 300 DPI er et nyttig mål; forstørring av en dårlig skanning kan ikke gjenopprette manglende detaljer. Konfidens er bare motorens anslag.

Hvor mange sider kan jeg velge?

Du kan behandle opptil 50 PDF-sider i én kjøring, med maksimalt 50 elementer i køen totalt. Store dokumenter kan også være begrenset av minnet på enheten.

Kan PDF-en inneholde mer enn ett språk?

Velg blant 20 språkmodeller. Ett dokumentspråk er påkrevd, og et andrespråk er valgfritt. Velg språkene som brukes på sidene, fordi oppdagelsen ikke er automatisk.

Lastes PDF-en opp for gjenkjenning?

PDF-en behandles lokalt i nettleseren og lastes ikke opp. Språkfiler lastes ned første gang de trengs og kan bli liggende i mellomlageret. Dette nettstedet viser annonser.

Hva inneholder den søkbare PDF-en?

Den kombinerer den gjenkjente teksten med de opprinnelige sidebildene, noe som kan gjøre nedlastingen stor. Du kan også kopiere rettet tekst eller lagre den som TXT.

Andre alternativer for PDF-tekst