Tillbaka till AllToolio

OCR skannad PDF: skannad PDF till text

Känn igen text på skannade PDF-sidor lokalt i webbläsaren; din PDF laddas inte upp.

Gör om bilder till redigerbar text Släpp bilder eller PDF-filer här, eller klistra in en bild var som helst på sidan.

Dina filer stannar i den här webbläsaren. Inga uppladdningar, konton eller sparade dokumentdata.

Upp till 50 objekt i kön, varav upp till 50 PDF-sidor. Bilder över 40 megapixlar skalas ned före OCR. GIF: endast första bildrutan.

Tryckt text fungerar bäst. Handskrift, suddig eller mycket liten text, tabeller och komplexa layouter kan läsas fel eller i en annan ordning. Språkfiler laddas ned vid första användningen (en till några MB styck); webbläsaren kan cachelagra dem.

Inställningar för igenkänning

Kontrollera de valda språken. Verktyget identifierar inte dokumentets språk automatiskt.

Justerar kontrast och mörka bakgrunder samt förstorar små bilder. Förstoring tillför inga detaljer. Din ursprungsbild sparas för ett nytt försök.

PDF-filen lagrar sidbilder och kan därför bli stor. Den innehåller den igenkända beskärningen och rotationen. Alla objekt i kön måste ha ett PDF-resultat innan nedladdning.

Ange sidintervall och lösenord innan du lägger till PDF-filer. Tomt intervall betyder alla sidor; 8- betyder sida 8 till slutet. Inställningarna gäller varje tillagd PDF. Om en PDF inte kan öppnas, rätta inställningarna och välj Känn igen igen. Lösenordet rensas efter öppning.

Så kör du OCR på en PDF

  1. För att göra en skannad PDF till text lägger du till dokumentet och anger lösenordet om det är skyddat.
  2. Ange sidnummer som 1–3, 5, eller lämna intervallet tomt för att välja alla sidor.
  3. Kontrollera meddelandet om textlager. Om de flesta valda sidor redan innehåller text följer du länken PDF till text för extrahering utan OCR.
  4. Välj dokumentets språk, ett valfritt andra språk och en lämplig layout. Justera en sidförhandsvisning om orienteringen eller beskärningen behöver ses över.
  5. Känn igen de valda sidorna, rätta den redigerbara texten och ladda ned TXT. Låt sökbar PDF vara aktiverad om du också behöver den filen.

När PDF OCR hjälper

  • Gör orden i ett skannat avtal, brev eller arkivsida tillgängliga för kopiering.
  • Kör igenkänning endast på relevanta sidor i stället för att bearbeta hela dokumentet.
  • Granska varje sida bredvid sitt resultat och rätta namn eller nummer innan du sparar.
  • Använd en sökbar PDF när du vill kunna söka efter ord och samtidigt behålla sidbilderna.
  • Ändra beskärning eller läsordning och känn igen en svår sida igen.

Frågor om PDF OCR

Behöver en PDF med markerbar text OCR?

Oftast inte. Verktyget kontrollerar valda sidor för ett textlager och hänvisar till PDF till text när de flesta redan har ett. Du kan ändå fortsätta med OCR.

Vad påverkar igenkänningen på skannade sidor?

Skarpa tryckta sidor fungerar oftast bättre än handskrift, suddiga skanningar eller komplicerade tabeller. En skanning på omkring 300 DPI är ett bra riktmärke; att förstora en dålig skanning kan inte återställa saknade detaljer. Säkerheten är bara motorns uppskattning.

Hur många sidor kan jag välja?

Du kan bearbeta upp till 50 PDF-sidor i en körning, med högst 50 objekt i kön totalt. Stora dokument kan också begränsas av enhetens minne.

Kan PDF-filen innehålla mer än ett språk?

Välj bland 20 språkmodeller. Ett dokumentspråk krävs och ett andra är valfritt. Välj de språk som används på sidorna eftersom identifieringen inte är automatisk.

Laddas PDF-filen upp för igenkänning?

PDF-filen bearbetas lokalt i webbläsaren och laddas inte upp. Språkfiler laddas ned första gången de behövs och kan ligga kvar i cachen. Den här webbplatsen visar annonser.

Vad innehåller den sökbara PDF-filen?

Den kombinerar den igenkända texten med de ursprungliga sidbilderna, vilket kan göra nedladdningen stor. Du kan också kopiera rättad text eller spara den som TXT.

Andra alternativ för PDF-text