Înapoi la AllToolio

PDF OCR: extrage text din PDF scanat

Recunoaște text pe paginile PDF scanate local în browser; PDF-ul tău nu este încărcat.

Transformă imaginile în text editabil Trage aici imagini sau PDF-uri ori lipește o imagine oriunde pe această pagină.

Fișierele rămân în acest browser. Fără încărcări, conturi sau date de document salvate.

Până la 50 de elemente în coadă, inclusiv până la 50 de pagini PDF. Imaginile peste 40 de megapixeli sunt reduse înainte de OCR. GIF: doar primul cadru.

Textul tipărit funcționează cel mai bine. Scrisul de mână, textul neclar sau foarte mic, tabelele și aspectele complexe pot fi citite greșit sau în altă ordine. Fișierele de limbă se descarcă la prima utilizare (de la unul la câțiva MB fiecare); browserul le poate păstra în memoria cache.

Setări de recunoaștere

Verifică limbile selectate. Instrumentul nu detectează automat limba documentului.

Ajustează contrastul și fundalurile întunecate; mărește imaginile mici. Mărirea nu adaugă detalii. Imaginea sursă este păstrată pentru o altă încercare.

PDF-ul stochează imaginile paginilor, deci poate fi mare. Conține decupajul și rotirea recunoscute. Toate elementele din coadă trebuie să aibă un rezultat PDF înainte de descărcare.

Setează intervalul de pagini și parola înainte de a adăuga PDF-uri. Interval gol înseamnă toate paginile; 8- înseamnă de la pagina 8 până la sfârșit. Setările se aplică fiecărui PDF adăugat. Pentru un PDF eșuat, corectează-le și alege Recunoaște din nou. Parola este ștearsă după deschidere.

Cum să rulezi OCR pe un PDF

  1. Pentru a extrage text din PDF scanat, adaugă documentul și introdu parola dacă este protejat.
  2. Introdu numere de pagină precum 1–3, 5 sau lasă intervalul gol pentru a selecta toate paginile.
  3. Verifică notificarea despre stratul de text. Dacă majoritatea paginilor selectate conțin deja text, urmează linkul PDF în text pentru extragere fără OCR.
  4. Alege limba documentului, o a doua limbă opțională și un aspect potrivit. Ajustează previzualizarea unei pagini dacă orientarea sau decupajul necesită atenție.
  5. Recunoaște paginile selectate, corectează textul editabil și descarcă TXT. Lasă PDF cu căutare activat dacă ai nevoie și de acel fișier.

Când ajută OCR PDF

  • Fă cuvintele dintr-un contract scanat, o scrisoare sau o pagină de arhivă disponibile pentru copiere.
  • Rulează recunoașterea doar pe paginile relevante în loc să procesezi întregul document.
  • Inspectează fiecare pagină lângă rezultatul ei și corectează numele sau numerele înainte de salvare.
  • Folosește un PDF cu căutare când vrei să găsești cuvinte păstrând imaginile paginilor.
  • Schimbă decupajul sau aspectul de citire și recunoaște din nou o pagină dificilă.

Întrebări despre OCR PDF

Un PDF cu text selectabil are nevoie de OCR?

De obicei nu. Instrumentul verifică paginile selectate pentru un strat de text și te îndrumă către PDF în text când majoritatea au deja unul. Poți continua totuși cu OCR.

Ce afectează recunoașterea pe paginile scanate?

Paginile tipărite clare tind să funcționeze mai bine decât scrisul de mână, scanările neclare sau tabelele complicate. O scanare de aproximativ 300 DPI este o țintă utilă; mărirea unei scanări slabe nu poate recupera detaliile lipsă. Încrederea este doar estimarea motorului.

Câte pagini pot selecta?

Poți procesa până la 50 de pagini PDF într-o rulare, cu cel mult 50 de elemente în coadă în total. Documentele mari pot fi limitate și de memoria dispozitivului.

PDF-ul poate conține mai multe limbi?

Alege dintre 20 de modele de limbă. O limbă de document este obligatorie, iar a doua este opțională. Selectează limbile folosite pe pagini, deoarece detectarea nu este automată.

PDF-ul este încărcat pentru recunoaștere?

PDF-ul este procesat local în browser și nu este încărcat. Fișierele de limbă se descarcă prima dată când sunt necesare și pot rămâne în memoria cache. Acest site afișează reclame.

Ce conține PDF-ul cu căutare?

Combină textul recunoscut cu imaginile originale ale paginilor, ceea ce poate face descărcarea mare. Poți, de asemenea, să copiezi textul corectat sau să îl salvezi ca TXT.

Alte opțiuni pentru text PDF