Torna ad AllToolio

PDF scansionato in testo con OCR

Riconosci il testo nelle pagine di un PDF scansionato localmente nel browser; il PDF non viene caricato.

Trasforma le immagini in testo modificabile Trascina qui immagini o PDF, oppure incolla un'immagine in qualsiasi punto di questa pagina.

I file restano in questo browser. Nessun caricamento, account o dato del documento salvato.

Fino a 50 elementi in coda, comprese fino a 50 pagine PDF. Le immagini oltre 40 megapixel vengono ridotte prima dell'OCR. GIF: solo il primo fotogramma.

Il testo stampato dà i risultati migliori. Scrittura a mano, testo sfocato o molto piccolo, tabelle e impaginazioni complesse possono essere letti male o in un ordine diverso. I file di lingua vengono scaricati al primo utilizzo (da uno a pochi MB ciascuno); il browser può conservarli nella cache.

Impostazioni di riconoscimento

Controlla le lingue selezionate. Lo strumento non rileva automaticamente la lingua del documento.

Corregge il contrasto e gli sfondi scuri; ingrandisce le immagini piccole. L'ingrandimento non aggiunge dettagli. L'immagine originale resta disponibile per un altro tentativo.

Il PDF contiene le immagini delle pagine, quindi può essere grande. Include il ritaglio e la rotazione riconosciuti. Il download è disponibile quando ogni elemento della coda ha un risultato PDF pronto.

Imposta l'intervallo di pagine e la password prima di aggiungere i PDF. Un intervallo vuoto significa tutte le pagine; 8- significa dalla pagina 8 alla fine. Le impostazioni valgono per ogni PDF aggiunto. Se l'apertura non riesce, correggile e scegli Riconosci di nuovo. La password viene cancellata dal campo dopo l'apertura.

Come eseguire l'OCR su un PDF

  1. Per convertire un PDF scansionato in testo, aggiungi il documento e inserisci la password se è protetto.
  2. Inserisci i numeri di pagina, per esempio 1–3, 5, oppure lascia vuoto l'intervallo per selezionare tutte le pagine.
  3. Controlla l'avviso sul livello di testo. Se la maggior parte delle pagine selezionate contiene già testo, segui il link PDF in testo per l'estrazione senza OCR.
  4. Scegli la lingua del documento, una seconda lingua facoltativa e un'impaginazione adatta. Regola l'anteprima di una pagina se orientamento o ritaglio richiedono attenzione.
  5. Riconosci le pagine selezionate, correggi il testo modificabile e scarica il TXT. Lascia attivo il PDF ricercabile se ti serve anche quel file.

Quando è utile l'OCR PDF

  • Rendi copiabili le parole di un contratto, una lettera o una pagina d'archivio scansionati.
  • Esegui il riconoscimento solo sulle pagine rilevanti invece di elaborare l'intero documento.
  • Esamina ogni pagina accanto al suo risultato e correggi nomi o numeri prima di salvare.
  • Usa un PDF ricercabile quando vuoi trovare le parole mantenendo le immagini delle pagine.
  • Cambia il ritaglio o l'impaginazione di lettura e riconosci di nuovo una pagina difficile.

Domande sull'OCR dei PDF

Un PDF con testo selezionabile ha bisogno dell'OCR?

Di solito no. Lo strumento controlla le pagine selezionate per un livello di testo e ti indirizza a PDF in testo quando la maggior parte ne ha già uno. Puoi comunque procedere con l'OCR.

Cosa influisce sul riconoscimento delle pagine scansionate?

Le pagine stampate nitide tendono a dare risultati migliori rispetto a scrittura a mano, scansioni sfocate o tabelle complicate. Una scansione intorno ai 300 DPI è un buon obiettivo; ingrandire una scansione scadente non recupera i dettagli mancanti. La confidenza è solo una stima del motore.

Quante pagine posso selezionare?

Puoi elaborare fino a 50 pagine PDF in una sola esecuzione, con non più di 50 elementi in coda in totale. I documenti grandi possono anche essere limitati dalla memoria del dispositivo.

Il PDF può contenere più di una lingua?

Scegli tra 20 modelli linguistici. Una lingua del documento è obbligatoria e una seconda è facoltativa. Seleziona le lingue usate nelle pagine perché il rilevamento non è automatico.

Il PDF viene caricato per il riconoscimento?

Il PDF viene elaborato localmente nel browser e non viene caricato. I file di lingua vengono scaricati la prima volta che servono e possono restare nella cache. Questo sito mostra annunci pubblicitari.

Cosa contiene il PDF ricercabile?

Combina il testo riconosciuto con le immagini originali delle pagine, il che può rendere il download grande. Puoi anche copiare il testo corretto o salvarlo come TXT.

Altre opzioni per il testo dei PDF