PDF scansionato in testo con OCR
Riconosci il testo nelle pagine di un PDF scansionato localmente nel browser; il PDF non viene caricato.
I file restano in questo browser. Nessun caricamento, account o dato del documento salvato.
Fino a 50 elementi in coda, comprese fino a 50 pagine PDF. Le immagini oltre 40 megapixel vengono ridotte prima dell'OCR. GIF: solo il primo fotogramma.
Il testo stampato dà i risultati migliori. Scrittura a mano, testo sfocato o molto piccolo, tabelle e impaginazioni complesse possono essere letti male o in un ordine diverso. I file di lingua vengono scaricati al primo utilizzo (da uno a pochi MB ciascuno); il browser può conservarli nella cache.
La maggior parte delle pagine selezionate in un PDF contiene già del testo. Puoi procedere con l'OCR oppure estrarre direttamente il testo esistente: Apri PDF in testo
Controlla e salva
La confidenza è una stima del motore, non una misura della correttezza. Confronta i dettagli importanti con l'originale.
Copia tutto e Scarica TXT usano il testo di questo campo. Modificare un elemento, aggiungere o rimuovere elementi oppure riconoscere di nuovo ricostruisce questo campo dai testi dei singoli elementi.
Le correzioni manuali del testo finiscono solo nel TXT. Il PDF ricercabile conserva il livello di testo originale del motore OCR; confrontalo con le immagini delle pagine.
Come eseguire l'OCR su un PDF
- Per convertire un PDF scansionato in testo, aggiungi il documento e inserisci la password se è protetto.
- Inserisci i numeri di pagina, per esempio 1–3, 5, oppure lascia vuoto l'intervallo per selezionare tutte le pagine.
- Controlla l'avviso sul livello di testo. Se la maggior parte delle pagine selezionate contiene già testo, segui il link PDF in testo per l'estrazione senza OCR.
- Scegli la lingua del documento, una seconda lingua facoltativa e un'impaginazione adatta. Regola l'anteprima di una pagina se orientamento o ritaglio richiedono attenzione.
- Riconosci le pagine selezionate, correggi il testo modificabile e scarica il TXT. Lascia attivo il PDF ricercabile se ti serve anche quel file.
Quando è utile l'OCR PDF
- Rendi copiabili le parole di un contratto, una lettera o una pagina d'archivio scansionati.
- Esegui il riconoscimento solo sulle pagine rilevanti invece di elaborare l'intero documento.
- Esamina ogni pagina accanto al suo risultato e correggi nomi o numeri prima di salvare.
- Usa un PDF ricercabile quando vuoi trovare le parole mantenendo le immagini delle pagine.
- Cambia il ritaglio o l'impaginazione di lettura e riconosci di nuovo una pagina difficile.
Domande sull'OCR dei PDF
Un PDF con testo selezionabile ha bisogno dell'OCR?
Di solito no. Lo strumento controlla le pagine selezionate per un livello di testo e ti indirizza a PDF in testo quando la maggior parte ne ha già uno. Puoi comunque procedere con l'OCR.
Cosa influisce sul riconoscimento delle pagine scansionate?
Le pagine stampate nitide tendono a dare risultati migliori rispetto a scrittura a mano, scansioni sfocate o tabelle complicate. Una scansione intorno ai 300 DPI è un buon obiettivo; ingrandire una scansione scadente non recupera i dettagli mancanti. La confidenza è solo una stima del motore.
Quante pagine posso selezionare?
Puoi elaborare fino a 50 pagine PDF in una sola esecuzione, con non più di 50 elementi in coda in totale. I documenti grandi possono anche essere limitati dalla memoria del dispositivo.
Il PDF può contenere più di una lingua?
Scegli tra 20 modelli linguistici. Una lingua del documento è obbligatoria e una seconda è facoltativa. Seleziona le lingue usate nelle pagine perché il rilevamento non è automatico.
Il PDF viene caricato per il riconoscimento?
Il PDF viene elaborato localmente nel browser e non viene caricato. I file di lingua vengono scaricati la prima volta che servono e possono restare nella cache. Questo sito mostra annunci pubblicitari.
Cosa contiene il PDF ricercabile?
Combina il testo riconosciuto con le immagini originali delle pagine, il che può rendere il download grande. Puoi anche copiare il testo corretto o salvarlo come TXT.