PDF scanné en texte
Reconnaissez le texte des pages PDF scannées localement dans votre navigateur ; votre PDF n'est pas envoyé.
Vos fichiers restent dans ce navigateur. Aucun envoi, aucun compte, aucune donnée de document enregistrée.
Jusqu'à 50 éléments en file d'attente, dont jusqu'à 50 pages PDF. Les images de plus de 40 mégapixels sont réduites avant l'OCR. GIF : première image uniquement.
Le texte imprimé donne les meilleurs résultats. L'écriture manuscrite, le texte flou ou très petit, les tableaux et les mises en page complexes peuvent être mal lus ou dans un ordre différent. Les fichiers de langue sont téléchargés à la première utilisation (de un à quelques Mo chacun) ; votre navigateur peut les mettre en cache.
La plupart des pages sélectionnées d'un PDF contiennent déjà du texte. Vous pouvez continuer avec l'OCR ou extraire directement le texte existant : Ouvrir PDF en texte
Vérifier et enregistrer
La confiance est l'estimation du moteur, pas une mesure d'exactitude. Comparez les détails importants avec l'original.
Tout copier et Télécharger TXT utilisent ce texte modifié. Modifier un élément, ajouter ou supprimer des éléments, ou reconnaître à nouveau reconstruit ce champ à partir des textes des éléments.
Les corrections manuelles du texte ne sont incluses que dans le TXT. Le PDF avec recherche conserve la couche de texte d'origine du moteur OCR ; comparez-la avec les images des pages.
Comment lancer l'OCR sur un PDF
- Pour convertir un PDF scanné en texte, ajoutez votre document et saisissez son mot de passe s'il est protégé.
- Saisissez des numéros de page comme 1–3, 5, ou laissez la plage vide pour sélectionner toutes les pages.
- Consultez l'avis sur la couche de texte. Si la plupart des pages sélectionnées contiennent déjà du texte, suivez son lien PDF en texte pour extraire sans OCR.
- Choisissez la langue du document, une deuxième langue facultative et une disposition adaptée. Ajustez l'aperçu d'une page si son orientation ou son recadrage le nécessite.
- Reconnaissez les pages sélectionnées, corrigez le texte modifiable et téléchargez le TXT. Laissez le PDF avec recherche activé si vous avez aussi besoin de ce fichier.
Quand l'OCR PDF est utile
- Rendez copiables les mots d'un contrat, d'une lettre ou d'une page d'archive scannés.
- Lancez la reconnaissance uniquement sur les pages utiles au lieu de traiter tout le document.
- Inspectez chaque page à côté de son résultat et corrigez les noms ou les nombres avant d'enregistrer.
- Utilisez un PDF avec recherche pour retrouver des mots tout en conservant les images des pages.
- Changez le recadrage ou la disposition de lecture et reconnaissez à nouveau une page difficile.
Questions sur l'OCR PDF
Un PDF avec texte sélectionnable a-t-il besoin de l'OCR ?
En général non. L'outil vérifie la couche de texte des pages sélectionnées et vous oriente vers PDF en texte lorsque la plupart en ont déjà une. Vous pouvez tout de même continuer avec l'OCR.
Qu'est-ce qui influence la reconnaissance sur les pages scannées ?
Les pages imprimées nettes donnent généralement de meilleurs résultats que l'écriture manuscrite, les scans flous ou les tableaux compliqués. Un scan d'environ 300 DPI est un bon objectif ; agrandir un mauvais scan ne restaure pas les détails manquants. La confiance n'est que l'estimation du moteur.
Combien de pages puis-je sélectionner ?
Vous pouvez traiter jusqu'à 50 pages PDF en un seul traitement, avec au maximum 50 éléments en file d'attente au total. Les documents volumineux peuvent aussi être limités par la mémoire de votre appareil.
Le PDF peut-il contenir plusieurs langues ?
Choisissez parmi 20 modèles de langue. Une langue de document est obligatoire et une deuxième est facultative. Sélectionnez les langues utilisées sur les pages, car la détection n'est pas automatique.
Le PDF est-il envoyé pour la reconnaissance ?
Le PDF est traité localement dans votre navigateur et n'est pas envoyé. Les fichiers de langue sont téléchargés la première fois qu'ils sont nécessaires et peuvent rester en cache. Ce site affiche des publicités.
Que contient le PDF avec recherche ?
Il combine le texte reconnu avec les images d'origine des pages, ce qui peut rendre le téléchargement volumineux. Vous pouvez aussi copier le texte corrigé ou l'enregistrer en TXT.