Gescande PDF naar tekst met PDF OCR
Herkende tekst op gescande PDF-pagina's lokaal in je browser; je PDF wordt niet geüpload.
Je bestanden blijven in deze browser. Geen uploads, accounts of opgeslagen documentgegevens.
Maximaal 50 items in de wachtrij, waaronder maximaal 50 PDF-pagina's. Afbeeldingen boven 40 megapixels worden verkleind voor OCR. GIF: alleen het eerste frame.
Gedrukte tekst werkt het beste. Handschrift, onscherpe of zeer kleine tekst, tabellen en complexe lay-outs kunnen slecht of in een andere volgorde worden gelezen. Taalbestanden worden bij het eerste gebruik gedownload (elk één tot een paar MB); je browser kan ze opslaan in de cache.
De meeste geselecteerde pagina's in een PDF bevatten al tekst. Je kunt doorgaan met OCR of de bestaande tekst direct extraheren: PDF naar tekst openen
Controleren en opslaan
Confidence is de eigen schatting van de engine, geen maat voor correctheid. Vergelijk belangrijke details met het origineel.
Alles kopiëren en TXT downloaden gebruiken deze bewerkte tekst. Een item bewerken, items toevoegen of verwijderen, of opnieuw herkennen bouwt dit veld opnieuw op uit de itemteksten.
Handmatige tekstcorrecties komen alleen in de TXT. De doorzoekbare PDF behoudt de originele tekstlaag van de engine; vergelijk die met de pagina-afbeeldingen.
Zo voer je OCR uit op een PDF
- Voeg voor gescande PDF naar tekst je document toe en voer het wachtwoord in als het beveiligd is.
- Voer paginanummers in zoals 1–3, 5, of laat het bereik leeg om elke pagina te selecteren.
- Controleer de melding over de tekstlaag. Als de meeste geselecteerde pagina's al tekst bevatten, volg dan de link PDF naar tekst voor extractie zonder OCR.
- Kies de documenttaal, een optionele tweede taal en een geschikte lay-out. Pas een paginavoorbeeld aan als de oriëntatie of uitsnede aandacht nodig heeft.
- Herkende de geselecteerde pagina's, corrigeer de bewerkbare tekst en download TXT. Laat doorzoekbare PDF aan staan als je dat bestand ook nodig hebt.
Wanneer PDF OCR helpt
- Maak de woorden in een gescand contract, brief of archiefpagina beschikbaar om te kopiëren.
- Voer herkenning alleen uit op relevante pagina's in plaats van het hele document te verwerken.
- Bekijk elke pagina naast het resultaat en corrigeer namen of nummers voordat je opslaat.
- Gebruik een doorzoekbare PDF als je woorden wilt vinden terwijl de pagina-afbeeldingen behouden blijven.
- Wijzig de uitsnede of leeslay-out en herken een moeilijke pagina opnieuw.
Vragen over PDF OCR
Heeft een PDF met selecteerbare tekst OCR nodig?
Meestal niet. De tool controleert geselecteerde pagina's op een tekstlaag en verwijst je naar PDF naar tekst als de meeste er al een hebben. Je kunt nog steeds doorgaan met OCR.
Wat beïnvloedt de herkenning op gescande pagina's?
Scherpe gedrukte pagina's werken meestal beter dan handschrift, onscherpe scans of ingewikkelde tabellen. Een scan rond 300 DPI is een nuttig doel; het vergroten van een slechte scan kan ontbrekend detail niet herstellen. Confidence is alleen de schatting van de engine.
Hoeveel pagina's kan ik selecteren?
Je kunt maximaal 50 PDF-pagina's in één run verwerken, met in totaal niet meer dan 50 items in de wachtrij. Grote documenten kunnen ook beperkt worden door het geheugen van je apparaat.
Kan de PDF meer dan één taal bevatten?
Kies uit 20 taalmodellen. Eén documenttaal is vereist en een tweede is optioneel. Selecteer de talen die op de pagina's voorkomen, want detectie is niet automatisch.
Wordt de PDF geüpload voor herkenning?
De PDF wordt lokaal in je browser verwerkt en niet geüpload. Taalbestanden worden de eerste keer dat ze nodig zijn gedownload en kunnen in de cache blijven. Deze site toont advertenties.
Wat bevat de doorzoekbare PDF?
Hij combineert de herkende tekst met de originele pagina-afbeeldingen, waardoor de download groot kan worden. Je kunt gecorrigeerde tekst ook kopiëren of opslaan als TXT.