Înapoi la AllToolio

PDF în text

Extrage textul selectabil, verifică-l și salvează un fișier TXT, în timp ce PDF-ul rămâne în browser.

sau plasează aici un PDF
Lasă gol pentru toate paginile. Exemplu: 1-3, 5. Folosește 8- pentru pagina 8 până la final.

Aranjarea textului

Încearcă aspectul aproximativ pentru tabele și coloane. Alinierea poate necesita corecturi.

Choose a PDF to start.

PDF-ul este procesat local în browser; fișierul nu este încărcat. Textul de citit urmează ordinea stocată în PDF, așa că coloanele și tabelele pot apărea într-o ordine neașteptată.

Cum să extragi textul dintr-un PDF

  1. Începe cu PDF în text alegând un PDF sau trăgându-l în zona de fișiere. Dacă ți se cere, introdu parola documentului.
  2. Lasă Pagini gol pentru a procesa întregul document sau introdu o selecție. De exemplu, 1-3, 5 extrage patru pagini în această ordine.
  3. Alege Text de citit pentru paragrafe obișnuite. Încearcă Aspect aproximativ când spațiile dintre coloane sau intrările din tabel contează.
  4. Păstrează activate Separatoarele de pagini pentru a identifica paginile sursă, apoi selectează Extrage textul. Verifică orice notificare despre pagini fără text utilizabil.
  5. Corectează rezultatul editabil, apoi copiază-l sau descarcă un fișier .txt UTF-8. Ambele acțiuni folosesc textul afișat în acel moment.

Modalități practice de a folosi textul extras

  • Copiază text din rapoarte PDF în notițe de lucru fără a retasta paragrafe întregi.
  • Salvează formularea unui document digital ca text simplu pentru editare ulterioară.
  • Colectează pagini selectate dintr-un manual păstrând etichetele paginilor pentru referință.
  • Inspectează textul dintr-un tabel cu spațiere aproximativă înainte de a-i corecta alinierea.
  • Verifică totalurile de cuvinte și caractere în timp ce elimini titluri nedorite din rezultat.

Întrebări despre extragerea textului din PDF

De ce o pagină nu produce text?

O scanare poate conține imagini cu litere fără strat de text. Acest instrument nu face OCR. Paginile cu mai puțin de trei caractere care nu sunt spații sunt raportate ca fără text utilizabil; paginile albe declanșează și ele această notificare.

Ce aranjare a textului să aleg?

Text de citit urmează ordinea stocată a elementelor din PDF și folosește pozițiile pentru a adăuga spațiere și întreruperi de rând. Aspect aproximativ aranjează elementele de sus în jos și de la stânga la dreapta, adăugând spații între ele. Niciun mod nu garantează ordinea originală de citire pentru coloane complexe.

De ce lipsesc spații sau caracterele sunt incorecte?

PDF-urile stochează fragmente de text poziționate, iar unele fonturi au mapări incomplete de caractere. Încearcă celălalt mod de aranjare și compară rezultatul cu originalul. Poți corecta textul extras înainte de a-l exporta.

Pot extrage text dintr-un PDF protejat cu parolă?

Introdu parola când apare câmpul, apoi selectează Deschide. Ai nevoie de parola corectă; instrumentul nu o ocolește. Parola este păstrată în memorie doar pentru acea încărcare.

PDF în TXT păstrează formatarea Word?

TXT conține text simplu, cu întreruperi de rând și spații. Nu păstrează fonturi, imagini, formulare interactive sau semnături digitale, iar acest instrument nu exportă documente Word. Etichetele de pagină generate sunt excluse din totaluri; totalurile de caractere exclud și întreruperile de rând.

PDF-ul meu este încărcat și pot procesa un fișier mare?

Fișierul este procesat local în browser și nu este încărcat. Documentele mari pot dura mai mult sau pot depăși memoria disponibilă a dispozitivului. Selectarea mai puținor pagini reduce munca de extragere, deși browserul trebuie totuși să deschidă PDF-ul.

Continuă lucrul cu textul sau PDF-ul tău