PDF a texto
Extrae el texto seleccionable, revísalo y guarda un archivo TXT mientras tu PDF permanece en el navegador.
Disposición del texto
Prueba la disposición aproximada para tablas y columnas. La alineación puede necesitar correcciones.
El PDF se procesa localmente en el navegador; el archivo no se sube. El texto de lectura sigue el orden guardado en el PDF, así que las columnas y las tablas pueden aparecer en un orden inesperado.
Cómo extraer texto de un PDF
- Empieza con PDF a texto eligiendo un PDF o arrastrándolo al área de archivos. Si se solicita, introduce la contraseña del documento.
- Deja Páginas vacío para procesar todo el documento, o introduce una selección. Por ejemplo, 1-3, 5 extrae cuatro páginas en ese orden.
- Elige Texto de lectura para párrafos normales. Prueba Disposición aproximada cuando importen los espacios entre columnas o entradas de tabla.
- Mantén activados los separadores de página para identificar las páginas de origen y selecciona Extraer texto. Revisa cualquier aviso sobre páginas sin texto utilizable.
- Corrige el resultado editable y cópialo o descarga un archivo .txt en UTF-8. Ambas acciones usan el texto que se muestra actualmente.
Formas prácticas de usar el texto extraído
- Copiar texto de informes PDF a tus notas de trabajo sin reescribir párrafos enteros.
- Guardar el texto de un documento digital como texto plano para editarlo después.
- Recopilar páginas seleccionadas de un manual conservando las etiquetas de página como referencia.
- Revisar el texto de una tabla con espaciado aproximado antes de corregir su alineación.
- Comprobar los totales de palabras y caracteres mientras quitas encabezados no deseados del resultado.
Preguntas sobre la extracción de texto de PDF
¿Por qué una página no produce texto?
Un escaneo puede contener imágenes de letras sin capa de texto. Esta herramienta no hace OCR. Las páginas con menos de tres caracteres que no sean espacios se informan como sin texto utilizable; las páginas en blanco también activan este aviso.
¿Qué disposición de texto debo elegir?
Texto de lectura sigue el orden de elementos guardado en el PDF y usa las posiciones para añadir espaciado y saltos de línea. Disposición aproximada ordena los elementos de arriba abajo y de izquierda a derecha, añadiendo espacios entre ellos. Ningún modo garantiza el orden de lectura original en columnas complejas.
¿Por qué faltan espacios o hay caracteres incorrectos?
Los PDF guardan fragmentos de texto posicionados, y algunas fuentes tienen mapas de caracteres incompletos. Prueba el otro modo de disposición y compara la salida con el original. Puedes corregir el texto extraído antes de exportarlo.
¿Puedo extraer texto de un PDF protegido con contraseña?
Introduce la contraseña cuando aparezca el campo y selecciona Abrir. Necesitas la contraseña correcta; la herramienta no la omite. La contraseña se mantiene en memoria solo durante esa carga.
¿PDF a TXT conserva el formato de Word?
TXT contiene texto plano, con saltos de línea y espacios. No conserva fuentes, imágenes, formularios interactivos ni firmas digitales, y esta herramienta no exporta documentos de Word. Las etiquetas de página generadas se excluyen de los recuentos; los totales de caracteres tampoco incluyen los saltos de línea.
¿Se sube mi PDF y puedo procesar un archivo grande?
El archivo se procesa localmente en tu navegador y no se sube. Los documentos grandes pueden tardar más o superar la memoria disponible del dispositivo. Seleccionar menos páginas reduce el trabajo de extracción, aunque el navegador sigue necesitando abrir el PDF.