Voltar ao AllToolio

PDF OCR: PDF digitalizado para texto

Reconheça texto em páginas de PDF digitalizadas localmente no navegador; o PDF não é enviado.

Transforme imagens em texto editável Largue imagens ou PDF aqui, ou cole uma imagem em qualquer parte desta página.

Os seus ficheiros ficam neste navegador. Sem envios, contas ou dados de documentos guardados.

Até 50 itens na fila, incluindo até 50 páginas de PDF. Imagens acima de 40 megapíxeis são reduzidas antes do OCR. GIF: apenas o primeiro fotograma.

Texto impresso funciona melhor. Escrita à mão, texto desfocado ou muito pequeno, tabelas e esquemas complexos podem ser lidos mal ou por ordem diferente. Os ficheiros de idioma são transferidos na primeira utilização (de um a alguns MB cada); o navegador pode guardá-los em cache.

Definições de reconhecimento

Verifique os idiomas selecionados. A ferramenta não deteta o idioma do documento automaticamente.

Ajusta o contraste e os fundos escuros; amplia imagens pequenas. A ampliação não acrescenta detalhe. A imagem original é mantida para nova tentativa.

O PDF guarda as imagens das páginas, por isso pode ser grande. Contém o recorte e a rotação reconhecidos. Todos os itens da fila têm de ter um resultado PDF antes da transferência.

Defina o intervalo de páginas e a palavra-passe antes de adicionar PDF. Intervalo vazio significa todas as páginas; 8- significa da página 8 até ao fim. As definições aplicam-se a cada PDF adicionado. Se um PDF falhar, corrija-as e escolha Reconhecer novamente. A palavra-passe é apagada após a abertura.

Como executar OCR num PDF

  1. Para converter PDF digitalizado em texto, adicione o documento e introduza a palavra-passe se estiver protegido.
  2. Introduza números de página como 1–3, 5, ou deixe o intervalo vazio para selecionar todas as páginas.
  3. Verifique o aviso sobre a camada de texto. Se a maioria das páginas selecionadas já contiver texto, siga a ligação PDF para texto para extrair sem OCR.
  4. Escolha o idioma do documento, um segundo idioma opcional e um esquema adequado. Ajuste a pré-visualização de uma página se a orientação ou o recorte precisarem de atenção.
  5. Reconheça as páginas selecionadas, corrija o texto editável e transfira TXT. Deixe o PDF pesquisável ativado se também precisar desse ficheiro.

Quando o PDF OCR ajuda

  • Torne as palavras de um contrato, carta ou página de arquivo digitalizado disponíveis para cópia.
  • Execute o reconhecimento apenas nas páginas relevantes em vez de processar o documento inteiro.
  • Inspecione cada página junto do seu resultado e corrija nomes ou números antes de guardar.
  • Use um PDF pesquisável quando quiser encontrar palavras mantendo as imagens das páginas.
  • Altere o recorte ou o esquema de leitura e reconheça novamente uma página difícil.

Perguntas sobre PDF OCR

Um PDF com texto selecionável precisa de OCR?

Normalmente não. A ferramenta verifica as páginas selecionadas quanto a uma camada de texto e encaminha-o para PDF para texto quando a maioria já tem uma. Ainda pode continuar com OCR.

O que afeta o reconhecimento em páginas digitalizadas?

Páginas impressas nítidas tendem a funcionar melhor do que escrita à mão, digitalizações desfocadas ou tabelas complicadas. Uma digitalização de cerca de 300 DPI é um objetivo útil; ampliar uma digitalização fraca não recupera detalhe em falta. A confiança é apenas uma estimativa do motor.

Quantas páginas posso selecionar?

Pode processar até 50 páginas de PDF numa execução, com um máximo de 50 itens na fila no total. Documentos grandes também podem ser limitados pela memória do seu dispositivo.

O PDF pode conter mais do que um idioma?

Escolha entre 20 modelos de idioma. Um idioma de documento é obrigatório e um segundo é opcional. Selecione os idiomas usados nas páginas porque a deteção não é automática.

O PDF é enviado para reconhecimento?

O PDF é processado localmente no navegador e não é enviado. Os ficheiros de idioma são transferidos na primeira vez que são necessários e podem ficar em cache. Este site mostra anúncios.

O que contém o PDF pesquisável?

Combina o texto reconhecido com as imagens originais das páginas, o que pode tornar a transferência grande. Também pode copiar o texto corrigido ou guardá-lo como TXT.

Outras opções de texto em PDF