AllToolio'ya dön

PDF OCR: taranmış PDF metin tanıma

Taranmış PDF sayfalarındaki metni tarayıcınızda yerel olarak tanıyın; PDF'iniz yüklenmez.

Görselleri düzenlenebilir metne dönüştürün Görselleri veya PDF'leri buraya bırakın ya da bu sayfanın herhangi bir yerine bir görsel yapıştırın.

Dosyalarınız bu tarayıcıda kalır. Yükleme, hesap veya kaydedilen belge verisi yok.

Kuyrukta en fazla 50 öğe, bunun içinde en fazla 50 PDF sayfası. 40 megapikselin üzerindeki görseller OCR öncesinde küçültülür. GIF: yalnızca ilk kare.

En iyi sonucu basılı metin verir. El yazısı, bulanık veya çok küçük metin, tablolar ve karmaşık düzenler hatalı ya da farklı sırayla okunabilir. Dil dosyaları ilk kullanımda indirilir (her biri bir ile birkaç MB arası); tarayıcınız bunları önbelleğe alabilir.

Tanıma ayarları

Seçili dilleri kontrol edin. Araç belge dilini otomatik olarak algılamaz.

Kontrastı ve koyu arka planları düzeltir; küçük görselleri büyütür. Büyütme ayrıntı eklemez. Kaynak görseliniz başka bir deneme için saklanır.

PDF sayfa görsellerini saklar, bu yüzden büyük olabilir. Tanınan kırpma ve döndürmeyi içerir. İndirme için kuyruktaki her öğenin bir PDF sonucu olmalıdır.

PDF'leri eklemeden önce sayfa aralığını ve parolayı ayarlayın. Boş aralık tüm sayfalar anlamına gelir; 8- sekizinci sayfadan sona kadar demektir. Ayarlar eklenen her PDF için geçerlidir. Açılamayan bir PDF için ayarları düzeltip Yeniden tanı'yı seçin. Parola açıldıktan sonra temizlenir.

Bir PDF'te OCR nasıl çalıştırılır

  1. Taranmış PDF metin tanıma için belgenizi ekleyin ve korumalıysa parolasını girin.
  2. 1-3, 5 gibi sayfa numaralarını girin ya da tüm sayfaları seçmek için aralığı boş bırakın.
  3. Metin katmanı bildirimini kontrol edin. Seçili sayfaların çoğu zaten metin içeriyorsa, OCR olmadan çıkarma için PDF'ten metne bağlantısını izleyin.
  4. Belge dilini, isteğe bağlı ikinci dili ve uygun bir düzeni seçin. Yönü veya kırpması gerekiyorsa bir sayfa önizlemesini ayarlayın.
  5. Seçili sayfaları tanıyın, düzenlenebilir metni düzeltin ve TXT indirin. Bu dosyaya da ihtiyacınız varsa aranabilir PDF seçeneğini açık bırakın.

PDF OCR ne zaman yardımcı olur

  • Taranmış bir sözleşmedeki, mektuptaki veya arşiv sayfasındaki sözcükleri kopyalanabilir hale getirin.
  • Tüm belgeyi işlemek yerine yalnızca ilgili sayfalarda tanıma çalıştırın.
  • Kaydetmeden önce her sayfayı sonucunun yanında inceleyip adları veya sayıları düzeltin.
  • Sayfa görsellerini korurken sözcükleri bulmak istediğinizde aranabilir PDF kullanın.
  • Kırpmayı veya okuma düzenini değiştirip zor bir sayfayı yeniden tanıyın.

PDF OCR soruları

Metni seçilebilen bir PDF OCR gerektirir mi?

Genellikle hayır. Araç seçili sayfaları metin katmanı için kontrol eder ve çoğunda zaten varsa sizi PDF'ten metne aracına yönlendirir. Yine de OCR ile devam edebilirsiniz.

Taranmış sayfalarda tanımayı neler etkiler?

Net basılı sayfalar el yazısından, bulanık taramalardan veya karmaşık tablolardan genellikle daha iyi sonuç verir. Yaklaşık 300 DPI'lık bir tarama iyi bir hedeftir; kötü bir taramayı büyütmek eksik ayrıntıyı geri getirmez. Güven yalnızca motorun tahminidir.

Kaç sayfa seçebilirim?

Bir çalıştırmada en fazla 50 PDF sayfası işleyebilirsiniz ve toplam kuyruk 50 öğeyi geçemez. Büyük belgeler cihazınızın belleğiyle de sınırlı olabilir.

PDF birden fazla dil içerebilir mi?

20 dil modeli arasından seçim yapın. Bir belge dili zorunlu, ikincisi isteğe bağlıdır. Algılama otomatik olmadığı için sayfalarda kullanılan dilleri seçin.

PDF tanıma için yükleniyor mu?

PDF tarayıcınızda yerel olarak işlenir ve yüklenmez. Dil dosyaları ilk gerektiğinde indirilir ve önbellekte kalabilir. Bu site reklam gösterir.

Aranabilir PDF neleri içerir?

Tanınan metni özgün sayfa görselleriyle birleştirir, bu da indirmeyi büyük yapabilir. Düzeltilmiş metni kopyalayabilir veya TXT olarak kaydedebilirsiniz.

Diğer PDF metin seçenekleri