PDF OCR: taranmış PDF metin tanıma
Taranmış PDF sayfalarındaki metni tarayıcınızda yerel olarak tanıyın; PDF'iniz yüklenmez.
Dosyalarınız bu tarayıcıda kalır. Yükleme, hesap veya kaydedilen belge verisi yok.
Kuyrukta en fazla 50 öğe, bunun içinde en fazla 50 PDF sayfası. 40 megapikselin üzerindeki görseller OCR öncesinde küçültülür. GIF: yalnızca ilk kare.
En iyi sonucu basılı metin verir. El yazısı, bulanık veya çok küçük metin, tablolar ve karmaşık düzenler hatalı ya da farklı sırayla okunabilir. Dil dosyaları ilk kullanımda indirilir (her biri bir ile birkaç MB arası); tarayıcınız bunları önbelleğe alabilir.
Bir PDF'te seçili sayfaların çoğu zaten metin içeriyor. OCR ile devam edebilir ya da mevcut metni doğrudan çıkarabilirsiniz: PDF'ten metne aracını aç
İncele ve kaydet
Güven, motorun kendi tahminidir; doğruluk ölçüsü değildir. Önemli ayrıntıları özgün görselle karşılaştırın.
Tümünü kopyala ve TXT indir bu düzenlenmiş metni kullanır. Bir öğeyi düzenlemek, öğe eklemek veya kaldırmak ya da yeniden tanımak bu alanı öğe metinlerinden yeniden oluşturur.
Elle yapılan metin düzeltmeleri yalnızca TXT'ye yansır. Aranabilir PDF, OCR motorunun özgün metin katmanını korur; sayfa görselleriyle karşılaştırın.
Bir PDF'te OCR nasıl çalıştırılır
- Taranmış PDF metin tanıma için belgenizi ekleyin ve korumalıysa parolasını girin.
- 1-3, 5 gibi sayfa numaralarını girin ya da tüm sayfaları seçmek için aralığı boş bırakın.
- Metin katmanı bildirimini kontrol edin. Seçili sayfaların çoğu zaten metin içeriyorsa, OCR olmadan çıkarma için PDF'ten metne bağlantısını izleyin.
- Belge dilini, isteğe bağlı ikinci dili ve uygun bir düzeni seçin. Yönü veya kırpması gerekiyorsa bir sayfa önizlemesini ayarlayın.
- Seçili sayfaları tanıyın, düzenlenebilir metni düzeltin ve TXT indirin. Bu dosyaya da ihtiyacınız varsa aranabilir PDF seçeneğini açık bırakın.
PDF OCR ne zaman yardımcı olur
- Taranmış bir sözleşmedeki, mektuptaki veya arşiv sayfasındaki sözcükleri kopyalanabilir hale getirin.
- Tüm belgeyi işlemek yerine yalnızca ilgili sayfalarda tanıma çalıştırın.
- Kaydetmeden önce her sayfayı sonucunun yanında inceleyip adları veya sayıları düzeltin.
- Sayfa görsellerini korurken sözcükleri bulmak istediğinizde aranabilir PDF kullanın.
- Kırpmayı veya okuma düzenini değiştirip zor bir sayfayı yeniden tanıyın.
PDF OCR soruları
Metni seçilebilen bir PDF OCR gerektirir mi?
Genellikle hayır. Araç seçili sayfaları metin katmanı için kontrol eder ve çoğunda zaten varsa sizi PDF'ten metne aracına yönlendirir. Yine de OCR ile devam edebilirsiniz.
Taranmış sayfalarda tanımayı neler etkiler?
Net basılı sayfalar el yazısından, bulanık taramalardan veya karmaşık tablolardan genellikle daha iyi sonuç verir. Yaklaşık 300 DPI'lık bir tarama iyi bir hedeftir; kötü bir taramayı büyütmek eksik ayrıntıyı geri getirmez. Güven yalnızca motorun tahminidir.
Kaç sayfa seçebilirim?
Bir çalıştırmada en fazla 50 PDF sayfası işleyebilirsiniz ve toplam kuyruk 50 öğeyi geçemez. Büyük belgeler cihazınızın belleğiyle de sınırlı olabilir.
PDF birden fazla dil içerebilir mi?
20 dil modeli arasından seçim yapın. Bir belge dili zorunlu, ikincisi isteğe bağlıdır. Algılama otomatik olmadığı için sayfalarda kullanılan dilleri seçin.
PDF tanıma için yükleniyor mu?
PDF tarayıcınızda yerel olarak işlenir ve yüklenmez. Dil dosyaları ilk gerektiğinde indirilir ve önbellekte kalabilir. Bu site reklam gösterir.
Aranabilir PDF neleri içerir?
Tanınan metni özgün sayfa görselleriyle birleştirir, bu da indirmeyi büyük yapabilir. Düzeltilmiş metni kopyalayabilir veya TXT olarak kaydedebilirsiniz.