Розпізнавання тексту в PDF: сканований PDF у текст
Розпізнайте текст на сканованих сторінках PDF локально у браузері; ваш PDF не завантажується.
Ваші файли залишаються в цьому браузері. Без завантажень, облікових записів чи збережених даних документа.
До 50 позицій у черзі, включно з до 50 сторінками PDF. Зображення понад 40 мегапікселів зменшуються перед OCR. GIF: лише перший кадр.
Найкраще працює друкований текст. Рукописний текст, розмитий або дуже дрібний текст, таблиці та складні макети можуть бути розпізнані погано або в іншому порядку. Мовні файли завантажуються при першому використанні (від одного до кількох МБ кожен); браузер може їх кешувати.
Більшість вибраних сторінок у PDF уже містять текст. Ви можете продовжити з OCR або витягти наявний текст безпосередньо: Відкрити PDF у текст
Перевірте та збережіть
Достовірність — це власна оцінка движка, а не міра правильності. Порівняйте важливі деталі з оригіналом.
Копіювати все та Завантажити TXT використовують цей редагований текст. Редагування позиції, додавання або видалення позицій чи повторне розпізнавання відновлює це поле з текстів позицій.
Ручні виправлення тексту включено лише до TXT. PDF із пошуком зберігає оригінальний текстовий шар движка; порівняйте його із зображеннями сторінок.
Як запустити OCR на PDF
- Щоб перетворити сканований PDF на текст, додайте документ і введіть його пароль, якщо він захищений.
- Введіть номери сторінок, наприклад 1–3, 5, або залиште діапазон порожнім, щоб вибрати всі сторінки.
- Перевірте повідомлення про текстовий шар. Якщо більшість вибраних сторінок уже містять текст, скористайтеся посиланням «PDF у текст» для витягу без OCR.
- Виберіть мову документа, необов'язкову другу мову та відповідний макет. Налаштуйте попередній перегляд сторінки, якщо її орієнтація або кадрування потребують уваги.
- Розпізнайте вибрані сторінки, виправте редагований текст і завантажте TXT. Залиште PDF із пошуком увімкненим, якщо вам також потрібен цей файл.
Коли PDF OCR допомагає
- Зробіть слова зі сканованого договору, листа або архівної сторінки доступними для копіювання.
- Запускайте розпізнавання лише на відповідних сторінках замість обробки всього документа.
- Перегляньте кожну сторінку поруч із її результатом і виправте імена або числа перед збереженням.
- Використовуйте PDF із пошуком, коли хочете знаходити слова, зберігаючи зображення сторінок.
- Змініть кадрування або макет читання та розпізнайте складну сторінку знову.
Питання про PDF OCR
Чи потрібен OCR для PDF із вибраним текстом?
Зазвичай ні. Інструмент перевіряє вибрані сторінки на наявність текстового шару та вказує на PDF у текст, коли більшість уже має його. Ви все одно можете продовжити з OCR.
Що впливає на розпізнавання на сканованих сторінках?
Чіткі друковані сторінки зазвичай працюють краще, ніж рукописний текст, розмиті скани або складні таблиці. Скан близько 300 DPI є корисною метою; збільшення поганого скану не може відновити відсутні деталі. Достовірність — це лише оцінка движка.
Скільки сторінок я можу вибрати?
Ви можете обробити до 50 сторінок PDF за один запуск, загалом не більше 50 позицій черги. Великі документи також можуть бути обмежені пам'яттю вашого пристрою.
Чи може PDF містити більше однієї мови?
Виберіть із 20 мовних моделей. Одна мова документа обов'язкова, а друга — необов'язкова. Виберіть мови, які використовуються на сторінках, оскільки визначення не є автоматичним.
Чи завантажується PDF для розпізнавання?
PDF обробляється локально у вашому браузері та не завантажується. Мовні файли завантажуються при першій потребі та можуть залишатися в кеші. Цей сайт показує рекламу.
Що містить PDF із пошуком?
Він поєднує розпізнаний текст з оригінальними зображеннями сторінок, що може зробити завантаження великим. Ви також можете скопіювати виправлений текст або зберегти його як TXT.