Назад до AllToolio

Розпізнавання тексту в PDF: сканований PDF у текст

Розпізнайте текст на сканованих сторінках PDF локально у браузері; ваш PDF не завантажується.

Перетворіть зображення на редагований текст Перетягніть сюди зображення або PDF чи вставте зображення будь-де на цій сторінці.

Ваші файли залишаються в цьому браузері. Без завантажень, облікових записів чи збережених даних документа.

До 50 позицій у черзі, включно з до 50 сторінками PDF. Зображення понад 40 мегапікселів зменшуються перед OCR. GIF: лише перший кадр.

Найкраще працює друкований текст. Рукописний текст, розмитий або дуже дрібний текст, таблиці та складні макети можуть бути розпізнані погано або в іншому порядку. Мовні файли завантажуються при першому використанні (від одного до кількох МБ кожен); браузер може їх кешувати.

Налаштування розпізнавання

Перевірте вибрані мови. Інструмент не визначає мову документа автоматично.

Коригує контраст і темний фон; збільшує дрібні зображення. Збільшення не додає деталей. Ваше вихідне зображення зберігається для наступної спроби.

PDF зберігає зображення сторінок, тому може бути великим. Він містить розпізнаний кадр і обертання. Усі позиції черги повинні мати результат PDF перед завантаженням.

Встановіть діапазон сторінок і пароль перед додаванням PDF. Порожній діапазон означає всі сторінки; 8- означає від сторінки 8 до кінця. Налаштування застосовуються до кожного доданого PDF. Для невдалого PDF виправте їх і виберіть «Розпізнати знову». Пароль очищується після відкриття.

Як запустити OCR на PDF

  1. Щоб перетворити сканований PDF на текст, додайте документ і введіть його пароль, якщо він захищений.
  2. Введіть номери сторінок, наприклад 1–3, 5, або залиште діапазон порожнім, щоб вибрати всі сторінки.
  3. Перевірте повідомлення про текстовий шар. Якщо більшість вибраних сторінок уже містять текст, скористайтеся посиланням «PDF у текст» для витягу без OCR.
  4. Виберіть мову документа, необов'язкову другу мову та відповідний макет. Налаштуйте попередній перегляд сторінки, якщо її орієнтація або кадрування потребують уваги.
  5. Розпізнайте вибрані сторінки, виправте редагований текст і завантажте TXT. Залиште PDF із пошуком увімкненим, якщо вам також потрібен цей файл.

Коли PDF OCR допомагає

  • Зробіть слова зі сканованого договору, листа або архівної сторінки доступними для копіювання.
  • Запускайте розпізнавання лише на відповідних сторінках замість обробки всього документа.
  • Перегляньте кожну сторінку поруч із її результатом і виправте імена або числа перед збереженням.
  • Використовуйте PDF із пошуком, коли хочете знаходити слова, зберігаючи зображення сторінок.
  • Змініть кадрування або макет читання та розпізнайте складну сторінку знову.

Питання про PDF OCR

Чи потрібен OCR для PDF із вибраним текстом?

Зазвичай ні. Інструмент перевіряє вибрані сторінки на наявність текстового шару та вказує на PDF у текст, коли більшість уже має його. Ви все одно можете продовжити з OCR.

Що впливає на розпізнавання на сканованих сторінках?

Чіткі друковані сторінки зазвичай працюють краще, ніж рукописний текст, розмиті скани або складні таблиці. Скан близько 300 DPI є корисною метою; збільшення поганого скану не може відновити відсутні деталі. Достовірність — це лише оцінка движка.

Скільки сторінок я можу вибрати?

Ви можете обробити до 50 сторінок PDF за один запуск, загалом не більше 50 позицій черги. Великі документи також можуть бути обмежені пам'яттю вашого пристрою.

Чи може PDF містити більше однієї мови?

Виберіть із 20 мовних моделей. Одна мова документа обов'язкова, а друга — необов'язкова. Виберіть мови, які використовуються на сторінках, оскільки визначення не є автоматичним.

Чи завантажується PDF для розпізнавання?

PDF обробляється локально у вашому браузері та не завантажується. Мовні файли завантажуються при першій потребі та можуть залишатися в кеші. Цей сайт показує рекламу.

Що містить PDF із пошуком?

Він поєднує розпізнаний текст з оригінальними зображеннями сторінок, що може зробити завантаження великим. Ви також можете скопіювати виправлений текст або зберегти його як TXT.

Інші варіанти роботи з текстом PDF