Перетворення зображення у пошуковий PDF за допомогою Python

Цей посібник описує, як перетворити image у пошуковий PDF за допомогою Python. У ньому є деталі щодо налаштування IDE, список кроків та зразковий код для перетворення зображення у читабельний PDF за допомогою Python. Зразковий код можна додатково розширити, щоб створити власний вихідний PDF‑файл, слідуючи наведеним рекомендаціям.

Кроки для перетворення зображення у пошуковий PDF за допомогою Python

  1. Налаштуйте середовище для використання Aspose.OCR for Python via .NET для перетворення сканованих JPG у PDF
  2. Імпортуйте OCR‑бібліотеку, щоб розпізнавати текст з JPG і зберігати його у PDF
  3. Встановіть папку для вхідних зображень та вихідних PDF‑файлів
  4. Створіть екземпляр OCR engine, щоб розпізнати текст зі сканованого зображення
  5. Завантажте скановане зображення для обробки, використовуючи клас OcrInput
  6. Запустіть процес розпізнавання, щоб витягти текст
  7. Виведіть текст для інформації користувача
  8. Збережіть кожен текстовий сегмент у окремому PDF

Вищезазначені кроки охоплюють процес перетворення зображення у пошуковий PDF за допомогою Python. Імпортуйте необхідну бібліотеку Aspose, застосуйте ліцензію, встановіть потрібні папки, створіть екземпляр OCR‑двигуна та створіть об’єкт OcrInput для зберігання зображень, необхідних для обробки. Запустіть метод recognize () для отримання тексту, пройдіться по списку результатів, відобразіть кожен результат і збережіть кожен у окремий PDF‑файл.

Код для перетворення зображення у читабельний PDF за допомогою Python

Вищенаведений зразковий код демонструє, як перетворити JPG у читабельний PDF за допомогою Python. Щоб покращити процес конвертації, ви можете спробувати RecognitionSettings для зміни поведінки, наприклад, встановлення мови розпізнавання, увімкнення автоматичного інвертування кольору або увімкнення масштабування малих шрифтів. Ви також можете задати список дозволених або ігнорованих символів, використати recognize_fast() замість recognize() для зображень високої якості та перевірити result.skew, щоб обробити нахилену скановану копію.

Цей посібник пояснює процес застосування OCR до зображення та збереження результату у PDF‑файлі. Щоб видалити шум із зображення, зверніться до статті Видалення шуму з зображення за допомогою Python.

 Українська