Цей швидкий посібник пояснює, як перетворити image у пошуковий PDF за допомогою Java. У ньому є деталі налаштування IDE, список кроків та зразковий код для зміни зображення у придатний до читання PDF за допомогою Java. Ви також отримаєте кілька покращень для створення власного вихідного PDF‑файлу.
Кроки для вилучення тексту з зображення у PDF за допомогою Java
- Налаштуйте IDE використовувати Aspose.OCR for Java, щоб конвертувати JPG у читабельний PDF
- Створіть екземпляр ліцензії та встановіть шляхи вводу/виводу
- Створіть екземпляр OCR engine для розпізнавання тексту з зображення
- Створіть об’єкт класу OcrInput і додайте вихідне зображення для обробки
- Підготуйте екземпляр RecognitionSettings з налаштуваннями за замовчуванням
- Запустіть процес розпізнавання тексту, використовуючи метод Recognize(), і збережіть результати
- Перегляньте кожен результат і збережіть кожен результат у окремий PDF
Вищезазначені кроки підсумовують процес перетворення зображення у пошуковий PDF за допомогою Java. Створіть об’єкт OCR‑двигуна, використайте клас OcrInput для завантаження вихідного зображення, ініціалізуйте налаштування розпізнавання та запустіть процес. Пройдіться по кожному отриманому рядку та збережіть його у PDF.
Код для перетворення зображення у читаємий PDF за допомогою Java
Цей код демонструє, як конвертувати JPG у читабельний PDF за допомогою Java. Ви повинні встановити мову розпізнавання, щоб підвищити точність, замість використання багатомовного значення за замовчуванням. Увімкнення автоматичного інвертування кольору для сканів тексту з темного фону також покращить процес конвертації.
Ця стаття допомагає вам розробити конвертер зображення у пошуковий PDF. Щоб видалити шум з зображення, зверніться до статті Видалення шуму з зображення за допомогою Java.