Конвертировать изображение в поисковый PDF с помощью Java

Это краткое руководство объясняет, как конвертировать image в поисковый PDF с помощью Java. В нём содержатся детали настройки IDE, список шагов и пример кода для преобразования изображения в читаемый PDF с использованием Java. Вы также получите несколько улучшений для создания пользовательского PDF‑файла.

Шаги по извлечению текста из изображения в PDF с помощью Java

  1. Настройте IDE использовать Aspose.OCR for Java для преобразования JPG в читаемый PDF
  2. Создайте экземпляр лицензии и задайте пути ввода/вывода
  3. Создайте объект OCR engine для распознавания текста из изображения
  4. Создайте объект класса OcrInput и добавьте исходное изображение для обработки
  5. Подготовьте экземпляр RecognitionSettings с настройками по умолчанию
  6. Запустите процесс распознавания текста, используя метод Recognize(), и сохраните результаты
  7. Пройдите каждый результат и сохраните каждый из них в отдельный PDF

Вышеперечисленные шаги суммируют процесс преобразования изображения в поисковый PDF с использованием Java. Создайте объект OCR‑движка, используйте класс OcrInput для загрузки исходного изображения, инициализируйте настройки распознавания и запустите процесс. Пройдитесь по каждому полученному строковому результату и сохраните его в PDF.

Код для преобразования изображения в читаемый PDF с помощью Java

Этот код демонстрирует, как конвертировать JPG в читаемый PDF с помощью Java. Вам следует установить язык распознавания, чтобы повысить точность, вместо использования многократного значения по умолчанию. Включение автоматического инвертирования цветов для сканов текста с тёмного фона также улучшит процесс конвертации.

Эта статья помогает вам в разработке конвертера изображений в PDF с возможностью поиска. Чтобы удалить шум с изображения, обратитесь к статье Remove Noise from Image using Java.

 Русский