使用 Java 将图像转换为可搜索的 PDF

本快速指南解释了如何 image 转换为可搜索的 PDF 使用 Java。它包含设置 IDE 的详细信息、步骤列表以及将 图像转为可读的 PDF 使用 Java 的示例代码。您还将获得一些用于创建自定义输出 PDF 文件的增强功能。

使用 Java 将图像中的文本提取为 PDF 的步骤

  1. 将 IDE 设置为使用 Aspose.OCR for Java 将 JPG 转换为可读的 PDF
  2. 实例化许可证并设置输入/输出路径
  3. 实例化 OCR engine 对象以识别图像中的文本
  4. 创建 OcrInput 类的对象并添加源图像进行处理
  5. 使用默认设置准备 RecognitionSettings 实例
  6. 使用 Recognize() 方法运行文本识别过程并保存结果
  7. 解析每个结果并将每个结果保存为单独的 PDF

上述步骤概述了 使用 Java 将图像转换为可搜索的 PDF 的过程。实例化 OCR 引擎对象,使用 OcrInput 类加载源图像,初始化识别设置,并运行该过程。遍历每个结果字符串并将其保存为 PDF。

使用 Java 将图像转换为可读 PDF 的代码

此代码演示了如何 使用 Java 将 JPG 转换为可读的 PDF。您应该设置识别语言以提高准确性,而不是使用多语言默认值。启用对暗背景文本扫描的自动颜色反转也将改进转换过程。

本文帮助您开发图像转可搜索 PDF 的转换器。要从图像中去除噪声,请参阅文章 Remove Noise from Image using Java.

 简体中文