本快速指南解释了如何 将 image 转换为可搜索的 PDF 使用 Java。它包含设置 IDE 的详细信息、步骤列表以及将 图像转为可读的 PDF 使用 Java 的示例代码。您还将获得一些用于创建自定义输出 PDF 文件的增强功能。
使用 Java 将图像中的文本提取为 PDF 的步骤
- 将 IDE 设置为使用 Aspose.OCR for Java 将 JPG 转换为可读的 PDF
- 实例化许可证并设置输入/输出路径
- 实例化 OCR engine 对象以识别图像中的文本
- 创建 OcrInput 类的对象并添加源图像进行处理
- 使用默认设置准备 RecognitionSettings 实例
- 使用 Recognize() 方法运行文本识别过程并保存结果
- 解析每个结果并将每个结果保存为单独的 PDF
上述步骤概述了 使用 Java 将图像转换为可搜索的 PDF 的过程。实例化 OCR 引擎对象,使用 OcrInput 类加载源图像,初始化识别设置,并运行该过程。遍历每个结果字符串并将其保存为 PDF。
使用 Java 将图像转换为可读 PDF 的代码
此代码演示了如何 使用 Java 将 JPG 转换为可读的 PDF。您应该设置识别语言以提高准确性,而不是使用多语言默认值。启用对暗背景文本扫描的自动颜色反转也将改进转换过程。
本文帮助您开发图像转可搜索 PDF 的转换器。要从图像中去除噪声,请参阅文章 Remove Noise from Image using Java.