Python を使用して画像を検索可能な PDF に変換する

このガイドでは、Python を使用して image を検索可能な PDF に変換する方法を説明します。IDE の設定方法、手順の一覧、そして Python を使用して画像を読み取り可能な PDF に変換する サンプルコードが含まれています。サンプルコードは、提示された提案に従ってカスタム出力 PDF ファイルを作成するようにさらに拡張できます。

Python を使って画像を検索可能な PDF に変換する手順

  1. スキャンしたJPGをPDFに変換するために、環境を Aspose.OCR for Python via .NET を使用するように設定します
  2. OCR ライブラリをインポートして JPG からテキストを認識し、テキストを PDF に保存する
  3. 入力画像と出力PDFファイルのフォルダーを設定する
  4. OCR engine をインスタンス化して、スキャンした画像からテキストを認識します。
  5. スキャンした画像を処理するために OcrInput クラスを使用してロードします
  6. 認識プロセスを実行してテキストを抽出する
  7. ユーザー情報のテキストを表示
  8. 各テキストセグメントを別々のPDFに保存する

上記の手順は、Python を使用した画像から検索可能な PDF に変換するプロセスを網羅しています。必要な Aspose ライブラリをインポートし、ライセンスを適用し、必要なフォルダーを設定し、OCR エンジンをインスタンス化し、処理に必要な画像を保持する OcrInput オブジェクトを作成します。recognize () メソッドを実行してテキストを取得し、結果のリストを反復処理して各結果を表示し、各結果を個別の PDF ファイルとして保存します。

Python を使用して画像を読み取り可能な PDF に変換するコード

上記のサンプルコードは、Python を使用して JPG を読み取り可能な PDF に変換する 方法を示しています。変換プロセスを改善するために、認識言語の設定や自動カラー反転の有効化、または小フォントの拡大を有効にするなど、動作を変更するために RecognitionSettings を試すことができます。許可または除外する文字リストを設定したり、品質の高い画像には recognize() の代わりに recognize_fast() を使用したり、傾いたスキャンを処理するために result.skew を確認したりすることもできます。

このガイドでは、画像に OCR を適用し、結果を PDF ファイルに保存する手順を説明します。画像のノイズを除去するには、記事 Remove Noise from Image using Python を参照してください。

 日本語