この記事では、Pythonで PDF を画像として Word に挿入する方法を説明します。IDEの設定方法、プログラミング手順のリスト、そして PythonでPDFをWordに画像として挿入するサンプルコードが含まれています。また、カスタム出力のWordファイルを取得するためにコードを改良するいくつかの提案も提供します。
PythonでPDF画像をWordに挿入する手順
- 環境を設定して Aspose.Total for Python via .NET を使用し、PDF を Word ファイルに変換します。
- 該当する製品ライセンスを適用して、製品機能をフルに有効化する
- ソースPDFファイルをメモリにロードするために Document クラスを使用します。
- 結果として得られる PDF 画像を保存するための新しい空の Word file を作成する
- 解像度などのパラメータを設定して、PDFページをPNGにレンダリングする
- 各PDFページを1つずつ確認する
- 各ページを PNG 画像に変換し、改ページを追加して Word ファイルの新しいページにレンダリングします
- 完成した Word ファイルをディスクに保存する
これらの手順は、PythonでPDF画像をWordに挿入する方法 を説明しています。 このタスクを実行するには、元のPDFファイルを読み込み、新しいDOCXファイルを作成し、PDFページをレンダリングするためのパラメータを設定し、PDF内の各ページを解析します。 定義された設定で各PDFページをPNGに変換し、生成された画像を新しいWordファイルに挿入し、各画像の後に改ページを挿入し、すべてのPDFページ画像がWordファイルに保存されるまでこのプロセスを続けます。
PythonでPDFを画像としてWordに挿入するコード
このコードは、PythonでWordにPDFを画像として挿入するプロセスを示しています。画像レンダリングのデフォルトスケールは100%です。ただし、page.メディアボックス。width/height のポイント数値を使用して、各画像を明示的な高さと幅で挿入できます。PDF にページサイズや向きが混在している場合は、単純な改ページの代わりに、セクションごとのページ設定とともに aw.BreakType.SECTION_BREAK_NEW_PAGE を使用することを検討してください。
このガイドでは、テキスト付きPDFファイルをページごとに画像としてWordファイルに変換する手順を示します。スキャンしたPDFをDOCXファイルに変換するには、記事Convert scanned PDF to Word using Pythonを参照してください。