このガイドでは、Python を使用して image を検索可能な PDF に変換する方法を説明します。IDE の設定方法、手順の一覧、そして Python を使用して画像を読み取り可能な PDF に変換する サンプルコードが含まれています。サンプルコードは、提示された提案に従ってカスタム出力 PDF ファイルを作成するようにさらに拡張できます。
Python を使って画像を検索可能な PDF に変換する手順
- スキャンしたJPGをPDFに変換するために、環境を Aspose.OCR for Python via .NET を使用するように設定します
- OCR ライブラリをインポートして JPG からテキストを認識し、テキストを PDF に保存する
- 入力画像と出力PDFファイルのフォルダーを設定する
- OCR engine をインスタンス化して、スキャンした画像からテキストを認識します。
- スキャンした画像を処理するために OcrInput クラスを使用してロードします
- 認識プロセスを実行してテキストを抽出する
- ユーザー情報のテキストを表示
- 各テキストセグメントを別々のPDFに保存する
上記の手順は、Python を使用した画像から検索可能な PDF に変換するプロセスを網羅しています。必要な Aspose ライブラリをインポートし、ライセンスを適用し、必要なフォルダーを設定し、OCR エンジンをインスタンス化し、処理に必要な画像を保持する OcrInput オブジェクトを作成します。recognize () メソッドを実行してテキストを取得し、結果のリストを反復処理して各結果を表示し、各結果を個別の PDF ファイルとして保存します。
Python を使用して画像を読み取り可能な PDF に変換するコード
上記のサンプルコードは、Python を使用して JPG を読み取り可能な PDF に変換する 方法を示しています。変換プロセスを改善するために、認識言語の設定や自動カラー反転の有効化、または小フォントの拡大を有効にするなど、動作を変更するために RecognitionSettings を試すことができます。許可または除外する文字リストを設定したり、品質の高い画像には recognize() の代わりに recognize_fast() を使用したり、傾いたスキャンを処理するために result.skew を確認したりすることもできます。
このガイドでは、画像に OCR を適用し、結果を PDF ファイルに保存する手順を説明します。画像のノイズを除去するには、記事 Remove Noise from Image using Python を参照してください。