Java を使用して画像を検索可能な PDF に変換する

このクイックガイドでは、Java を使用して image を検索可能な PDF に変換する方法を説明します。IDE の設定方法、手順の一覧、そして Java を使用して画像を読み取り可能な PDF に変換するサンプルコード が含まれています。また、カスタム出力 PDF ファイルを作成するためのいくつかの機能強化も提供します。

Java を使用した画像から PDF へのテキスト抽出手順

  1. IDE を Aspose.OCR for Java を使用して JPG を読み取り可能な PDF に変換するように設定する
  2. ライセンスをインスタンス化し、入力/出力パスを設定する
  3. OCR engine のオブジェクトをインスタンス化し、画像からテキストを認識します
  4. OcrInput クラスのオブジェクトを作成し、処理用のソース画像を追加します
  5. デフォルト設定で RecognitionSettings のインスタンスを用意します
  6. Recognize() メソッドを使用してテキスト認識プロセスを実行し、結果を保存します
  7. 各結果を解析し、各結果を別々のPDFとして保存する

上記の手順は、Java を使用して画像を検索可能な PDF に変換するプロセスを要約しています。OCR エンジンオブジェクトをインスタンス化し、OcrInput クラスを使用してソース画像をロードし、認識設定を初期化してプロセスを実行します。各結果文字列を反復処理し、PDF として保存します。

Javaで画像を読み取り可能なPDFに変換するコード

このコードは、Java を使用して JPG を読み取り可能な PDF に変換する方法を示しています。精度を向上させるために、多言語のデフォルト値を使用する代わりに認識言語を設定すべきです。暗い背景からのテキストスキャンに対して自動カラー反転を有効にすると、変換プロセスも改善されます。

この記事は、画像から検索可能なPDFコンバータを開発する際に役立ちます。画像のノイズを除去するには、記事Remove Noise from Image using Javaを参照してください。

 日本語