Този бърз наръчник обяснява как да конвертирате image в търсим PDF с Java. Той съдържа подробности за настройка на IDE, списък със стъпки и примерен код за преобразуване изображение в четим PDF с Java. Също така ще получите няколко подобрения за създаване на персонализиран изходен PDF файл.
Стъпки за извличане на текст от изображение към PDF с Java
- Задайте IDE да използва Aspose.OCR for Java за конвертиране на JPG в четим PDF
- Инстанцирайте лиценза и задайте пътищата за вход/изход
- Инстанцирайте обект от OCR engine, за да разпознаете текст от изображение
- Създайте обект от класа OcrInput и добавете изходното изображение за обработка
- Подгответе екземпляр на RecognitionSettings с настройките по подразбиране
- Стартирайте процеса за разпознаване на текст, използвайки метода Recognize() и запазете резултатите
- Прегледайте всеки резултат и запазете всеки резултат като отделен PDF
Горните стъпки обобщават процеса за преобразуване на изображение в търсим PDF с Java. Създайте обект на OCR двигател, използвайте класа OcrInput, за да заредите изходното изображение, инициализирайте настройките за разпознаване и стартирайте процеса. Итерирайте през всеки получен низ и го запазете като PDF.
Код за конвертиране на изображение в четим PDF с Java
Този код демонстрира как да конвертирате JPG в четим PDF с помощта на Java. Трябва да зададете езика за разпознаване, за да подобрите точността, вместо да използвате многобичната стойност по подразбиране. Активирането на автоматично обръщане на цветовете за сканиране на текст от тъмен фон също ще подобри процеса на конвертиране.
Тази статия ви помага при разработването на конвертор от изображение в търсим PDF. За премахване на шум от изображение, вижте статията Премахване на шум от изображение с Java.