Это краткое руководство объясняет, как конвертировать image в поисковый PDF с помощью Java. В нём содержатся детали настройки IDE, список шагов и пример кода для преобразования изображения в читаемый PDF с использованием Java. Вы также получите несколько улучшений для создания пользовательского PDF‑файла.
Шаги по извлечению текста из изображения в PDF с помощью Java
- Настройте IDE использовать Aspose.OCR for Java для преобразования JPG в читаемый PDF
- Создайте экземпляр лицензии и задайте пути ввода/вывода
- Создайте объект OCR engine для распознавания текста из изображения
- Создайте объект класса OcrInput и добавьте исходное изображение для обработки
- Подготовьте экземпляр RecognitionSettings с настройками по умолчанию
- Запустите процесс распознавания текста, используя метод Recognize(), и сохраните результаты
- Пройдите каждый результат и сохраните каждый из них в отдельный PDF
Вышеперечисленные шаги суммируют процесс преобразования изображения в поисковый PDF с использованием Java. Создайте объект OCR‑движка, используйте класс OcrInput для загрузки исходного изображения, инициализируйте настройки распознавания и запустите процесс. Пройдитесь по каждому полученному строковому результату и сохраните его в PDF.
Код для преобразования изображения в читаемый PDF с помощью Java
Этот код демонстрирует, как конвертировать JPG в читаемый PDF с помощью Java. Вам следует установить язык распознавания, чтобы повысить точность, вместо использования многократного значения по умолчанию. Включение автоматического инвертирования цветов для сканов текста с тёмного фона также улучшит процесс конвертации.
Эта статья помогает вам в разработке конвертера изображений в PDF с возможностью поиска. Чтобы удалить шум с изображения, обратитесь к статье Remove Noise from Image using Java.