이 빠른 가이드는 Java를 사용하여 image을 검색 가능한 PDF로 변환하는 방법을 설명합니다. IDE 설정 방법, 단계 목록 및 Java를 사용하여 이미지를 읽을 수 있는 PDF로 변환하는 샘플 코드를 포함하고 있습니다. 또한 사용자 정의 출력 PDF 파일을 만들기 위한 몇 가지 향상 기능도 제공합니다.
Java를 사용하여 이미지에서 PDF로 텍스트 추출 단계
- IDE를 Aspose.OCR for Java를 사용하도록 설정하여 JPG를 읽을 수 있는 PDF로 변환합니다.
- 라이선스를 인스턴스화하고 입력/출력 경로를 설정합니다
- OCR engine의 객체를 인스턴스화하여 이미지에서 텍스트를 인식합니다.
- OcrInput 클래스의 객체를 생성하고 처리할 원본 이미지를 추가합니다.
- 기본 설정으로 RecognitionSettings 인스턴스를 준비합니다.
- Recognize() 메서드를 사용하여 텍스트 인식 프로세스를 실행하고 결과를 저장합니다.
- 각 결과를 순회하며 각 결과를 별도의 PDF로 저장합니다.
위 단계들은 Java를 사용하여 이미지를 검색 가능한 PDF로 변환하는 과정을 요약합니다. OCR 엔진 객체를 인스턴스화하고, OcrInput 클래스를 사용하여 원본 이미지를 로드한 뒤, 인식 설정을 초기화하고 프로세스를 실행합니다. 각 결과 문자열을 반복하면서 PDF로 저장합니다.
Java를 사용하여 이미지를 읽을 수 있는 PDF로 변환하는 코드
이 코드는 Java를 사용하여 JPG를 읽을 수 있는 PDF로 변환하는 방법을 보여줍니다. 정확도를 높이기 위해 다국어 기본값 대신 인식 언어를 설정해야 합니다. 어두운 배경에서 텍스트 스캔에 대한 자동 색상 반전을 활성화하면 변환 과정도 개선됩니다.
이 문서는 이미지-검색 가능한 PDF 변환기를 개발하는 데 도움이 됩니다. 이미지에서 노이즈를 제거하려면, 기사 Java를 사용한 이미지 노이즈 제거를 참조하십시오.