이 가이드는 Python을 사용하여 image을 검색 가능한 PDF으로 변환하는 방법을 설명합니다. IDE 설정 방법, 단계 목록, 그리고 Python을 사용하여 이미지를 읽을 수 있는 PDF로 변환하는 샘플 코드를 포함하고 있습니다. 샘플 코드는 제공된 제안을 따라 맞춤형 출력 PDF 파일을 생성하도록 추가로 향상시킬 수 있습니다.
Python을 사용하여 이미지를 검색 가능한 PDF로 변환하는 단계
- 환경을 설정하여 Aspose.OCR for Python via .NET를 사용해 스캔한 JPG를 PDF로 변환합니다.
- JPG에서 텍스트를 인식하고 PDF에 텍스트를 저장하기 위해 OCR 라이브러리를 가져옵니다.
- 입력 이미지와 출력 PDF 파일의 폴더를 설정합니다
- OCR engine을(를) 인스턴스화하여 스캔한 이미지에서 텍스트를 인식합니다.
- OcrInput 클래스를 사용하여 스캔한 이미지를 로드합니다.
- 텍스트를 추출하기 위해 인식 프로세스를 실행합니다
- 사용자 정보를 위한 텍스트를 출력합니다
- 각 텍스트 세그먼트를 별도의 PDF로 저장합니다.
위 단계들은 Python을 사용한 이미지에서 검색 가능한 PDF로 변환 프로세스를 포함합니다. 필요한 Aspose 라이브러리를 가져오고, 라이선스를 적용하며, 필요한 폴더를 설정하고, OCR 엔진을 인스턴스화한 뒤, 처리에 필요한 이미지를 보관할 OcrInput 객체를 생성합니다. recognize () 메서드를 실행하여 텍스트를 가져오고, 결과 목록을 반복하면서 각 결과를 표시하고, 각각을 별도의 PDF 파일로 저장합니다.
Python을 사용하여 이미지를 읽을 수 있는 PDF로 변환하는 코드
위의 샘플 코드는 Python을 사용하여 JPG를 읽을 수 있는 PDF로 변환하는 방법을 보여줍니다. 변환 프로세스를 개선하려면 인식 언어 설정, 자동 색상 반전 활성화, 작은 글꼴 확대 활성화와 같은 동작을 변경하기 위해 RecognitionSettings를 시도해 볼 수 있습니다. 허용하거나 무시할 문자 목록을 설정하고, 고품질 이미지의 경우 recognize() 대신 recognize_fast()를 사용하며, 기울어진 스캔을 처리하기 위해 result.skew를 확인할 수도 있습니다.
이 가이드는 이미지에 OCR을 적용하고 결과를 PDF 파일로 저장하는 과정을 설명합니다. 이미지의 노이즈를 제거하려면 기사 Python을 사용하여 이미지의 노이즈 제거를 참조하십시오.