แปลงรูปภาพเป็น PDF ที่ค้นหาได้โดยใช้ Python

คู่มือนี้อธิบายวิธี แปลง image ให้เป็น PDF ที่สามารถค้นหาได้โดยใช้ Python. มีรายละเอียดเกี่ยวกับการตั้งค่า IDE รายการขั้นตอน และโค้ดตัวอย่างสำหรับการเปลี่ยน รูปภาพเป็น PDF ที่อ่านได้โดยใช้ Python. โค้ดตัวอย่างสามารถปรับปรุงต่อไปเพื่อสร้างไฟล์ PDF ผลลัพธ์แบบกำหนดเองโดยทำตามข้อเสนอแนะที่ให้ไว้.

ขั้นตอนการแปลงภาพเป็น PDF ที่สามารถค้นหาได้โดยใช้ Python

  1. ตั้งค่าสภาพแวดล้อมให้ใช้ Aspose.OCR for Python via .NET สำหรับการแปลง JPG ที่สแกนเป็น PDF
  2. นำเข้าไลบรารี OCR เพื่อจดจำข้อความจากไฟล์ JPG และบันทึกข้อความเป็น PDF
  3. ตั้งค่าโฟลเดอร์สำหรับภาพอินพุตและไฟล์ PDF เอาต์พุต
  4. สร้างอินสแตนซ์ของ OCR engine เพื่อจดจำข้อความจากภาพสแกน
  5. โหลดภาพสแกนเพื่อการประมวลผลโดยใช้คลาส OcrInput class
  6. เรียกใช้กระบวนการจดจำเพื่อดึงข้อความออก
  7. พิมพ์ข้อความสำหรับข้อมูลผู้ใช้
  8. บันทึกแต่ละส่วนของข้อความเป็น PDF แยกไฟล์

ขั้นตอนข้างต้นครอบคลุมกระบวนการแปลง image to searchable PDF using Python ให้เป็น PDF ที่สามารถค้นหาได้. นำเข้าไลบรารี Aspose ที่จำเป็น, ใช้ใบอนุญาต, ตั้งค่าโฟลเดอร์ที่ต้องการ, สร้างอินสแตนซ์ของเครื่องมือ OCR, และสร้างอ็อบเจ็กต์ OcrInput เพื่อเก็บภาพที่ต้องใช้สำหรับการประมวลผล. เรียกใช้เมธอด recognize () เพื่อดึงข้อความ, วนลูปรายการผลลัพธ์, แสดงผลลัพธ์แต่ละรายการ, และบันทึกแต่ละรายการเป็นไฟล์ PDF แยกต่างหาก.

โค้ดสำหรับแปลงภาพเป็น PDF ที่อ่านได้โดยใช้ Python

โค้ดตัวอย่างข้างต้นแสดงวิธีการ แปลง JPG เป็น PDF ที่อ่านได้โดยใช้ Python. เพื่อปรับปรุงกระบวนการแปลง คุณอาจลองใช้ RecognitionSettings เพื่อเปลี่ยนพฤติกรรม เช่น การตั้งค่าภาษาในการจดจำ, การเปิดใช้งานการกลับสีอัตโนมัติ, หรือการเปิดใช้งานการขยายขนาดฟอนต์ขนาดเล็ก. คุณยังสามารถตั้งค่ารายการอักขระที่อนุญาตหรือไม่สนใจ, ใช้ recognize_fast() แทน recognize() สำหรับภาพคุณภาพสูง, และตรวจสอบ result.skew เพื่อจัดการกับการสแกนที่เอียง.

คู่มือนี้อธิบายขั้นตอนการใช้ OCR กับภาพและบันทึกผลลัพธ์เป็นไฟล์ PDF. เพื่อลบสัญญาณรบกวนจากภาพ, ดูบทความ ลบสัญญาณรบกวนจากภาพโดยใช้ Python.

 ไทย