Tento rychlý průvodce vysvětluje, jak převést image na prohledávatelný PDF pomocí Javy. Obsahuje podrobnosti o nastavení IDE, seznam kroků a ukázkový kód pro změnu obrázku na čitelný PDF pomocí Javy. Také získáte několik vylepšení pro vytvoření vlastního výstupního PDF souboru.
Kroky pro extrakci textu z obrázku do PDF pomocí Javy
- Nastavte IDE tak, aby používalo Aspose.OCR for Java k převodu JPG na čitelný PDF
- Vytvořte instanci licence a nastavte vstupní/výstupní cesty
- Vytvořte instanci objektu OCR engine pro rozpoznání textu z obrázku
- Vytvořte objekt třídy OcrInput a přidejte zdrojový obrázek ke zpracování
- Připravte instanci RecognitionSettings s výchozími nastaveními
- Spusťte proces rozpoznávání textu pomocí metody Recognize() a uložte výsledky
- Procházejte každý výsledek a uložte jej jako samostatný PDF
Výše uvedené kroky shrnují proces převodu obrázku na prohledávatelný PDF pomocí Javy. Vytvořte objekt OCR enginu, použijte třídu OcrInput k načtení zdrojového obrázku, inicializujte nastavení rozpoznávání a spusťte proces. Projděte každý výsledný řetězec a uložte jej jako PDF.
Kód pro převod obrázku na čitelný PDF pomocí Javy
Tento kód ukazuje, jak převést JPG na čitelný PDF pomocí Javy. Měli byste nastavit jazyk rozpoznávání, aby se zlepšila přesnost, místo používání výchozí vícejazykové hodnoty. Povolení automatické inverze barev pro skeny textu z tmavého pozadí také zlepší proces konverze.
Tento článek vám pomáhá při vývoji konvertoru obrázku na prohledávatelný PDF. Pro odstranění šumu z obrázku se podívejte na článek Odstranění šumu z obrázku pomocí Javy.