Deze snelle gids legt uit hoe je image kunt converteren naar doorzoekbare PDF met Java. Het bevat details om de IDE in te stellen, een lijst met stappen, en voorbeeldcode om afbeelding naar leesbare PDF te wijzigen met Java. Je krijgt ook een paar verbeteringen voor het maken van een aangepast uitvoer‑PDF‑bestand.
Stappen om tekst uit een afbeelding naar PDF te extraheren met Java.
- Stel de IDE in om Aspose.OCR for Java te gebruiken om JPG naar een leesbare PDF te converteren
- Instantieer de licentie en stel de invoer-/uitvoerpaden in
- Maak een object van de OCR engine aan om tekst van een afbeelding te herkennen.
- Maak een object van de OcrInput‑klasse aan en voeg de bronafbeelding toe voor verwerking
- Maak een instantie van de RecognitionSettings met de standaardinstellingen
- Voer het tekstherkenningsproces uit met de Recognize()-methode en sla de resultaten op.
- Doorloop elk resultaat en sla elk resultaat op als een aparte PDF
De bovenstaande stappen vatten het proces samen om een afbeelding om te zetten in een doorzoekbare PDF met Java. Instantieer een OCR‑engineobject, gebruik de OcrInput‑klasse om de bronafbeelding te laden, initialiseert de herkenningsinstellingen en voer het proces uit. Itereer door elke resulterende string en sla op als een PDF.
Code om een afbeelding te converteren naar een leesbare PDF met Java
Deze code toont hoe je JPG naar leesbare PDF kunt converteren met Java. Je moet de herkenningstaal instellen om de nauwkeurigheid te verbeteren in plaats van de meertalige standaardwaarde te gebruiken. Het inschakelen van de automatische kleurinversie voor tekstscans van een donkere achtergrond zal ook het conversieproces verbeteren.
Dit artikel helpt je bij het ontwikkelen van een afbeelding-naar-zoekbare-PDF converter. Om ruis uit een afbeelding te verwijderen, raadpleeg je het artikel Ruis verwijderen uit afbeelding met Java.