Denna snabba guide förklarar hur man konverterar image till sökbar PDF med Java. Den innehåller detaljer för att ställa in IDE:n, en lista med steg och exempel på kod för att ändra bild till läsbar PDF med Java. Du får också några förbättringar för att skapa en anpassad utdata‑PDF‑fil.
Steg för att extrahera text från en bild till PDF med Java
- Ställ in IDE:n att använda Aspose.OCR for Java för att konvertera JPG till en läsbar PDF
- Instansiera licensen och ange in- och utdata‑sökvägar
- Skapa ett objekt av OCR engine för att känna igen text från en bild
- Skapa ett objekt av OcrInput‑klassen och lägg till källbilden för bearbetning
- Skapa en instans av RecognitionSettings med standardinställningarna
- Kör textigenkänningsprocessen med metoden Recognize() och spara resultaten
- Gå igenom varje resultat och spara varje resultat som en separat PDF
Ovanstående steg sammanfattar processen för att konvertera en bild till en sökbar PDF med Java. Skapa ett OCR-motorobjekt, använd OcrInput-klassen för att ladda källbilden, initiera igenkänningsinställningarna och kör processen. Iterera genom varje resulterande sträng och spara som en PDF.
Kod för att konvertera bild till läsbar PDF med Java
Den här koden demonstrerar hur man konverterar JPG till läsbar PDF med Java. Du bör ställa in igenkänningsspråket för att förbättra noggrannheten istället för att använda det flerspråkiga standardvärdet. Att aktivera automatisk färginvertering för textskanningar från en mörk bakgrund kommer också att förbättra konverteringsprocessen.
Den här artikeln hjälper dig att utveckla en bild‑till‑sökbar‑PDF‑konverterare. För att ta bort brus från en bild, se artikeln Ta bort brus från en bild med Java.