pdfOCR is an iText add-on to recognize and extract text in scanned documents and images. It can also convert them into fully ISO-compliant PDF or PDF/A-3u files that are accessible, searchable, and suitable for archiving
pdfdataimageocrrecognitionglyphstesseractscancharacterspanishsearchableligatureshindiportugueseopticalarchivalmandarinextractableiso-compliantdiacritic
-
Updated
Aug 26, 2026 - Java