pdfOCR is an iText add-on for Java to recognize and extract text in scanned documents and images. It can also convert them into fully ISO-compliant PDF or PDF/A-3u files that are accessible, searchable, and suitable for archiving

Compile Dependencies (3)

Category/LicenseGroup / ArtifactVersionUpdates
AGPL 3.0
com.itextpdf » layout7.2.49.7.1
AGPL 3.0
com.itextpdf » pdfa7.2.49.7.1
Apache 2.0
org.apache.commons » commons-imaging
Apache Commons Imaging (previously Sanselan) is a pure-Java image library.
1.0-alpha11.0

Test Dependencies (1)

Category/LicenseGroup / ArtifactVersionUpdates
AGPL 3.0
com.itextpdf » pdftest7.2.47.1.16