Apache Tika is a toolkit for detecting and extracting metadata and structured text content from various documents using existing parser libraries.
<dependency>
<groupId>org.apache.tika</groupId>
<artifactId>tika-parsers-standard-package</artifactId>
<version>3.3.0</version>
</dependency>No compatibility data collected yet for this library.
Verified import paths — ran on the pinned version, not inferred.
Parses a document and extracts text.
No known issues recorded.
No dependency data recorded yet.