TextExtractor
Översikt
TextExtractor är en klass i Aspose.PDF FOSS för Java.
Utvinner text från PDF-sidans innehållströmmar genom att behandla textoperatorer. (ISO 32000-1:2008, §9.4).
Denna klass ger 3 metoder för att arbeta med TextExtractor objekt i Java-program. Tillgängliga metoder är bland annat: TextExtractor, extract, extractText. Alla offentliga medlemmar är tillgängliga för alla Java-applikationer efter installation av FOSS for Java.
Methods
| Signature | Beskrivning |
|---|---|
TextExtractor(parser: PDFParser) | Skapar en TextExtractor. |
extract(page: Page) → List<TextFragment> | Extraherar alla textrem från en sida. |
extractText(page: Page) → String | Extraherar all text från en sida som ett enkelt sträng. |