TextAbsorber
Översikt
TextAbsorber är en klass i Aspose.PDF FOSS för .NET.
Extraherar text från PDF-sidor genom att parsera innehållströmmar.
Denna klass ger 8 metoder för att arbeta med TextAbsorber objekt i .NET-program. Tillgängliga metoder inkluderar: Reset, TextAbsorber, Visit. Alla offentliga medlemmar är tillgängliga för alla .NET-applikationer efter att ha installerat Aspose.PDF FOSS för .Net-paketet. och egenskaper: Errors, ExtractionOptions, HasErrors, Text, TextSearchOptions.
ägodelar
| Namn | Typ av | Access | Beskrivning |
|---|---|---|---|
Text | string | Läsning | Den extraherade texten efter att ha kallat Visit(). |
ExtractionOptions | TextExtractionOptions | Läs/ Skriv | Få eller ställa in alternativen för textutvinning. |
TextSearchOptions | TextSearchOptions | Läs/ Skriv | Få eller ställa in sökalternativ för text som används under utvinning. |
Errors | List<TextExtractionError> | Läsning | Fel som upptäcks under utvinning. |
HasErrors | bool | Läsning | Om någon extrahera fel har registrerats. |
Metoder
| Signature | Beskrivning |
|---|---|
TextAbsorber() | Initialiserar en ny TextAbsorber med standardinställningar. |
TextAbsorber(extractionOptions: TextExtractionOptions) | Initialiserar en ny TextAbsorber med de angivna utvinningslägen. |
TextAbsorber(textSearchOptions: TextSearchOptions) | Initialisera med text-sökalternativ. |
TextAbsorber(extractionOptions: TextExtractionOptions, textSearchOptions: TextSearchOptions) | Initialiserar med både utvinning och sökalternativ. |
Visit(page: Page) | Ta ut text från en enda sida. |
Visit(form: XForm) | Extrahera text från alla sidor i ett dokument. |
Visit(pdf: Document) | Kalla besök på denna instans TextAbsorber. |
Reset() | Rengör den extraherade texten och återställer absorberingsstatus så att den kan användas igen. |