TextAbsorber
Revisió
TextAbsorber És una classe en Aspose.PDF FOSS per a .NET.
Extreu el text de les pàgines PDF parsant els fluxos de contingut.
Aquesta classe proporciona 8 mètodes per treballar amb els objectes TextAbsorber en programes .NET. Els mètodes disponibles inclouen: Reset, TextAbsorber, Visit. Tots els membres públics estan accessibles a qualsevol aplicació .NET després d’instal·lar el Aspose.PDF FOSS per al paquet .Net. Propietats : Errors, ExtractionOptions, HasErrors, Text, TextSearchOptions.
Propietats
| Nom | Tipus | Access | Descripció |
|---|---|---|---|
Text | string | Llegir | Obté el text. |
ExtractionOptions | TextExtractionOptions | Llegir / Escriure | Obté o estableix les opcions d’extracció de text. |
TextSearchOptions | TextSearchOptions | Llegir / Escriure | Obté o estableix les opcions de cerca de text utilitzades durant l’extracció. |
Errors | List<TextExtractionError> | Llegir | Errors registrats durant l’extracció. |
HasErrors | bool | Llegir | Si s’ha registrat algun error d’extracció. |
Mètodes
| Signature | Descripció |
|---|---|
TextAbsorber() | Inicia un nou TextAbsorber amb les configuracions de predefinit. |
TextAbsorber(extractionOptions: TextExtractionOptions) | Inicialitza un nou TextAbsorber amb les opcions d’extracció especificades. |
TextAbsorber(textSearchOptions: TextSearchOptions) | Iniciar amb les opcions de cerca de text. |
TextAbsorber(extractionOptions: TextExtractionOptions, textSearchOptions: TextSearchOptions) | Inicialitza amb les opcions d’extracció i de cerca. |
Visit(page: Page) | Extratació de text d’una sola pàgina. |
Visit(form: XForm) | Extrata el text de totes les pàgines d’un document. |
Visit(pdf: Document) | Calla Visit(pdf) en aquest instància TextAbsorber. |
Reset() | Es neteja el text extraït i reestableix l’estat d’absorció per tal que es pugui reutilitzar. |