TextAbsorber
Opinie generală
TextAbsorber este o clasă în Aspose.PDF FOSS pentru .NET.
Extrage text din paginile PDF prin analizarea fluxurilor de conținut.
Această clasă oferă 8 metode pentru a lucra cu obiecte TextAbsorber în programe .NET. Metodele disponibile includ: Reset, TextAbsorber, Visit. Toți membrii publicului sunt accesibili oricărei aplicații .NET după instalarea pachetului Aspose.PDF FOSS for .Net. Proprietăți: Errors, ExtractionOptions, HasErrors, Text, TextSearchOptions.
Proprietăți
| Numele de proprietate | Tipul de vehicul | Access | Descriere: |
|---|---|---|---|
Text | string | Citeşte. | Obține textul. |
ExtractionOptions | TextExtractionOptions | Citire/scriere | Obține sau stabilește opțiunile de extragere a textului. |
TextSearchOptions | TextSearchOptions | Citire/scriere | Obține sau stabilește opțiunile de căutare text utilizate în timpul extragerii. |
Errors | List<TextExtractionError> | Citeşte. | Erori înregistrate în timpul extracției. |
HasErrors | bool | Citeşte. | Dacă a fost înregistrată vreo eroare de extracție. |
Metode de evaluare
| Signature | Descriere: |
|---|---|
TextAbsorber() | Iniţializează un nou TextAbsorber cu setări implicite. |
TextAbsorber(extractionOptions: TextExtractionOptions) | Inițializează un nou TextAbsorber cu opțiunile de extracție specificate. |
TextAbsorber(textSearchOptions: TextSearchOptions) | Iniţializează cu opţiuni de căutare text. |
TextAbsorber(extractionOptions: TextExtractionOptions, textSearchOptions: TextSearchOptions) | Iniţializează atât cu opţiunile de extracţie, cât şi cu cele de căutare. |
Visit(page: Page) | Extrage text dintr-o singură pagină. |
Visit(form: XForm) | Extrage text din toate paginile unui document. |
Visit(pdf: Document) | Apeluri Visit(pdf) pe această instanță TextAbsorber. |
Reset() | Curăţă textul extras şi resetează starea de absorbţie, astfel încât să poată fi reutilizat. |