TextAbsorber
Overview
TextAbsorber є класом в Aspose.PDF FOSS для .NET.
Витягує текст з PDF-сторінки шляхом аналізу потоків вмісту.
Цей клас надає 8 методів роботи з об’єктами TextAbsorber в програмах .NET. Доступні методи включають: Reset, TextAbsorber, Visit. Всі публічні члени доступні будь-якій додаткові .NET після встановлення Aspose.PDF FOSS для пакету .Net. Свойства: Errors, ExtractionOptions, HasErrors, Text, TextSearchOptions.
Properties
| Name | Type | Access | Description |
|---|---|---|---|
Text | string | Read | Витягнутий текст після дзвінка Visit (((). |
ExtractionOptions | TextExtractionOptions | Читання/писання | Обирає або встановлює опції вилучення тексту. |
TextSearchOptions | TextSearchOptions | Читання/писання | Обирає або встановлює опції пошуку тексту, що використовуються під час вилучення. |
Errors | List<TextExtractionError> | Read | Помилки, зафіксовані під час вилучення. |
HasErrors | bool | Read | Чи була зафіксована будь-яка помилка вилучення. |
Methods
| Signature | Description |
|---|---|
TextAbsorber() | Ініціалізує новий TextAbsorber з налаштуваннями по умові. |
TextAbsorber(extractionOptions: TextExtractionOptions) | Ініціалізує новий TextAbsorber з зазначеними опціями вилучення. |
TextAbsorber(textSearchOptions: TextSearchOptions) | Ініціалізує з текстовим пошуком. |
TextAbsorber(extractionOptions: TextExtractionOptions, textSearchOptions: TextSearchOptions) | Ініціалізує як з опціями вилучення, так і пошуку. |
Visit(page: Page) | Витягнення тексту з однієї сторінки. |
Visit(form: XForm) | Витягувати текст з усіх сторінок документа. |
Visit(pdf: Document) | Покликання Visit на цій інстанції TextAbsorber. |
Reset() | Вичищає витягнутий текст і переставляє стан поглинання, щоб його можна було повторно використовувати. |