TextAbsorber
Genel Bakış
TextAbsorber NET için FOSS’de bir sınıf.
İçerik akışlarını analiz ederek PDF sayfalarından metin çıkarır.
Bu sınıf, .NET programlarında TextAbsorber nesnelerle çalışmak için 8 yöntem sağlar. Kullanılabilir yöntemler şunlardır: Reset, TextAbsorber, Visit. Tüm kamu üyeleri, .NET paketi için Aspose.PDF FOSS’u yükledikten sonra herhangi bir NET uygulamasına erişilebilir. Özellikleri: Errors, ExtractionOptions, HasErrors, Text, TextSearchOptions.
Özellikler
| Adı: | Tip: | Access | Açıklama: |
|---|---|---|---|
Text | string | Oku . | Metni alır. |
ExtractionOptions | TextExtractionOptions | Okuma/Yazma | Metin çıkarma seçeneklerini alır veya ayarlar. |
TextSearchOptions | TextSearchOptions | Okuma/Yazma | Çıkarma sırasında kullanılan metin arama seçeneklerini alır veya ayarlar. |
Errors | List<TextExtractionError> | Oku . | Ekstraksiyon sırasında kaydedilen hatalar. |
HasErrors | bool | Oku . | Bir çıkarma hatası kaydedildi mi. |
Yöntemler
| Signature | Açıklama: |
|---|---|
TextAbsorber() | Varsayılan ayarlarla yeni bir TextAbsorber başlatır. |
TextAbsorber(extractionOptions: TextExtractionOptions) | Belirtilen çıkarma seçenekleriyle yeni bir TextAbsorber başlatır. |
TextAbsorber(textSearchOptions: TextSearchOptions) | Metin arama seçenekleriyle başlatır. |
TextAbsorber(extractionOptions: TextExtractionOptions, textSearchOptions: TextSearchOptions) | Hem çıkarma hem de arama seçenekleriyle başlatır. |
Visit(page: Page) | Tek bir sayfadan metin çıkar. |
Visit(form: XForm) | Bir belgenin tüm sayfalarından metni çıkar. |
Visit(pdf: Document) | Bu TextAbsorber örneğinde Visit ((pdf) çağrısı. |
Reset() | Çıkarılan metni temizler ve yeniden kullanılabilir olması için absorber durumunu sıfırlar. |