TextExtractor
Genel Bakış
TextExtractor Java için FOSS’de bir sınıf.
Metin işleme operatörleri ile PDF sayfa içeriği akışlarından metni çıkarır. (ISO 32000-1:2008, §9.4).
Bu sınıf, Java programlarında TextExtractor nesnelerle çalışmak için 3 yöntem sağlar. Kullanılabilir yöntemler şunlardır: TextExtractor, extract, extractText. Tüm kamu üyeleri, Java için FOSS paketini yükledikten sonra herhangi bir Java uygulamasına erişilebilir.
Yöntemler
| Signature | Açıklama: |
|---|---|
TextExtractor(parser: PDFParser) | TextExtractor oluşturur. |
extract(page: Page) → List<TextFragment> | Bir sayfadan tüm metin parçalarını çıkarır. |
extractText(page: Page) → String | Bir sayfadan tüm metni basit bir dize olarak çıkarır. |