TextExtractor

TextExtractor

Genel Bakış

TextExtractor Java için FOSS’de bir sınıf.

Metin işleme operatörleri ile PDF sayfa içeriği akışlarından metni çıkarır. (ISO 32000-1:2008, §9.4).

Bu sınıf, Java programlarında TextExtractor nesnelerle çalışmak için 3 yöntem sağlar. Kullanılabilir yöntemler şunlardır: TextExtractor, extract, extractText. Tüm kamu üyeleri, Java için FOSS paketini yükledikten sonra herhangi bir Java uygulamasına erişilebilir.

Yöntemler

SignatureAçıklama:
TextExtractor(parser: PDFParser)TextExtractor oluşturur.
extract(page: Page)List<TextFragment>Bir sayfadan tüm metin parçalarını çıkarır.
extractText(page: Page)StringBir sayfadan tüm metni basit bir dize olarak çıkarır.

Ayrıca bakınız:

 Türkçe