PdfExtractor

Genel Bakış

PdfExtractor NET için FOSS’de bir sınıf. Mirasçılar: IDisposable.

PDF belgelerinden metin ve görüntüler çıkarmak için bir cephe.

Bu sınıf, .NET programlarında PdfExtractor nesnelerle çalışmak için 29 yöntem sağlar. Kullanılabilir yöntemler şunlardır: BindPdf, Close, Dispose, ExtractAttachment, ExtractImage, ExtractText, GetAttachNames, GetAttachment, GetAttachmentInfo, GetNextImage, GetNextPageText, GetText, ve 3 ek yöntem. Tüm kamu üyeleri, .NET paketi için Aspose.PDF FOSS’u yükledikten sonra herhangi bir NET uygulamasına erişilebilir. Özellikleri: EndPage, ExtractImageMode, ExtractTextMode, IsBidi, Password, Resolution,Ve iki tane daha.

Özellikler

Adı:Tip:AccessAçıklama:
StartPageintOkuma/Yazma1-based start page for extraction.
EndPageintOkuma/Yazma1-based end page for extraction.
ExtractTextModeintOkuma/YazmaMetin çıkarma modu.
ExtractImageModeExtractImageModeOkuma/YazmaGörüntü çıkarma stratejisi.
ResolutionintOkuma/YazmaGörüntü çıkarma (DPI) için çözünürlük oluşturmak.
IsBidiboolOku .En son alınan metin sağdan sola yazılı bir yazı sürüşü içerdiğinde doğru (İbranice, Arapça, Suriyece, Thaana vb.), yani.
Passwordstring?Okuma/YazmaŞifreli bir PDF’i bağlarken kullanılan parola.
TextSearchOptionsAspose.Pdf.Text.TextSearchOptionsOkuma/YazmaExtractText() sırasında kullanılan metin arama seçenekleri.

Yöntemler

SignatureAçıklama:
PdfExtractor()PdfExtractor’ı bu PdfExtractor örneğinde çağırır.
PdfExtractor(document: Document)PdfExtractor(doküman) bu PdfExtractor örneğinde çağrılır.
BindPdf(inputFile: string)BindPdf(inputFile) bu PdfExtractor örneğinde çağrılır.
BindPdf(document: Document)BindPdf(doküman) bu PdfExtractor örneğinde çağrılır.
BindPdf(inputStream: Stream)BindPdf(inputStream) bu PdfExtractor örneğinde çağrılır.
ExtractText()Bağlı belgedeki her sayfayı TextAbsorber ile yürütür ve alınan metni zincirler.
ExtractText(outputFile: string)Bağlı PDF’den metni çıkarın ve verilen dosyaya kaydetin (UTF-16 LE bayt).
ExtractText(encoding: Encoding)Verilen kodlamayı kullanarak bağlanmış PDF’den metni çıkarın.
GetText(outputStream: Stream)Çıkarılan metni en son ExtractText ((Kodlama) çağrısı tarafından ayarlanan kodlamayı kullanarak outputStream’a bayt olarak yazar (varsayılan UTF-16 LE).
GetText(outputStream: Stream, filterNotAscii: bool)Çıkarılan metni bayt olarak yazar, seçeneğe göre önce ASCII olmayan kod noktaları bırakır.
GetText(outputFile: string)Ekstrakt edilen metni verilen dosya yolu üzerine yazar.
HasNextPageText()GetNextPageText üzerinden başka bir sayfanın metni mevcutsa doğru.
GetNextPageText(outputFile: string)Bir sonraki sayfanın metnini verilen dosya yoluna yazar (UTF-16 LE bayt).
GetNextPageText(outputStream: Stream)Verilen akışa (UTF-16 LE bayt) bir sonraki sayfanın metnini yazar.
ExtractImage()ExtractImage’ı bu PdfExtractor örneğinde çağırır.
ExtractImage(outputDirectory: string)Verilen dizinde her resmi çıkarın, JPEG kaynakları için dosyalara image_N.jpg ve diğer durumlarda image _N .png isimlendirin.
HasNextImage()GetNextImage(string) yazmak için kalan bir görüntü varken doğru.
GetNextImage(outputStream: Stream)GetNextImage(outputStream) bu PdfExtractor örneğinde çağrılır.
GetNextImage(outputFile: string)GetNextImage(outputFile) bu PdfExtractor örneğinde çağrılır.
GetNextImage(outputStream: Stream, format: System.Drawing.Imaging.ImageFormat)GetNextImage{outputStream, format) bu PdfExtractor örneğinde çağrılar.
GetNextImage(outputFile: string, format: System.Drawing.Imaging.ImageFormat)GetNextImage{outputFile, format) bu PdfExtractor örneğinde çağrılır.
ExtractAttachment()Bağlı belgedeki her gömülü dosyayı seçin; bir sonraki GetAttachment(sır) hepsini yazar.
ExtractAttachment(attachmentFileName: string)Ekran için bir tane yerleştirilmiş dosyayı seçin.
GetAttachNames()Bağlı belgedeki her gömülü dosyanın adı.
GetAttachmentInfo()Bağlı belgedeki her gömülü dosya için FileSpecification girişleri.
GetAttachment()Seçilen eklerin içeriğini MemoryStreams olarak gönderin (kesin bir şekilde seçilmediği takdirde tüm ekler).
GetAttachment(outputPath: string)Seçilen ekleri (tam olarak seçilmediğinde hepsi) outputPath dizinine yazın. Her bir ek dosyasının adı kendi dosya adından alınır.
Close()Bu PdfExtractor örneğinde yakın çağrılar.
Dispose()Bu PdfExtractor örneğinde Dispose çağrısı.

Ayrıca bakınız:

 Türkçe