PdfExtractor

Približni podaci

PdfExtractor je klasa u Aspose.PDF FOSS za .NET. Nasljednici od: IDisposable.

Facade za izvlačenje teksta i slika iz PDF dokumenta.

Ova klasa pruža 29 metoda za rad s PdfExtractor objektima u .NET programima. Postoje i sljedeće metode: BindPdf, Close, Dispose, ExtractAttachment, ExtractImage, ExtractText, GetAttachNames, GetAttachment, GetAttachmentInfo, GetNextImage, GetNextPageText, GetText, i tri dodatna metoda. Svi javni članovi dostupni su bilo kojoj .NET aplikaciji nakon instalacije paketa Aspose.PDF FOSS za .Net. Ograničenja: EndPage, ExtractImageMode, ExtractTextMode, IsBidi, Password, Resolution, i još 2 .

Oznake i značajke

Izvršni datum:Iznos:PrihvatOpisivanje
StartPageintČitanje/pisanje1-based start page for extraction.
EndPageintČitanje/pisanje1-based end page for extraction.
ExtractTextModeintČitanje/pisanjeU režimu za izvlačenje teksta.
ExtractImageModeExtractImageModeČitanje/pisanjeStrategija ekstrakcije slike.
ResolutionintČitanje/pisanjeSnimka se može prikazati u obliku slike.
IsBidiboolČitaj.Istina kada najnoviji tekst sadrži rukopis koji se kreće s desne na lijevu stranu (hebrajski, arapski, sirijski i thaana itd.), tj.
Passwordstring?Čitanje/pisanjeKodiranje šifriranih PDF-ova.
TextSearchOptionsAspose.Pdf.Text.TextSearchOptionsČitanje/pisanjeU slučaju da je to moguće, treba se primjenjivati sljedeći postupak:.

Metoda za primjenu

PotpisOpisivanje
PdfExtractor()Zove PdfExtractor na ovom PdfExtractor primjerka.
PdfExtractor(document: Document)
BindPdf(inputFile: string)Zove BindPdf na ovom PdfExtractor primjerka.
BindPdf(document: Document)
BindPdf(inputStream: Stream)
ExtractText()Pretraži svaku stranicu u vezanoj dokumenti s TextAbsorber i povezuje izveden tekst.
ExtractText(outputFile: string)Izvadite tekst iz vezane PDF-a i sačuvajte ga u datoj datoteki (UTF-16 LE bajtovi).
ExtractText(encoding: Encoding)Izvadite tekst iz vezane PDF-a pomoću navedenog kodiranja.
GetText(outputStream: Stream)Uvodni tekst se piše kao bajt u izlaznu sliku, koristeći kodiranje postavljeno najnovijim pozivom ExtractText ((Encoding) (predviđene vrijednosti su UTF-16 LE).
GetText(outputStream: Stream, filterNotAscii: bool)Piše izveden tekst kao bajtove, pri čemu se prvo povlače kodne tačke koje nisu ASCII.
GetText(outputFile: string)Piše izveden tekst na datoteku.
HasNextPageText()Istina ako je tekst druge stranice dostupan putem GetNextPageText.
GetNextPageText(outputFile: string)Piše tekst sljedeće stranice na datoteku (UTF-16 LE bajtova).
GetNextPageText(outputStream: Stream)Piše tekst sljedeće stranice na datom strimu (UTF-16 LE bajtova).
ExtractImage()Zove ExtractImage na ovom PdfExtractor primjerka.
ExtractImage(outputDirectory: string)Izvadite svaku sliku iz datog direktorija, imenovanjem datoteka image_N.jpg za JPEG izvore i image _N .png inače.
HasNextImage()Istina dok GetNextImage(string) ima preostali prikaz za pisanje.
GetNextImage(outputStream: Stream)Zove GetNextImage na ovom PdfExtractor primjerka.
GetNextImage(outputFile: string)
GetNextImage(outputStream: Stream, format: System.Drawing.Imaging.ImageFormat)
GetNextImage(outputFile: string, format: System.Drawing.Imaging.ImageFormat)
ExtractAttachment()Odaberi svaku ugrađenu datoteku u vezano dokumentu; naknadni GetAttachment(string) piše sve njih.
ExtractAttachment(attachmentFileName: string)Odaberi jednu ugrađenu datoteku po imenu za izvlačenje.
GetAttachNames()Naziv svake ugrađene datoteke u vezano dokumentu.
GetAttachmentInfo()FileSpecification unosi za svaku ugrađenu datoteku u vezano dokumentu.
GetAttachment()U nastavku se navodi broj podataka koji su bili odabrani za priključak.
GetAttachment(outputPath: string)Napišite odabrane priloške (sve kada nijedan nije izričito izabran) u direktorij outputPath, jednu datoteku po prilogu nazvanom po imenu datotek.
Close()Zove se “Ključi” u ovom PdfExtractor slučaju.
Dispose()Zove se raspolaganje na ovom PdfExtractor primjerku.

Također pogledajte:

 Hrvatski