PdfExtractor
Približni podaci
PdfExtractor je klasa u Aspose.PDF FOSS za .NET. Nasljednici od: IDisposable.
Facade za izvlačenje teksta i slika iz PDF dokumenta.
Ova klasa pruža 29 metoda za rad s PdfExtractor objektima u .NET programima. Postoje i sljedeće metode: BindPdf, Close, Dispose, ExtractAttachment, ExtractImage, ExtractText, GetAttachNames, GetAttachment, GetAttachmentInfo, GetNextImage, GetNextPageText, GetText, i tri dodatna metoda. Svi javni članovi dostupni su bilo kojoj .NET aplikaciji nakon instalacije paketa Aspose.PDF FOSS za .Net. Ograničenja: EndPage, ExtractImageMode, ExtractTextMode, IsBidi, Password, Resolution, i još 2 .
Oznake i značajke
| Izvršni datum: | Iznos: | Prihvat | Opisivanje |
|---|---|---|---|
StartPage | int | Čitanje/pisanje | 1-based start page for extraction. |
EndPage | int | Čitanje/pisanje | 1-based end page for extraction. |
ExtractTextMode | int | Čitanje/pisanje | U režimu za izvlačenje teksta. |
ExtractImageMode | ExtractImageMode | Čitanje/pisanje | Strategija ekstrakcije slike. |
Resolution | int | Čitanje/pisanje | Snimka se može prikazati u obliku slike. |
IsBidi | bool | Čitaj. | Istina kada najnoviji tekst sadrži rukopis koji se kreće s desne na lijevu stranu (hebrajski, arapski, sirijski i thaana itd.), tj. |
Password | string? | Čitanje/pisanje | Kodiranje šifriranih PDF-ova. |
TextSearchOptions | Aspose.Pdf.Text.TextSearchOptions | Čitanje/pisanje | U slučaju da je to moguće, treba se primjenjivati sljedeći postupak:. |
Metoda za primjenu
| Potpis | Opisivanje |
|---|---|
PdfExtractor() | Zove PdfExtractor na ovom PdfExtractor primjerka. |
PdfExtractor(document: Document) | |
BindPdf(inputFile: string) | Zove BindPdf na ovom PdfExtractor primjerka. |
BindPdf(document: Document) | |
BindPdf(inputStream: Stream) | |
ExtractText() | Pretraži svaku stranicu u vezanoj dokumenti s TextAbsorber i povezuje izveden tekst. |
ExtractText(outputFile: string) | Izvadite tekst iz vezane PDF-a i sačuvajte ga u datoj datoteki (UTF-16 LE bajtovi). |
ExtractText(encoding: Encoding) | Izvadite tekst iz vezane PDF-a pomoću navedenog kodiranja. |
GetText(outputStream: Stream) | Uvodni tekst se piše kao bajt u izlaznu sliku, koristeći kodiranje postavljeno najnovijim pozivom ExtractText ((Encoding) (predviđene vrijednosti su UTF-16 LE). |
GetText(outputStream: Stream, filterNotAscii: bool) | Piše izveden tekst kao bajtove, pri čemu se prvo povlače kodne tačke koje nisu ASCII. |
GetText(outputFile: string) | Piše izveden tekst na datoteku. |
HasNextPageText() | Istina ako je tekst druge stranice dostupan putem GetNextPageText. |
GetNextPageText(outputFile: string) | Piše tekst sljedeće stranice na datoteku (UTF-16 LE bajtova). |
GetNextPageText(outputStream: Stream) | Piše tekst sljedeće stranice na datom strimu (UTF-16 LE bajtova). |
ExtractImage() | Zove ExtractImage na ovom PdfExtractor primjerka. |
ExtractImage(outputDirectory: string) | Izvadite svaku sliku iz datog direktorija, imenovanjem datoteka image_N.jpg za JPEG izvore i image _N .png inače. |
HasNextImage() | Istina dok GetNextImage(string) ima preostali prikaz za pisanje. |
GetNextImage(outputStream: Stream) | Zove GetNextImage na ovom PdfExtractor primjerka. |
GetNextImage(outputFile: string) | |
GetNextImage(outputStream: Stream, format: System.Drawing.Imaging.ImageFormat) | |
GetNextImage(outputFile: string, format: System.Drawing.Imaging.ImageFormat) | |
ExtractAttachment() | Odaberi svaku ugrađenu datoteku u vezano dokumentu; naknadni GetAttachment(string) piše sve njih. |
ExtractAttachment(attachmentFileName: string) | Odaberi jednu ugrađenu datoteku po imenu za izvlačenje. |
GetAttachNames() | Naziv svake ugrađene datoteke u vezano dokumentu. |
GetAttachmentInfo() | FileSpecification unosi za svaku ugrađenu datoteku u vezano dokumentu. |
GetAttachment() | U nastavku se navodi broj podataka koji su bili odabrani za priključak. |
GetAttachment(outputPath: string) | Napišite odabrane priloške (sve kada nijedan nije izričito izabran) u direktorij outputPath, jednu datoteku po prilogu nazvanom po imenu datotek. |
Close() | Zove se “Ključi” u ovom PdfExtractor slučaju. |
Dispose() | Zove se raspolaganje na ovom PdfExtractor primjerku. |