PdfExtractor

خلاصه ای

PdfExtractor یک کلاس در Aspose.PDF FOSS برای .NET است. وارثان از: IDisposable.

نمای برای استخراج متن و تصاویر از یک سند PDF.

این کلاس ۲۹ روش برای کار با PdfExtractor اشیاء در برنامه های .NET را فراهم می کند. روش های موجود شامل: BindPdf, Close, Dispose, ExtractAttachment, ExtractImage, ExtractText, GetAttachNames, GetAttachment, GetAttachmentInfo, GetNextImage, GetNextPageText, GetText,، و سه روش اضافی. همه اعضای عمومی پس از نصب بسته Aspose.PDF FOSS for .NET به هر برنامه .Net قابل دسترسی هستند. خواص: EndPage, ExtractImageMode, ExtractTextMode, IsBidi, Password, Resolution,، و 2 تا ديگه .

خواص

نام:نوع:Accessشرح:
StartPageintخواندن/نوشتن1-based start page for extraction.
EndPageintخواندن/نوشتن1-based end page for extraction.
ExtractTextModeintخواندن/نوشتنحالت استخراج متن.
ExtractImageModeExtractImageModeخواندن/نوشتناستراتژی استخراج تصویر.
Resolutionintخواندن/نوشتنرندر کردن رزولوشن برای استخراج تصویر (DPI).
IsBidiboolبخونید.درست است وقتی که آخرین متن استخراج شده حاوی یک خط از راست به چپ (عبری، عربی، سوری، تایانا و غیره) باشد. یعنی:.
Passwordstring?خواندن/نوشتنرمز عبور استفاده شده در هنگام اتصال فایل های PDF کدگذاری شده.
TextSearchOptionsAspose.Pdf.Text.TextSearchOptionsخواندن/نوشتنگزینه های جستجوی متن در طول ExtractText استفاده شده است.

روش ها

Signatureشرح:
PdfExtractor()PdfExtractor را در این مورد PdfExtractor فرا می خواند.
PdfExtractor(document: Document)
BindPdf(inputFile: string)BindPdf را در این مورد PdfExtractor فرا می خواند.
BindPdf(document: Document)
BindPdf(inputStream: Stream)
ExtractText()هر صفحه را در سند بسته با TextAbsorber می گذرد و متن استخراج شده را به هم متصل می کند.
ExtractText(outputFile: string)متن را از PDF بسته شده استخراج کنید و آن را به فایل داده شده (بایت های UTF-16 LE) ذخیره کنید.
ExtractText(encoding: Encoding)متن را از PDF بسته با استفاده از کدگذاری داده شده استخراج کنید.
GetText(outputStream: Stream)متن استخراج شده را به عنوان بایت در outputStream می نویسد، با استفاده از کدگذاری تنظیم شده توسط آخرین ExtractText ((کود) تماس (پیش فرض برای UTF-16 LE).
GetText(outputStream: Stream, filterNotAscii: bool)متن استخراج شده را به عنوان بایت می نویسد، و در صورت لزوم اولین کد های غیر ASCII را حذف می کند.
GetText(outputFile: string)متن استخراج شده را به مسیر فایل داده می نویسد.
HasNextPageText()درست اگر متن صفحه دیگری از طریق GetNextPageText موجود باشد.
GetNextPageText(outputFile: string)متن صفحه بعدی را به مسیر فایل داده شده (بایت های UTF-16 LE) می نویسد.
GetNextPageText(outputStream: Stream)متن صفحه بعدی را به جریان داده شده (بایت های UTF-16 LE) می نویسد.
ExtractImage()ExtractImage را در این مورد PdfExtractor فرا می خواند.
ExtractImage(outputDirectory: string)هر تصویر را به دایرکتوری داده شده استخراج کنید، نامگذاری فایل ها image_N.jpg برای منابع JPEG و image _ N.png در غیر این صورت.
HasNextImage()درست است در حالی که GetNextImage(string) یک تصویر باقی مانده برای نوشتن دارد.
GetNextImage(outputStream: Stream)GetNextImage را در این مورد PdfExtractor فرا می خواند.
GetNextImage(outputFile: string)
GetNextImage(outputStream: Stream, format: System.Drawing.Imaging.ImageFormat)
GetNextImage(outputFile: string, format: System.Drawing.Imaging.ImageFormat)
ExtractAttachment()هر فایل چسبیده در سند بسته شده را انتخاب کنید؛ یک GetAttachment ((string) بعدی همه آنها را می نویسد.
ExtractAttachment(attachmentFileName: string)یک فایل داخل شده را با نام برای استخراج انتخاب کنید.
GetAttachNames()نام هر فایل درون سند بسته شده.
GetAttachmentInfo()FileSpecification برای هر فایل درون سند بسته شده وارد می شود.
GetAttachment()محتوای ضمیمه های انتخاب شده را به عنوان MemoryStreams (همه ضمیمات زمانی که هیچ یک از آنها بطور صریح انتخاب نشده اند) بازگردانید.
GetAttachment(outputPath: string)فایل های ضمیمه انتخاب شده (همه وقتی که هیچ کدام به طور صریح انتخاب نشده اند) را در دایرکتوری outputPath بنویسید، یک فایل برای هر افزونه با نام نام پرونده آن.
Close()در این مورد PdfExtractor تماس نزدیک می کند.
Dispose()در این مورد PdfExtractor تماس بگیرید.

همچنین ببینید:

 فارسی