PdfExtractor

Overview

PdfExtractor यह एक क्लास है Aspose.PDF FOSS के लिए .NET. वारिस से: IDisposable.

एक पीडीएफ दस्तावेज़ से पाठ और छवियों को निकालने के लिए चेक।.

इस वर्ग में .NET प्रोग्रामों में PdfExtractor वस्तुओं के साथ काम करने के लिए 29 तरीके प्रदान किए जाते हैं।. उपलब्ध तरीकों में शामिल हैं: BindPdf, Close, Dispose, ExtractAttachment, ExtractImage, ExtractText, GetAttachNames, GetAttachment, GetAttachmentInfo, GetNextImage, GetNextPageText, GetText,और तीन अतिरिक्त तरीके।. सभी सार्वजनिक सदस्य किसी भी .NET अनुप्रयोग के लिए उपलब्ध हैं Aspose.PDF FOSS को स्थापित करने के बाद .Net पैकेज के साथ।. संपत्ति : EndPage, ExtractImageMode, ExtractTextMode, IsBidi, Password, Resolution,और दो और।.

Properties

NameTypeAccessDescription
StartPageintपढ़ना / लिखना1-based start page for extraction.
EndPageintपढ़ना / लिखना1-based end page for extraction.
ExtractTextModeintपढ़ना / लिखनापाठ निकालने का तरीका।.
ExtractImageModeExtractImageModeपढ़ना / लिखनाImage Extraction की रणनीति।.
Resolutionintपढ़ना / लिखनाRendering Resolution for Image Extraction (DPI) के लिए रिलेशनशिप।.
IsBidiboolReadयह सच है जब सबसे हाल ही में निकाले गए पाठ में दाईं ओर-बाएं स्क्रिप्ट चलता है (हिब्रू, अरबी, सीरियाई, थाना आदि), अर्थात।.
Passwordstring?पढ़ना / लिखनाएन्क्रिप्टेड पीडीएफ को बाध्य करने के लिए उपयोग किए जाने वाले पासवर्ड।.
TextSearchOptionsAspose.Pdf.Text.TextSearchOptionsपढ़ना / लिखनापाठ खोज विकल्प ExtractText() के दौरान लागू किए गए थे।.

Methods

SignatureDescription
PdfExtractor()इस उदाहरण पर PdfExtractor कॉल करें।.
PdfExtractor(document: Document)
BindPdf(inputFile: string)इस उदाहरण पर BindPdf कॉल करें।.
BindPdf(document: Document)
BindPdf(inputStream: Stream)
ExtractText()TextAbsorber के साथ बाध्य दस्तावेज़ में प्रत्येक पृष्ठ चलता है और निकाले गए पाठ को संकुचित करता है।.
ExtractText(outputFile: string)पाठ को बांड पीडीएफ से निकाल दें और इसे दिए गए फ़ाइल (UTF-16 LE बाइट्स) में सहेजें।.
ExtractText(encoding: Encoding)पाठ को दिए गए एन्कोडिंग का उपयोग करके बांड पीडीएफ से निकालना।.
GetText(outputStream: Stream)निकाल दिया गया पाठ बाइट्स के रूप में आउटपुट स्ट्रीम में लिखता है, नवीनतम ExtractText(Encoding) कॉल द्वारा निर्धारित कोडिंग का उपयोग करके (UTF-16 LE के लिए डिफ़ॉल्ट)।.
GetText(outputStream: Stream, filterNotAscii: bool)यह निकाले गए पाठ को बाइट्स के रूप में लिखता है, वैकल्पिक रूप से गैर-एएससीआई कोडपॉइंट पहले छोड़ देता है।.
GetText(outputFile: string)उस फ़ाइल मार्ग पर निकाले गए पाठ को लिखें।.
HasNextPageText()यह सच है यदि GetNextPageText के माध्यम से एक और पृष्ठ का पाठ उपलब्ध है।.
GetNextPageText(outputFile: string)अगली पृष्ठ का पाठ दिए गए फ़ाइल मार्ग (UTF-16 LE बाइट्स) पर लिखें।.
GetNextPageText(outputStream: Stream)अगली पृष्ठ का पाठ उस प्रवाह में लिखें (UTF-16 LE बाइट्स)।.
ExtractImage()इस उदाहरण पर ExtractImage कॉल करें।.
ExtractImage(outputDirectory: string)प्रत्येक छवि को दिए गए निर्देशिका में निकालना, फ़ाइलों image_N.jpg के लिए JPEG स्रोतों और image-N .png का नाम देना।.
HasNextImage()सच है जबकि GetNextImage(string) में लिखने के लिए एक शेष छवि है।.
GetNextImage(outputStream: Stream)इस उदाहरण पर GetNextImage कॉल करें।.
GetNextImage(outputFile: string)
GetNextImage(outputStream: Stream, format: System.Drawing.Imaging.ImageFormat)
GetNextImage(outputFile: string, format: System.Drawing.Imaging.ImageFormat)
ExtractAttachment()बंधे हुए दस्तावेज़ में प्रत्येक अंतर्निहित फ़ाइल का चयन करें; एक बाद GetAttachment(string) उन सभी को लिखता है।.
ExtractAttachment(attachmentFileName: string)निकालने के लिए नाम से एक अंदरूनी फ़ाइल का चयन करें।.
GetAttachNames()प्रत्येक फ़ाइल का नाम बांड दस्तावेज़ में शामिल है।.
GetAttachmentInfo()FileSpecification प्रत्येक अंतर्निहित फ़ाइल के लिए बांड दस्तावेज़ में प्रवेश करता है।.
GetAttachment()चयनित अनुलग्नकों की सामग्री को MemoryStreams के रूप में वापस करें (सभी अनुप्रयोग जब कोई स्पष्ट रूप से नहीं चुना गया था)।.
GetAttachment(outputPath: string)चयनित अनुलग्नक (सभी जब कोई स्पष्ट रूप से नहीं चुना गया) को आउटपुटपैथ निर्देशिका में लिखें, प्रत्येक अनुभाग के लिए एक फ़ाइल जिसका नाम उसके फ़ील्ड नाम के बाद है।.
Close()इस PdfExtractor उदाहरण पर निकट कॉल करें।.
Dispose()इस संस्करण पर कॉल उपलब्ध है।.

See Also

 हिन्दी