PdfExtractor
PdfExtractor
अवलोकन
PdfExtractor जावा के लिए Aspose.PDF FOSS में एक वर्ग है. वारिसों सेः: Closeable.
पीडीएफ दस्तावेजों से पाठ और छवियों को निकालने के लिए मुखौटा।.
यह वर्ग जावा प्रोग्राम में PdfExtractor ऑब्जेक्ट के साथ काम करने के लिए 41 विधियाँ प्रदान करता है. उपलब्ध विधियों में शामिल हैंः: PdfExtractor, bindPdf, close, extractAttachment, extractImage, extractText, getAttachNames, getAttachment, getEndPage, getExtractImageMode, getExtractTextMode, getImageCount, और 18 अतिरिक्त विधियाँ।. सभी सार्वजनिक सदस्य Aspose.PDF FOSS for Java पैकेज को स्थापित करने के बाद किसी भी जावा एप्लिकेशन तक पहुंच सकते हैं. गुण: attachNames, bidi, endPage, extractImageMode, extractTextMode, imageCount, और 5 अधिक।.
गुण
| नाम | प्रकार | Access | विवरण |
|---|---|---|---|
password | String | पढ़िए। | बाद में {@link #bindPdf(String)} या { @link#bind Pdf ((InputStream) } कॉल में एन्क्रिप्टेड पीडीएफ को खोलने पर लागू पासवर्ड लौटाता है. |
startPage | int | पढ़िए। | प्रारंभ पृष्ठ लौटाता है. |
endPage | int | पढ़िए। | अंत पृष्ठ लौटाता है. |
extractTextMode | int | पढ़िए। | वर्तमान पाठ निकासी मोड लौटाता है. |
resolution | Resolution | पढ़िए। | कॉन्फ़िगर किया गया निष्कर्षण संकल्प लौटाता है. |
extractImageMode | ExtractImageMode | पढ़िए। | छवि निष्कर्षण मोड लौटाता है. |
textAsString | String | पढ़िए। | निकाले गए पाठ को स्ट्रिंग के रूप में लौटाता है. |
textSearchOptions | TextSearchOptions | पढ़िए। | निकालने वाले से जुड़े पाठ खोज विकल्प लौटाता है. |
bidi | boolean | पढ़िए। | लौटाता है कि क्या वर्तमान निष्कर्षण में बिडी पाठ शामिल है. |
attachNames | List<String> | पढ़िए। | वर्तमान में तैयार किए गए अनुलग्नक नाम लौटाता है. |
imageCount | int | पढ़िए। | निकाले गए चित्रों की संख्या लौटाता है. |
विधियाँ
| Signature | विवरण |
|---|---|
PdfExtractor() | एक नया PdfExtractor उदाहरण बनाता है. |
PdfExtractor(document: Document) | एक मौजूदा दस्तावेज़ से बंधे PdfExtractor का नया निर्माण करता है. |
PdfExtractor(stream: InputStream) | एक PDF स्ट्रीम से बंधे PdfExtractor का नया निर्माण करता है. |
bindPdf(inputFile: String) | इस निकालनेवाला के लिए एक पीडीएफ फ़ाइल को बांधता है. |
bindPdf(stream: InputStream) | इनपुट स्ट्रीम से PDF को बांड करता है. |
getPassword() → String | बाद में {@link #bindPdf(String)} या { @link#bind Pdf ((InputStream) } कॉल में एन्क्रिप्टेड पीडीएफ को खोलने पर लागू पासवर्ड लौटाता है. |
setPassword(password: String) | एन्क्रिप्टेड पीडीएफ को खोलने के लिए बाद में {@code bindPdf} कॉल द्वारा उपयोग किए जाने वाले पासवर्ड सेट करता है. |
bindPdf(document: Document) | इस निकालनेवाला के लिए एक मौजूदा दस्तावेज़ को जोड़ता है. |
setStartPage(page: int) | निकाल के लिए प्रारंभिक पृष्ठ सेट करता है (1‑आधारित)।. |
getStartPage() → int | प्रारंभ पृष्ठ लौटाता है. |
setEndPage(page: int) | निकाल के लिए अंतिम पृष्ठ सेट करता है (1-आधारित)।. |
getEndPage() → int | अंत पृष्ठ लौटाता है. |
setExtractTextMode(mode: int) | पाठ निष्कर्षण मोड सेट करता है।. |
getExtractTextMode() → int | वर्तमान पाठ निकासी मोड लौटाता है. |
setResolution(resolution: Resolution) | सेट करता है API पैरिटी के लिए इमेज एक्सट्रैक्शन रिज़ॉल्यूशन।. |
getResolution() → Resolution | कॉन्फ़िगर किया गया निष्कर्षण संकल्प लौटाता है. |
setExtractImageMode(extractImageMode: ExtractImageMode) | छवि निष्कर्षण मोड सेट करता है।. |
getExtractImageMode() → ExtractImageMode | छवि निष्कर्षण मोड लौटाता है. |
extractText() | पृष्ठ श्रेणी से पाठ निकाला जाता है. |
extractText(encoding: Charset) | अनुरोधित आउटपुट एन्कोडिंग का उपयोग करके पृष्ठ रेंज से पाठ निकालें. |
getText(outputPath: String) | फ़ाइल में निकाले गए पाठ को लिखता है. |
getText(stream: OutputStream) | आउटपुट स्ट्रीम में निकाले गए पाठ को लिखता है. |
getTextAsString() → String | निकाले गए पाठ को स्ट्रिंग के रूप में लौटाता है. |
getTextSearchOptions() → TextSearchOptions | निकालने वाले से जुड़े पाठ खोज विकल्प लौटाता है. |
setTextSearchOptions(textSearchOptions: TextSearchOptions) | बाद के निष्कर्षण कॉल द्वारा उपयोग किए जाने वाले पाठ खोज विकल्प सेट करता है. |
hasNextPageText() → boolean | यह लौटाता है कि क्या पृष्ठ-दर-पृष्ठ निकाले गए पाठ उपलब्ध हैं. |
getNextPageText(outputPath: String) | फ़ाइल में अगले पृष्ठ का पाठ लिखता है. |
getNextPageText(stream: OutputStream) | एक स्ट्रीम में अगले पृष्ठ का पाठ लिखता है. |
isBidi() → boolean | लौटाता है कि क्या वर्तमान निष्कर्षण में बिडी पाठ शामिल है. |
extractAttachment() | सभी एम्बेडेड फ़ाइलों के लिए संलग्नक निष्कर्षण तैयार करता है. |
extractAttachment(name: String) | किसी विशिष्ट संलग्न कुंजी या फ़ाइल नाम के लिए निष्कर्षण तैयार करता है. |
getAttachNames() → List<String> | वर्तमान में तैयार किए गए अनुलग्नक नाम लौटाता है. |
getAttachment(outputPath: String) | दी गई फ़ाइल या निर्देशिका में तैयार किए गए अनुलग्नक लिखता है. |
extractImage() | पृष्ठ श्रेणी से चित्र निकालें. |
hasNextImage() → boolean | यह लौटाता है कि क्या पुनः प्राप्त करने के लिए और भी चित्र निकाले गए हैं. |
getNextImage(outputPath: String) | फ़ाइल में अगली निकाली हुई छवि को सहेजता है. |
getNextImage(outputPath: String, format: ImageFormat) | अनुरोधित आउटपुट प्रारूप का उपयोग करके अगली निकाली गई छवि को फ़ाइल में सहेजता है. |
getNextImage(stream: OutputStream) | आउटपुट स्ट्रीम में अगली निकाली गई छवि को सहेजता है. |
getNextImage(stream: OutputStream, format: ImageFormat) | अनुरोधित आउटपुट प्रारूप का उपयोग करके अगली निकाली गई छवि को स्ट्रीम में सहेजता है. |
getImageCount() → int | निकाले गए चित्रों की संख्या लौटाता है. |
close() | इस निकालनेवाला को बंद करता है और बंधे हुए दस्तावेज़ को छोड़ देता है. |