PdfExtractor
PdfExtractor
نمای کلی
PdfExtractor یک کلاس در Aspose.PDF FOSS برای جاوا است. وارثان از: Closeable.
نمای برای استخراج متن و تصاویر از اسناد PDF.
این کلاس ۴۱ روش برای کار با PdfExtractor در برنامه های جاوا را فراهم می کند. روش های موجود شامل: PdfExtractor, bindPdf, close, extractAttachment, extractImage, extractText, getAttachNames, getAttachment, getEndPage, getExtractImageMode, getExtractTextMode, getImageCount,، و 18 روش اضافی. همه اعضای عمومی پس از نصب بسته Aspose.PDF FOSS for Java به هر برنامه جاوا قابل دسترسی هستند. خواص: attachNames, bidi, endPage, extractImageMode, extractTextMode, imageCount,، و 5 تا ديگه .
خواص
| نام: | نوع: | Access | شرح: |
|---|---|---|---|
password | String | بخونید. | رمز عبور مورد استفاده هنگام باز کردن فایل های PDF کدگذاری شده در تماس بعدی {@link #bindPdf(String)} یا { @link#bind Pdf ((InputStream) } را می دهد. |
startPage | int | بخونید. | صفحه شروع رو برگردونه. |
endPage | int | بخونید. | صفحه آخر رو باز می کنه. |
extractTextMode | int | بخونید. | حالت استخراج متن فعلی را باز می گرداند. |
resolution | Resolution | بخونید. | رزولوشن استخراج پیکربندی شده را باز می گرداند. |
extractImageMode | ExtractImageMode | بخونید. | حالت استخراج تصویر را باز می گرداند. |
textAsString | String | بخونید. | متن استخراج شده را به عنوان یک رشته باز می گرداند. |
textSearchOptions | TextSearchOptions | بخونید. | گزینه های جستجو متن مرتبط با استخراج کننده را باز می گرداند. |
bidi | boolean | بخونید. | بازمی گرداند که آیا استخراج فعلی حاوی متن bidi است. |
attachNames | List<String> | بخونید. | نام های پیوسته ای که در حال حاضر آماده شده اند را باز می گرداند. |
imageCount | int | بخونید. | تعداد تصاویر استخراج شده را بازمی گرداند. |
روش ها
| Signature | شرح: |
|---|---|
PdfExtractor() | یک نمونه جدید PdfExtractor ایجاد می کند. |
PdfExtractor(document: Document) | یک PdfExtractor جدید را به سند موجود متصل می کند. |
PdfExtractor(stream: InputStream) | یک PdfExtractor جدید را به جریان PDF متصل می کند. |
bindPdf(inputFile: String) | یک فایل PDF را به این اکستراکتور متصل می کند. |
bindPdf(stream: InputStream) | یک فایل PDF را از جریان ورودی پیوند می دهد. |
getPassword() → String | رمز عبور مورد استفاده هنگام باز کردن فایل های PDF کدگذاری شده در تماس بعدی {@link #bindPdf(String)} یا { @link#bind Pdf ((InputStream) } را می دهد. |
setPassword(password: String) | رمز عبور مورد استفاده برای تماس های بعدی {@code bindPdf} را برای باز کردن فایل های PDF رمزگذاری شده تنظیم می کند. |
bindPdf(document: Document) | یک سند موجود را به این استخراج کننده متصل می کند. |
setStartPage(page: int) | صفحهٔ شروع را برای استخراج تنظیم میکند (از ۱ شمارش میشود). |
getStartPage() → int | صفحه شروع رو برگردونه. |
setEndPage(page: int) | صفحهٔ انتهایی را برای استخراج تنظیم میکند (مبتنی بر ۱). |
getEndPage() → int | صفحه آخر رو باز می کنه. |
setExtractTextMode(mode: int) | حالت استخراج متن را تنظیم میکند. |
getExtractTextMode() → int | حالت استخراج متن فعلی را باز می گرداند. |
setResolution(resolution: Resolution) | رزولوشن استخراج تصویر را برای برابری API تنظیم میکند. |
getResolution() → Resolution | رزولوشن استخراج پیکربندی شده را باز می گرداند. |
setExtractImageMode(extractImageMode: ExtractImageMode) | حالت استخراج تصویر را تنظیم میکند. |
getExtractImageMode() → ExtractImageMode | حالت استخراج تصویر را باز می گرداند. |
extractText() | متن را از دامنه صفحه خارج می کند. |
extractText(encoding: Charset) | متن را از دامنه صفحه با استفاده از کدگذاری خروجی درخواست شده استخراج می کند. |
getText(outputPath: String) | متن استخراج شده را به یک فایل می نویسد. |
getText(stream: OutputStream) | متن استخراج شده را به یک جریان خروجی می نویسد. |
getTextAsString() → String | متن استخراج شده را به عنوان یک رشته باز می گرداند. |
getTextSearchOptions() → TextSearchOptions | گزینه های جستجو متن مرتبط با استخراج کننده را باز می گرداند. |
setTextSearchOptions(textSearchOptions: TextSearchOptions) | گزینه های جستجو متن را که توسط تماس های استخراج بعدی استفاده می شود، تنظیم می کند. |
hasNextPageText() → boolean | بازگردانید که آیا متن استخراج شده صفحه به صفحه هنوز در دسترس است. |
getNextPageText(outputPath: String) | متن صفحه بعدی را به یک فایل می نویسد. |
getNextPageText(stream: OutputStream) | متن صفحه بعدی را به یک جریان می نویسد. |
isBidi() → boolean | بازمی گرداند که آیا استخراج فعلی حاوی متن bidi است. |
extractAttachment() | آماده کردن استخراج التماس برای تمام فایل های جاسازی شده. |
extractAttachment(name: String) | استخراج برای یک کلید یا نام فایل خاص را آماده می کند. |
getAttachNames() → List<String> | نام های پیوسته ای که در حال حاضر آماده شده اند را باز می گرداند. |
getAttachment(outputPath: String) | فایل یا دایرکتوری آماده شده را می نویسد. |
extractImage() | تصاویر را از دامنه صفحه استخراج می کند. |
hasNextImage() → boolean | باز می گرداند که آیا تصاویر بیشتری برای بازیابی وجود دارد. |
getNextImage(outputPath: String) | تصویر بعدی را در یک فایل ذخیره می کند. |
getNextImage(outputPath: String, format: ImageFormat) | تصویر استخراج شده بعدی را در یک فایل با استفاده از فرمت خروجی درخواست شده ذخیره می کند. |
getNextImage(stream: OutputStream) | تصویر استخراج شده بعدی را به یک جریان خروجی ذخیره می کند. |
getNextImage(stream: OutputStream, format: ImageFormat) | تصویر استخراج شده بعدی را در یک جریان با استفاده از فرمت خروجی درخواست شده ذخیره می کند. |
getImageCount() → int | تعداد تصاویر استخراج شده را بازمی گرداند. |
close() | این دستگاه را بسته و سند مرتبط را آزاد می کند. |