PdfExtractor
ภาพรวม
PdfExtractor เป็นคลาสใน Aspose.PDF FOSS สําหรับ .NET. ทายาทจาก: IDisposable.
หน้าตัวการสกัดข้อความและภาพจากเอกสาร PDF.
หมวดนี้ให้ 29 วิธีในการทํางานกับวัตถุ PdfExtractor ในโปรแกรม .NET. วิธีการที่ใช้ได้แก่: BindPdf, Close, Dispose, ExtractAttachment, ExtractImage, ExtractText, GetAttachNames, GetAttachment, GetAttachmentInfo, GetNextImage, GetNextPageText, GetText,และวิธีการเพิ่มเติมอีก 3 วิธี. สมาชิกสาธารณะทุกคนสามารถเข้าถึงการใช้งาน .NET ใดก็ได้หลังจากติดตั้งแพ็คเกจ Aspose.PDF FOSS for .Net. คุณสมบัติ: EndPage, ExtractImageMode, ExtractTextMode, IsBidi, Password, Resolution,และอีก 2 ตัว.
คุณสมบัติ
| ชื่อ | ประเภท | Access | คําอธิบาย |
|---|---|---|---|
StartPage | int | อ่าน/เขียน | 1-based start page for extraction. |
EndPage | int | อ่าน/เขียน | 1-based end page for extraction. |
ExtractTextMode | int | อ่าน/เขียน | รูปแบบการสกัดข้อความ. |
ExtractImageMode | ExtractImageMode | อ่าน/เขียน | แนวทางการสกัดภาพ. |
Resolution | int | อ่าน/เขียน | การทําความละเอียดเพื่อการสกัดภาพ (DPI). |
IsBidi | bool | อ่าน | จริงเมื่อข้อความที่ถอนออกมาล่าสุดมีการเขียนจากขวาไปซ้าย (ภาษาฮีบรู, ภาษาราหรับ, สายซีเรีย, Thaana เป็นต้น) คือ. |
Password | string? | อ่าน/เขียน | คําแปลที่ใช้ในการผูก PDF ที่ถูกเข้ารหัส. |
TextSearchOptions | Aspose.Pdf.Text.TextSearchOptions | อ่าน/เขียน | ตัวเลือกการค้นหาข้อความที่ใช้ในระหว่าง ExtractText (())). |
วิธีการ
| Signature | คําอธิบาย |
|---|---|
PdfExtractor() | เรียก PdfExtractor ในตัวอย่างนี้ PdfExtractor. |
PdfExtractor(document: Document) | เรียก PdfExtractor(เอกสาร) ในตัวอย่างนี้ PdfExtractor. |
BindPdf(inputFile: string) | เรียก BindPdf ((inputFile) ในตัวอย่างนี้ PdfExtractor. |
BindPdf(document: Document) | เรียก BindPdf(เอกสาร) ในตัวอย่างนี้ PdfExtractor. |
BindPdf(inputStream: Stream) | เรียก BindPdf ((inputStream) ในตัวอย่างนี้ PdfExtractor. |
ExtractText() | การเดินทุกหน้าในเอกสารที่ผูกพันด้วย TextAbsorber และการประสานข้อความที่ถอดออกมา. |
ExtractText(outputFile: string) | สกัดข้อความจาก PDF ที่ติดต่อและบันทึกมันในไฟล์ที่ให้ (UTF-16 LE bytes). |
ExtractText(encoding: Encoding) | สกัดข้อความจาก PDF ที่ติดตาม โดยใช้การโค้ดที่ให้ไว้. |
GetText(outputStream: Stream) | เขียนข้อความที่สกัดเป็นไบต์ใน outputStream โดยใช้การโค้ดที่ตั้งโดยการเรียก ExtractText ((Encoding) ล่าสุด (แบบถ่วงหน้า UTF-16 LE). |
GetText(outputStream: Stream, filterNotAscii: bool) | เขียนข้อความที่สกัดออกเป็นไบต์ โดยจะทิ้งจุดโค้ดที่ไม่ใช่ ASCII ก่อน. |
GetText(outputFile: string) | เขียนข้อความที่สกัดไปสู่เส้นทางไฟล์ที่ให้. |
HasNextPageText() | True หากมีข้อความของหน้าอื่นที่สามารถใช้ได้ผ่าน GetNextPageText. |
GetNextPageText(outputFile: string) | เขียนข้อความของหน้าต่อไปไปยังเส้นทางไฟล์ที่ให้ (UTF-16 LE byte). |
GetNextPageText(outputStream: Stream) | เขียนข้อความของหน้าต่อไปไปยังสตรีมที่ให้ (UTF-16 LE byte). |
ExtractImage() | เรียก ExtractImage ในตัวอย่างนี้ PdfExtractor. |
ExtractImage(outputDirectory: string) | สกัดภาพทุกรูปจากกํากับที่ให้ โดยตั้งชื่อไฟล์ image_N.jpg สําหรับแหล่ง JPEG และ image _N .png หากไม่เป็นเช่นนั้น. |
HasNextImage() | True ในขณะที่ GetNextImage(string) มีภาพเหลือที่จะเขียน. |
GetNextImage(outputStream: Stream) | เรียก GetNextImage ((outputStream) ในตัวอย่างนี้ PdfExtractor. |
GetNextImage(outputFile: string) | เรียก GetNextImage ((outputFile) ในตัวอย่างนี้ PdfExtractor. |
GetNextImage(outputStream: Stream, format: System.Drawing.Imaging.ImageFormat) | เรียก GetNextImage ((outputStream, format) ในตัวอย่างนี้ PdfExtractor. |
GetNextImage(outputFile: string, format: System.Drawing.Imaging.ImageFormat) | เรียก GetNextImage ((outputFile, format) ในตัวอย่างนี้ PdfExtractor. |
ExtractAttachment() | เลือกไฟล์ที่ติดตั้งในเอกสารที่ผูกพัน; สาย GetAttachment ((สตริง) ต่อไปเขียนทั้งหมด. |
ExtractAttachment(attachmentFileName: string) | เลือกไฟล์ที่ติดตั้งตัวเดียวตามชื่อเพื่อการสลัดออก. |
GetAttachNames() | ชื่อของไฟล์ที่ติดในเอกสารที่ผูกพันทุกตัว. |
GetAttachmentInfo() | FileSpecification รายการสําหรับไฟล์ที่ติดในเอกสารที่ผูกพัน. |
GetAttachment() | การส่งกลับเนื้อหาของเอกสารย่อที่เลือกเป็น MemoryStreams (ทั้งหมดเมื่อไม่มีการเลือกลง). |
GetAttachment(outputPath: string) | เขียนเอกสารแนบที่เลือก (ทั้งหมดเมื่อไม่มีการเลือกลง) ไปในกํากับ outputPath, ไฟล์ละหนึ่งชื่อตามนามไฟล์ของมัน. |
Close() | เรียก Close ในตัวอย่าง PdfExtractor นี้. |
Dispose() | เรียก Dispose ในตัวอย่าง PdfExtractor นี้. |