PdfExtractor

ภาพรวม

PdfExtractor เป็นคลาสใน Aspose.PDF FOSS สําหรับ .NET. ทายาทจาก: IDisposable.

หน้าตัวการสกัดข้อความและภาพจากเอกสาร PDF.

หมวดนี้ให้ 29 วิธีในการทํางานกับวัตถุ PdfExtractor ในโปรแกรม .NET. วิธีการที่ใช้ได้แก่: BindPdf, Close, Dispose, ExtractAttachment, ExtractImage, ExtractText, GetAttachNames, GetAttachment, GetAttachmentInfo, GetNextImage, GetNextPageText, GetText,และวิธีการเพิ่มเติมอีก 3 วิธี. สมาชิกสาธารณะทุกคนสามารถเข้าถึงการใช้งาน .NET ใดก็ได้หลังจากติดตั้งแพ็คเกจ Aspose.PDF FOSS for .Net. คุณสมบัติ: EndPage, ExtractImageMode, ExtractTextMode, IsBidi, Password, Resolution,และอีก 2 ตัว.

คุณสมบัติ

ชื่อประเภทAccessคําอธิบาย
StartPageintอ่าน/เขียน1-based start page for extraction.
EndPageintอ่าน/เขียน1-based end page for extraction.
ExtractTextModeintอ่าน/เขียนรูปแบบการสกัดข้อความ.
ExtractImageModeExtractImageModeอ่าน/เขียนแนวทางการสกัดภาพ.
Resolutionintอ่าน/เขียนการทําความละเอียดเพื่อการสกัดภาพ (DPI).
IsBidiboolอ่านจริงเมื่อข้อความที่ถอนออกมาล่าสุดมีการเขียนจากขวาไปซ้าย (ภาษาฮีบรู, ภาษาราหรับ, สายซีเรีย, Thaana เป็นต้น) คือ.
Passwordstring?อ่าน/เขียนคําแปลที่ใช้ในการผูก PDF ที่ถูกเข้ารหัส.
TextSearchOptionsAspose.Pdf.Text.TextSearchOptionsอ่าน/เขียนตัวเลือกการค้นหาข้อความที่ใช้ในระหว่าง ExtractText (())).

วิธีการ

Signatureคําอธิบาย
PdfExtractor()เรียก PdfExtractor ในตัวอย่างนี้ PdfExtractor.
PdfExtractor(document: Document)เรียก PdfExtractor(เอกสาร) ในตัวอย่างนี้ PdfExtractor.
BindPdf(inputFile: string)เรียก BindPdf ((inputFile) ในตัวอย่างนี้ PdfExtractor.
BindPdf(document: Document)เรียก BindPdf(เอกสาร) ในตัวอย่างนี้ PdfExtractor.
BindPdf(inputStream: Stream)เรียก BindPdf ((inputStream) ในตัวอย่างนี้ PdfExtractor.
ExtractText()การเดินทุกหน้าในเอกสารที่ผูกพันด้วย TextAbsorber และการประสานข้อความที่ถอดออกมา.
ExtractText(outputFile: string)สกัดข้อความจาก PDF ที่ติดต่อและบันทึกมันในไฟล์ที่ให้ (UTF-16 LE bytes).
ExtractText(encoding: Encoding)สกัดข้อความจาก PDF ที่ติดตาม โดยใช้การโค้ดที่ให้ไว้.
GetText(outputStream: Stream)เขียนข้อความที่สกัดเป็นไบต์ใน outputStream โดยใช้การโค้ดที่ตั้งโดยการเรียก ExtractText ((Encoding) ล่าสุด (แบบถ่วงหน้า UTF-16 LE).
GetText(outputStream: Stream, filterNotAscii: bool)เขียนข้อความที่สกัดออกเป็นไบต์ โดยจะทิ้งจุดโค้ดที่ไม่ใช่ ASCII ก่อน.
GetText(outputFile: string)เขียนข้อความที่สกัดไปสู่เส้นทางไฟล์ที่ให้.
HasNextPageText()True หากมีข้อความของหน้าอื่นที่สามารถใช้ได้ผ่าน GetNextPageText.
GetNextPageText(outputFile: string)เขียนข้อความของหน้าต่อไปไปยังเส้นทางไฟล์ที่ให้ (UTF-16 LE byte).
GetNextPageText(outputStream: Stream)เขียนข้อความของหน้าต่อไปไปยังสตรีมที่ให้ (UTF-16 LE byte).
ExtractImage()เรียก ExtractImage ในตัวอย่างนี้ PdfExtractor.
ExtractImage(outputDirectory: string)สกัดภาพทุกรูปจากกํากับที่ให้ โดยตั้งชื่อไฟล์ image_N.jpg สําหรับแหล่ง JPEG และ image _N .png หากไม่เป็นเช่นนั้น.
HasNextImage()True ในขณะที่ GetNextImage(string) มีภาพเหลือที่จะเขียน.
GetNextImage(outputStream: Stream)เรียก GetNextImage ((outputStream) ในตัวอย่างนี้ PdfExtractor.
GetNextImage(outputFile: string)เรียก GetNextImage ((outputFile) ในตัวอย่างนี้ PdfExtractor.
GetNextImage(outputStream: Stream, format: System.Drawing.Imaging.ImageFormat)เรียก GetNextImage ((outputStream, format) ในตัวอย่างนี้ PdfExtractor.
GetNextImage(outputFile: string, format: System.Drawing.Imaging.ImageFormat)เรียก GetNextImage ((outputFile, format) ในตัวอย่างนี้ PdfExtractor.
ExtractAttachment()เลือกไฟล์ที่ติดตั้งในเอกสารที่ผูกพัน; สาย GetAttachment ((สตริง) ต่อไปเขียนทั้งหมด.
ExtractAttachment(attachmentFileName: string)เลือกไฟล์ที่ติดตั้งตัวเดียวตามชื่อเพื่อการสลัดออก.
GetAttachNames()ชื่อของไฟล์ที่ติดในเอกสารที่ผูกพันทุกตัว.
GetAttachmentInfo()FileSpecification รายการสําหรับไฟล์ที่ติดในเอกสารที่ผูกพัน.
GetAttachment()การส่งกลับเนื้อหาของเอกสารย่อที่เลือกเป็น MemoryStreams (ทั้งหมดเมื่อไม่มีการเลือกลง).
GetAttachment(outputPath: string)เขียนเอกสารแนบที่เลือก (ทั้งหมดเมื่อไม่มีการเลือกลง) ไปในกํากับ outputPath, ไฟล์ละหนึ่งชื่อตามนามไฟล์ของมัน.
Close()เรียก Close ในตัวอย่าง PdfExtractor นี้.
Dispose()เรียก Dispose ในตัวอย่าง PdfExtractor นี้.

ดูเช่นกัน

 ภาษาไทย