PdfExtractor
Összefoglaló
PdfExtractor az .NET-es FOSS Aspose.PDF osztály. Az örökölők: IDisposable.
A PDF dokumentumból készült szöveg és képek kivonására szolgáló homlokzat.
Ez a osztály 29 módszert biztosít az PdfExtractor objektumokkal való munkavégzéshez .NET programokban. A rendelkezésre álló módszerek közé tartozik: BindPdf, Close, Dispose, ExtractAttachment, ExtractImage, ExtractText, GetAttachNames, GetAttachment, GetAttachmentInfo, GetNextImage, GetNextPageText, GetText, és 3 további módszer. Minden nyilvános tag hozzáférhető bármely .NET alkalmazáshoz a Aspose.PDF FOSS for .Net csomag telepítése után. A tulajdonságok: EndPage, ExtractImageMode, ExtractTextMode, IsBidi, Password, Resolution, és még kettő.
A tulajdonságok
| A neve: | A típus: | Hozzáférés | Leírás |
|---|---|---|---|
StartPage | int | Olvasás/írás | 1-based start page for extraction. |
EndPage | int | Olvasás/írás | 1-based end page for extraction. |
ExtractTextMode | int | Olvasás/írás | A szöveg kivonási mód. |
ExtractImageMode | ExtractImageMode | Olvasás/írás | A kép kivonási stratégiája. |
Resolution | int | Olvasás/írás | A képkivonathoz (DPI) szolgáló rendszerezési felbontás. |
IsBidi | bool | Olvasd! | Igaz, ha a legújabb kivonatban található szöveg jobbról balra irányított írásmódot tartalmaz (héber, arab, szír, thaana stb.), azaz:. |
Password | string? | Olvasás/írás | A kódolt PDF-ek kötésekor használt jelszó. |
TextSearchOptions | Aspose.Pdf.Text.TextSearchOptions | Olvasás/írás | A ExtractText ((() alatt alkalmazott szöveges keresési lehetőségek. |
Módszerek
| Az aláírás: | Leírás |
|---|---|
PdfExtractor() | Hívja a PdfExtractor-t ebben aPdfExtractor példányban. |
PdfExtractor(document: Document) | |
BindPdf(inputFile: string) | Hívja a BindPdf-t ebben aPdfExtractor példányban. |
BindPdf(document: Document) | |
BindPdf(inputStream: Stream) | |
ExtractText() | Az egyes dokumentumok minden oldalán TextAbsorber-kal halad, és összevágja a kivonott szöveget. |
ExtractText(outputFile: string) | Kiválasztja a szöveget az összekötött PDF-ből, és mentse meg a megadott fájlba (UTF-16 LE bytes). |
ExtractText(encoding: Encoding) | A megadott kódolással kivonja a szöveget az összekötött PDF-ből. |
GetText(outputStream: Stream) | Az extrahált szöveget bytes formájában írja az outputStream-ba, a legutóbbi ExtractText ((Encoding) hívás által beállított kódolással (alapértelmezett UTF-16 LE). |
GetText(outputStream: Stream, filterNotAscii: bool) | Az extrahált szöveget bytes formában írja, elsőre nem ASCII kódpontokat hagyva. |
GetText(outputFile: string) | Az extrahált szöveget az adott fájl útvonalra írja. |
HasNextPageText() | Igaz, ha egy másik oldal szövegét GetNextPageText segítségével lehet elérni. |
GetNextPageText(outputFile: string) | Az alábbi oldal szövegét írja a megadott fájlútba (UTF-16 LE byte). |
GetNextPageText(outputStream: Stream) | Az alábbi oldal szövegét írja a megadott áramlásba (UTF-16 LE-bité). |
ExtractImage() | Hívja a ExtractImage-t ebben aPdfExtractor példányban. |
ExtractImage(outputDirectory: string) | Kiválasztja minden képet a megadott címtárba, és nevezze ki az image_N.jpg fájlt JPEG forrásokhoz, más esetben pedig image-N.png . |
HasNextImage() | Igaz, míg GetNextImage(string) -nak van egy maradék képje írni. |
GetNextImage(outputStream: Stream) | Hívja a GetNextImage-t ebben aPdfExtractor példányban. |
GetNextImage(outputFile: string) | |
GetNextImage(outputStream: Stream, format: System.Drawing.Imaging.ImageFormat) | |
GetNextImage(outputFile: string, format: System.Drawing.Imaging.ImageFormat) | |
ExtractAttachment() | Válassza ki az összes beágyazott fájlt a kötött dokumentumban; egy későbbi GetAttachment(sor) írja le mindegyiket. |
ExtractAttachment(attachmentFileName: string) | Válassza ki a beágyazott fájlt, hogy kivonja. |
GetAttachNames() | A kötött dokumentum minden beágyazott fájlok neve. |
GetAttachmentInfo() | FileSpecification bejegyzések az egyes beágyazott fájlokhoz a kötött dokumentumban. |
GetAttachment() | A kiválasztott mellékletek tartalmát MemoryStreams-ként adja vissza (minden melléklet, ha egyiket sem választottak ki kifejezetten). |
GetAttachment(outputPath: string) | Írja le a kiválasztott mellékletek (minden, ha egyiket sem választották ki kifejezetten) az outputPath címzettbe. Egyik fájlhoz egy csatolványt neveznek meg annak fájlok nevén. |
Close() | A PdfExtractor esethez hívja a Close-t. |
Dispose() | A PdfExtractor példányban a Dispose hívás. |