ExtractStructuredDocument
Tekst, udtræk, strukturerede data
Beskrivelse
Udtrækker et sideinterval til ét JSON-dokument, ét XHTML-dokument eller en sekvens af registrerede CSV-tabeller
Syntaks
Delphi
Function TPDFlib.ExtractStructuredDocument(Const PageRange: WideString;
Format, Options: Integer): WideString;ActiveX
Function PDFlib::ExtractStructuredDocument(PageRange As String,
Format As Long, Options As Long) As StringDLL
const wchar_t* DLExtractStructuredDocument(int InstanceID,
const wchar_t* PageRange, int Format, int Options);
const char* DLExtractStructuredDocumentA(int InstanceID,
const char* PageRange, int Format, int Options);Parametre
| PageRange | Et énbaseret sideinterval såsom 1-3,7 eller en tom streng for alle sider |
|---|---|
| Format | PDF_STRUCTURED_TEXT_JSON (0), PDF_STRUCTURED_TEXT_XHTML (1) eller PDF_STRUCTURED_TEXT_CSV (2) |
| Options | Nul eller PDF_STRUCTURED_TEXT_INCLUDE_STYLES (1) |
Returværdier
JSON indeholder et versionsstyret pages-array, og XHTML indeholder én semantisk section pr. valgt side
CSV indeholder kun registrerede tabeller og er tom, når ingen valgt side indeholder en tabel
Et ugyldigt interval, format eller en ugyldig indstilling samt enhver udtrækningsfejl returnerer en tom streng
Bemærkninger
Kun den aktuelle sides tekstmodel bevares, mens outputtet samles, så hukommelsesforbruget til geometri og hierarki ved udtrækning følger den mest komplekse valgte side frem for dokumentets sideantal
Den valgte side gendannes, før kaldet returnerer
Fremskridt og kooperativ annullering bruger den normale livscyklus for dokumenthandlinger
LastErrorCode er 111 ved ugyldigt input og 515, når udtrækningen mislykkes