ExtractStructuredDocument

Tekst, udtræk, strukturerede data

Beskrivelse

Udtrækker et sideinterval til ét JSON-dokument, ét XHTML-dokument eller en sekvens af registrerede CSV-tabeller

Syntaks

Delphi

Function TPDFlib.ExtractStructuredDocument(Const PageRange: WideString;
  Format, Options: Integer): WideString;

ActiveX

Function PDFlib::ExtractStructuredDocument(PageRange As String,
  Format As Long, Options As Long) As String

DLL

const wchar_t* DLExtractStructuredDocument(int InstanceID,
  const wchar_t* PageRange, int Format, int Options);
const char* DLExtractStructuredDocumentA(int InstanceID,
  const char* PageRange, int Format, int Options);

Parametre

PageRangeEt énbaseret sideinterval såsom 1-3,7 eller en tom streng for alle sider
FormatPDF_STRUCTURED_TEXT_JSON (0), PDF_STRUCTURED_TEXT_XHTML (1) eller PDF_STRUCTURED_TEXT_CSV (2)
OptionsNul eller PDF_STRUCTURED_TEXT_INCLUDE_STYLES (1)

Returværdier

JSON indeholder et versionsstyret pages-array, og XHTML indeholder én semantisk section pr. valgt side

CSV indeholder kun registrerede tabeller og er tom, når ingen valgt side indeholder en tabel

Et ugyldigt interval, format eller en ugyldig indstilling samt enhver udtrækningsfejl returnerer en tom streng

Bemærkninger

Kun den aktuelle sides tekstmodel bevares, mens outputtet samles, så hukommelsesforbruget til geometri og hierarki ved udtrækning følger den mest komplekse valgte side frem for dokumentets sideantal

Den valgte side gendannes, før kaldet returnerer

Fremskridt og kooperativ annullering bruger den normale livscyklus for dokumenthandlinger

LastErrorCode er 111 ved ugyldigt input og 515, når udtrækningen mislykkes

Se også

ExtractStructuredPage, ExtractPageRangeText