ExtractStructuredDocument

Tekst, uttrekk, strukturerte data

Beskrivelse

Trekker ut et sideområde til ett JSON-dokument, ett XHTML-dokument eller en sekvens av oppdagede CSV-tabeller

Syntaks

Delphi

Function TPDFlib.ExtractStructuredDocument(Const PageRange: WideString;
  Format, Options: Integer): WideString;

ActiveX

Function PDFlib::ExtractStructuredDocument(PageRange As String,
  Format As Long, Options As Long) As String

DLL

const wchar_t* DLExtractStructuredDocument(int InstanceID,
  const wchar_t* PageRange, int Format, int Options);
const char* DLExtractStructuredDocumentA(int InstanceID,
  const char* PageRange, int Format, int Options);

Parametere

PageRangeEt sideområde (fra 1) slik som 1-3,7, eller en tom streng for alle sider
FormatPDF_STRUCTURED_TEXT_JSON (0), PDF_STRUCTURED_TEXT_XHTML (1) eller PDF_STRUCTURED_TEXT_CSV (2)
OptionsZero or PDF_STRUCTURED_TEXT_INCLUDE_STYLES (1)

Returverdier

JSON inneholder en versjonert pages-matrise, og XHTML inneholder én semantisk section per valgt side

CSV inneholder bare oppdagede tabeller og er tom når ingen valgt side har én

Et ugyldig intervall, format eller alternativ og enhver uttrekksfeil returnerer en tom streng

Merknader

Bare nåvæende sides tekstmodell beholdes mens utdataene settes sammen, så uttrekksminne for geometri og hierarki følger den mest komplekse valgte siden snarere enn dokumentets sideantall

Den valgte siden gjenopprettes før kallet returnerer

Fremdrift og kooperativ avbryting bruker den normale livssyklusen for dokumentoperasjoner

LastErrorCode er 111 for ugyldig inndata og 515 når uttrekk feiler

Se også

ExtractStructuredPage, ExtractPageRangeText