ExtractStructuredDocument

Szöveg, kinyerés, strukturált adatok

Leírás

Oldaltartományt nyer ki egy JSON-dokumentumba, egy XHTML-dokumentumba vagy felismert CSV-táblák sorozatába

Szintaxis

Delphi

Function TPDFlib.ExtractStructuredDocument(Const PageRange: WideString;
  Format, Options: Integer): WideString;

ActiveX

Function PDFlib::ExtractStructuredDocument(PageRange As String,
  Format As Long, Options As Long) As String

DLL

const wchar_t* DLExtractStructuredDocument(int InstanceID,
  const wchar_t* PageRange, int Format, int Options);
const char* DLExtractStructuredDocumentA(int InstanceID,
  const char* PageRange, int Format, int Options);

Paraméterek

PageRangeEgy 1-től számozott oldaltartomány, például 1-3,7, vagy üres karakterlánc minden oldalhoz
FormatPDF_STRUCTURED_TEXT_JSON (0), PDF_STRUCTURED_TEXT_XHTML (1) vagy PDF_STRUCTURED_TEXT_CSV (2)
OptionsNulla vagy PDF_STRUCTURED_TEXT_INCLUDE_STYLES (1)

Visszatérési értékek

A JSON egy verziózott pages tömböt tartalmaz, az XHTML pedig kiválasztott oldalaként egy szemantikus section elemetA CSV csak észlelt táblázatokat tartalmaz, és üres, ha egyik kijelölt oldalon sincs ilyen

A CSV csak az észlelt táblázatokat tartalmazza, és üres, ha egyetlen kijelölt oldal sem rendelkezik ilyennel

Érvénytelen tartomány, formátum vagy opció és minden kinyerési hiba üres sztringet ad vissza

Megjegyzések

A kimenet összeállítása közben csak az aktuális oldal szövegmodellje marad meg, így a geometriai és hierarchiai kibontási memória a legösszetettebb kiválasztott oldalt követi, nem a dokumentum oldalszámát

A kijelölt oldal visszaállításra kerül, mielőtt a hívás visszatérne

A kiválasztott oldal a hívás visszatérése előtt helyreállAz előrehaladás és az együttműködő megszakítás a normál dokumentumműveleti életciklust használja

Érvénytelen bemenet esetén a(z) LastErrorCode értéke 111, kivonatolási hiba esetén pedig 515

Lásd még

ExtractStructuredPage, ExtractPageRangeText