ExtractStructuredDocument

Text, extraction, structured data

Περιγραφή

Εξάγει εύρος σελίδων σε ένα JSON έγγραφο, ένα XHTML έγγραφο ή μια ακολουθία ανιχνευμένων πινάκων CSV

Syntax

Delphi

Function TPDFlib.ExtractStructuredDocument(Const PageRange: WideString;
  Format, Options: Integer): WideString;

ActiveX

Function PDFlib::ExtractStructuredDocument(PageRange As String,
  Format As Long, Options As Long) As String

DLL

const wchar_t* DLExtractStructuredDocument(int InstanceID,
  const wchar_t* PageRange, int Format, int Options);
const char* DLExtractStructuredDocumentA(int InstanceID,
  const char* PageRange, int Format, int Options);

Parameters

PageRangeA one-based page range such as 1-3,7, or an empty string for every page
FormatPDF_STRUCTURED_TEXT_JSON (0), PDF_STRUCTURED_TEXT_XHTML (1) ή PDF_STRUCTURED_TEXT_CSV (2)
OptionsZero or PDF_STRUCTURED_TEXT_INCLUDE_STYLES (1)

Τιμές επιστροφής

JSON contains a versioned pages array and XHTML contains one semantic section per selected pageCSV contains only detected tables and is empty when no selected page has one

Άκυρο εύρος, μορφή ή επιλογή και κάθε αποτυχία εξαγωγής επιστρέφουν κενή συμβολοσειρά

Παρατηρήσεις

Μόνο το μοντέλο κειμένου τρέχουσας σελίδας διατηρείται κατά τη συναρμολόγηση της εξόδου, ώστε η μνήμη εξαγωγής για γεωμετρία και ιεραρχία να ακολουθεί την πιο σύνθετη επιλεγμένη σελίδα αντί για το πλήθος σελίδων του εγγράφου

Η επιλεγμένη σελίδα επαναφέρεται πριν επιστρέψει η κλήσηΗ πρόοδος και η συνεργατική ακύρωση χρησιμοποιούν τον κανονικό κύκλο ζωής λειτουργιών εγγράφου

LastErrorCode is 111 for invalid input and 515 when extraction fails

Δείτε επίσης

ExtractStructuredPage, ExtractPageRangeText