ExtractStructuredDocument
Text, extraction, structured data
Περιγραφή
Εξάγει εύρος σελίδων σε ένα JSON έγγραφο, ένα XHTML έγγραφο ή μια ακολουθία ανιχνευμένων πινάκων CSV
Syntax
Delphi
Function TPDFlib.ExtractStructuredDocument(Const PageRange: WideString;
Format, Options: Integer): WideString;ActiveX
Function PDFlib::ExtractStructuredDocument(PageRange As String,
Format As Long, Options As Long) As StringDLL
const wchar_t* DLExtractStructuredDocument(int InstanceID,
const wchar_t* PageRange, int Format, int Options);
const char* DLExtractStructuredDocumentA(int InstanceID,
const char* PageRange, int Format, int Options);Parameters
| PageRange | A one-based page range such as 1-3,7, or an empty string for every page |
|---|---|
| Format | PDF_STRUCTURED_TEXT_JSON (0), PDF_STRUCTURED_TEXT_XHTML (1) ή PDF_STRUCTURED_TEXT_CSV (2) |
| Options | Zero or PDF_STRUCTURED_TEXT_INCLUDE_STYLES (1) |
Τιμές επιστροφής
JSON contains a versioned pages array and XHTML contains one semantic section per selected pageCSV contains only detected tables and is empty when no selected page has one
Άκυρο εύρος, μορφή ή επιλογή και κάθε αποτυχία εξαγωγής επιστρέφουν κενή συμβολοσειρά
Παρατηρήσεις
Μόνο το μοντέλο κειμένου τρέχουσας σελίδας διατηρείται κατά τη συναρμολόγηση της εξόδου, ώστε η μνήμη εξαγωγής για γεωμετρία και ιεραρχία να ακολουθεί την πιο σύνθετη επιλεγμένη σελίδα αντί για το πλήθος σελίδων του εγγράφου
Η επιλεγμένη σελίδα επαναφέρεται πριν επιστρέψει η κλήσηΗ πρόοδος και η συνεργατική ακύρωση χρησιμοποιούν τον κανονικό κύκλο ζωής λειτουργιών εγγράφου
LastErrorCode is 111 for invalid input and 515 when extraction fails