ExportPageMarkdown
Text, extrakce, Markdown
Popis
Exportuje jednu stránku PDF jako sémantický Markdown s využitím zjištěných odstavců, seznamů, nadpisů a tabulek stránky
Syntaxe
Delphi
Function TPDFlib.ExportPageMarkdown(Page, Options: Integer): WideString;ActiveX
Function PDFlib::ExportPageMarkdown(Page As Long, Options As Long) As StringDLL
const wchar_t* DLExportPageMarkdown(int InstanceID, int Page, int Options);
const char* DLExportPageMarkdownA(int InstanceID, int Page, int Options);Parametry
| Page | Číslo stránky od jedničky |
|---|---|
| Options | Zkombinujte PDF_MARKDOWN_INCLUDE_PAGE_MARKERS (1), PDF_MARKDOWN_DETECT_HEADINGS (2) a PDF_MARKDOWN_PRESERVE_STYLES (4), nebo použijte PDF_MARKDOWN_DEFAULT (7); nula vysílá sémantické bloky bez volitelných značek, odvozování nadpisů nebo stylingu fontů |
Návratové hodnoty
Vrací text Markdown, nebo prázdný řetězec, když selže validace nebo extrakce
Poznámky
Odvozování nadpisů porovnává krátké jednoriádkové odstavce s mediánovou velikostí těla textu stránky a produkuje úrovně H1 až H3
Styling fontů rozpoznává názvy fontů bold a italic plus zarovnání horního a dolního indexu, když je PDF_MARKDOWN_PRESERVE_STYLES povoleno
Znaky syntaxe Markdown se escapují a buňky tabulek escapují vložené svislítky
Vybraná stránka se obnoví před tím, než volání skončí
Návratové ukazatele DLL zůstávají platné do dalšího volání vracejícího řetězec na stejné instanci
LastErrorCode je 113 pro neplatnou stránku nebo masku voleb a 517, když selže extrakce
Viz také
ExportDocumentMarkdown, ExtractStructuredPage, ExportPageHTML