ExportPageMarkdown

Text, extrakce, Markdown

Popis

Exportuje jednu stránku PDF jako sémantický Markdown s využitím zjištěných odstavců, seznamů, nadpisů a tabulek stránky

Syntaxe

Delphi

Function TPDFlib.ExportPageMarkdown(Page, Options: Integer): WideString;

ActiveX

Function PDFlib::ExportPageMarkdown(Page As Long, Options As Long) As String

DLL

const wchar_t* DLExportPageMarkdown(int InstanceID, int Page, int Options);
const char* DLExportPageMarkdownA(int InstanceID, int Page, int Options);

Parametry

PageČíslo stránky od jedničky
OptionsZkombinujte PDF_MARKDOWN_INCLUDE_PAGE_MARKERS (1), PDF_MARKDOWN_DETECT_HEADINGS (2) a PDF_MARKDOWN_PRESERVE_STYLES (4), nebo použijte PDF_MARKDOWN_DEFAULT (7); nula vysílá sémantické bloky bez volitelných značek, odvozování nadpisů nebo stylingu fontů

Návratové hodnoty

Vrací text Markdown, nebo prázdný řetězec, když selže validace nebo extrakce

Poznámky

Odvozování nadpisů porovnává krátké jednoriádkové odstavce s mediánovou velikostí těla textu stránky a produkuje úrovně H1 až H3

Styling fontů rozpoznává názvy fontů bold a italic plus zarovnání horního a dolního indexu, když je PDF_MARKDOWN_PRESERVE_STYLES povoleno

Znaky syntaxe Markdown se escapují a buňky tabulek escapují vložené svislítky

Vybraná stránka se obnoví před tím, než volání skončí

Návratové ukazatele DLL zůstávají platné do dalšího volání vracejícího řetězec na stejné instanci

LastErrorCode je 113 pro neplatnou stránku nebo masku voleb a 517, když selže extrakce

Viz také

ExportDocumentMarkdown, ExtractStructuredPage, ExportPageHTML