ExportPageHTML

文本、图像、提取、HTML

描述

将一个 PDF 页面导出为独立的 HTML5 文档,其中包含定位文本、嵌入图像和可点击的批注链接

语法

Delphi

Function TPDFlib.ExportPageHTML(Page, Options: Integer): WideString;

ActiveX

Function PDFlib::ExportPageHTML(Page As Long, Options As Long) As String

DLL

const wchar_t* DLExportPageHTML(int InstanceID, int Page, int Options);
const char* DLExportPageHTMLA(int InstanceID, int Page, int Options);

参数

Page从 1 开始的页码
Options零选择 PDF_HTML_DEFAULT;否则组合 PDF_HTML_INCLUDE_IMAGES(1)、PDF_HTML_INCLUDE_LINKS(2)和 PDF_HTML_INCLUDE_TEXT(4)

返回值

返回独立的 HTML5 文档;验证或提取失败时返回空字符串

备注

文本和图像在一次渲染过程中提取,并定位于固定尺寸页面容器内的 PDF 点坐标

光栅图像编码为 PNG 数据 URI,包括可用的图像掩码,因此结果没有外部图像依赖项

URI 注释会成为安全的可单击覆盖层,内部目标会成为 #page-N 锚点

可执行脚本的 URI 方案会从输出中省略

调用返回前会恢复所选页面

DLL 返回指针在同一实例的下一次字符串返回调用前始终有效

页面或选项无效时 LastErrorCode 为 112,导出失败时为 516

另请参阅

ExportDocumentHTML、ExtractStructuredPage、RenderPageToStream