THotPDF.ExtractLoadedPageGlyphs 方法

 

THotPDF.ExtractLoadedPageGlyphs

THotPDF

 

顶部

从已加载页面提取带位置信息的字形簇,包括完整的 Unicode 序列、经过变换的四边形、基线以及来源位置

 

Delphi 语法:

function ExtractLoadedPageGlyphs(PageIndex: Integer; out AGlyphs: THPDFGlyphArray): boolean;

 

说明

每个 THPDFGlyphRecord 都会保留 /ToUnicode 产出的完整 UnicodeSequence,而 Unicode 出于兼容考虑仍保存首个标量;ClusterStart、ClusterLength 和 IsLigature 标识逻辑字符的归属关系;QuadX、QuadY 和基线端点会经过文本矩阵与图形 CTM 变换;当字形宽度和 font descriptor 的 ascent、descent 都可用时,GeometryExact 为 true

如果每个逻辑 Unicode 标量都需要一条结果记录,请改用 ExtractLoadedPageCharacters

字形来自页面自己的内容流,因此其源位置始终指向该内容流;页面通过 Form XObject 绘制的文本不包含在内,ExtractLoadedPageText 则会包含它