THotPDF.ExtractLoadedPageGlyphs Method

 

THotPDF.ExtractLoadedPageGlyphs

THotPDF

 

Top

ロード済みページから、完全な Unicode シーケンス、変換済み四角形、ベースライン、ソース位置を含む位置指定グリフクラスタを抽出します

 

Delphi 構文:

function ExtractLoadedPageGlyphs(PageIndex: Integer; out AGlyphs: THPDFGlyphArray): boolean;

 

説明

各 THPDFGlyphRecord は /ToUnicode が生成した完全な UnicodeSequence を保持し、互換性のために Unicode は最初のスカラーのまま残ります。ClusterStart、ClusterLength、IsLigature が論理文字の所属を特定します。QuadX、QuadY、ベースラインの端点はテキスト行列とグラフィックス CTM を通して変換されます。GeometryExact は、グリフ幅とフォント記述子のアセント / デセントの両方が利用できるときに true になります

論理 Unicode スカラーごとに 1 つの結果レコードが必要な場合は、ExtractLoadedPageCharacters を使ってください

グリフはページ自身のコンテンツストリームから取得されるため、そのソース位置は常にコンテンツストリーム内を指します。ページが Form XObject 経由で描画しているテキストは含まれません。Form XObject のテキストを含めるのは ExtractLoadedPageText のほうです