THPDFHeadlessDocument.AnalyzePageSemanticText

function AnalyzePageSemanticText(PageIndex: Integer;
  out Layout: THPDFSemanticTextLayout): Boolean;

Analysera faktiska positionerade glyfer ur en nollbaserad inläst sida till semantisk läsordning, återkommande kolumner, justerade tabellrader, listmarkörer, rubriker och bildtexter

Extraktionen använder samma behörighets- och resurskontroller som ExtractPageGlyphs; semantiska rader behåller faktisk PDF-användarrymdsgeometri för kontraktsplatser

ExtractPageGlyphs · Nativ kontraktsjämförelse