THPDFHeadlessDocument.AnalyzePageSemanticText

function AnalyzePageSemanticText(PageIndex: Integer;
  out Layout: THPDFSemanticTextLayout): Boolean;

Разбирает фактически размещённые глифы загруженной страницы (индекс с нуля) в смысловой порядок чтения, повторяющиеся колонки, выровненные строки таблиц, маркеры списков, заголовки и подписи

Извлечение проходит те же проверки прав и ресурсов, что и ExtractPageGlyphs; смысловые строки сохраняют реальную геометрию пользовательского пространства PDF для контрактных позиций

ExtractPageGlyphs · Сравнение нативных контрактов