THotPDF.ExtractLoadedPageSemanticText

Vrací prostý text v sémantickém pořadí vzniklém geometrickou analýzou načtené stránky

Syntaxe Delphi

function ExtractLoadedPageSemanticText(PageIndex: Integer;
  out AText: UnicodeString): boolean;

Popis

Text uvnitř sloupce se vypisuje shora dolů, než přijde na řadu další sloupec. Buňky tabulek zůstávají oddělené tabulátory a řádky tabulek si zachovávají pořadí po řádcích. Přechody mezi zónami a sloupci dostanou prázdný řádek, takže viditelné hranice dokumentu zůstanou zachované, aniž by se reprodukoval každý poziční space

Když potřebujete metadata o roli, hranicích, buňce, tabulce, seznamu, sloupci nebo pořadí ve zdroji, použijte AnalyzeLoadedPageSemanticText