THotPDF.ExtractLoadedPageSemanticText
Zwraca czysty tekst w semantycznej kolejności wynikającej z analizy geometrii załadowanej strony
Składnia Delphi
function ExtractLoadedPageSemanticText(PageIndex: Integer; out AText: UnicodeString): boolean;
Opis
Tekst wewnątrz kolumny jest emitowany od góry do dołu, zanim metoda przejdzie do następnej kolumny. Komórki tabel pozostają rozdzielone tabulatorami, a wiersze tabel zachowują kolejność wierszową. Przejścia stref i kolumn dostają pustą linię, co zachowuje widoczne granice dokumentu bez odtwarzania każdej spacji pozycjonującej
Użyj AnalyzeLoadedPageSemanticText, gdy potrzebujesz metadanych o roli, granicach, komórkach, tabelach, listach, kolumnach albo kolejności źródłowej