THotPDF.ExtractLoadedPageSemanticText

Zwraca czysty tekst w semantycznej kolejności wynikającej z analizy geometrii załadowanej strony

Składnia Delphi

function ExtractLoadedPageSemanticText(PageIndex: Integer;
  out AText: UnicodeString): boolean;

Opis

Tekst wewnątrz kolumny jest emitowany od góry do dołu, zanim metoda przejdzie do następnej kolumny. Komórki tabel pozostają rozdzielone tabulatorami, a wiersze tabel zachowują kolejność wierszową. Przejścia stref i kolumn dostają pustą linię, co zachowuje widoczne granice dokumentu bez odtwarzania każdej spacji pozycjonującej

Użyj AnalyzeLoadedPageSemanticText, gdy potrzebujesz metadanych o roli, granicach, komórkach, tabelach, listach, kolumnach albo kolejności źródłowej