PDFium Delphi Component Docs

BuildReflowDocument method

Component: TPdf  ·  Unit: PDFium
Membangun model baca semantik yang terbatas untuk HTML responsif, bacaan di perangkat mobile, aksesibilitas, dan pengindeksan

Syntax

function BuildReflowDocument(
  const Options: TPdfReflowOptions;
  const CancellationToken: IPdfCancellationToken = nil): TPdfReflowDocument;

Description

BuildReflowDocument membaca setiap halaman terpilih melalui GetStructuredText, mengutamakan semantik Tagged PDF, dan beralih ke inferensi tata letak fisik ketika struktur tidak tersedia

Array TPdfReflowDocument.Nodes yang dikembalikan adalah pohon pre-order yang stabil dengan ParentIndex dan Depth, menghindari kepemilikan rekursif sembari mempertahankan relasi halaman, heading, paragraf, list, figure, caption, tabel, baris, dan sel

Setiap TPdfReflowNode membawa halamannya, teks, bahasa, sumber semantik, bounds, tingkat heading, koordinat tabel RowIndex dan ColumnIndex beserta span-nya, status IsHeader, dan confidence bila berlaku

TPdfReflowOptions memilih jendela halaman dan gate keluaran; DetectTables mengaktifkan deteksi tabel dengan record anggaran TableOptions bersarang, dan TPdfReflowDocument hasilnya mengekspos TableCount terdeteksi di samping pohon nodenya

Teks tabel terdeteksi menggantikan blok paragraf yang tumpang tindih sehingga hasil reflow tidak menduplikasi konten tabel

HTML output

TPdfReflowDocument.ToHtml mengeluarkan elemen semantik h1 sampai h6, p, ul, li, figure, figcaption, table, th, dan td

Nilai teks dan atribut selalu di-escape, span baris dan kolom dipertahankan, dan CSS responsif opsional tidak membutuhkan script maupun resource eksternal

FullDocument, IncludeCss, IncludePageSections, IncludeGeometry, dan PreserveLineBreaks mengendalikan serialisasi tanpa mem-parsing ulang PDF

Ranges and budgets

Example

var
  Options: TPdfReflowOptions;
  Document: TPdfReflowDocument;
begin
  Options := TPdfReflowOptions.Default;
  Options.IncludeGeometry := True;
  Document := Pdf1.BuildReflowDocument(Options);
  Memo1.Text := Document.ToHtml;
end;

See Also

GetStructuredText, ExtractTables, ReadableContent