Structured Loaded-Page Export

THotPDF.ExportLoadedPagesStructured converts selected loaded pages into one UTF-8 HTML, XHTML, XML, or JSON document without mutating the PDF

One semantic model

Every format consumes the same glyph geometry and semantic reading-order analysis, so paragraphs, headings, list items, captions, columns, source order, detected table rows, and table cells remain aligned across exporters

Generation completes in a bounded staging stream, and publication snapshots any destination bytes that would be overwritten so a failed final write can restore the original stream state

Each span carries safely escaped Unicode text plus optional page-space bounds, source font resource, and point size

Fiecare span poartă text Unicode escapes în siguranță, plus limite opționale în spațiul paginii, identitatea obiectului fluxului de conținut sursă, resursa de font sursă și dimensiunea în puncte

Structură și interacțiuni accesibile

HTML și XHTML folosesc elemente semantice și ancore stabile de pagină, în timp ce XML și JSON păstrează înregistrări echivalente de begin, end, content, referință de obiect, interacțiune, marcaj și etichetă de pagină

Proprietățile de conținut marcat inline și cu nume sunt rezolvate peste fluxurile paginilor și Form XObjects recursive, ActualText înlocuiește textul vizual al glifelor, artefactele rămân în afara modelului accesibil, iar textul alternativ al figurilor este asociat prin conținut etichetat, nu prin ordinea vizuală

Destinațiile http, https, mailto și locale, în siguranță, pot fi exportate, în timp ce URI-urile executabile sau cu caractere de control sunt omise

Numele, etichetele, opțiunile, stările și valorile obișnuite ale formularelor pot fi păstrate, dar payload-urile de parolă, de selecție de fișiere, NoExport și de semnătură nu ajung niciodată în modelul de export partajat

Images

Image XObject occurrences retain their resource name, object number, intrinsic pixel size, and transformed page-space bounds

simEmbeddedPNG decodes each supported image through the normal bounded image pipeline and emits a PNG data URI, while simMetadataOnly avoids pixel materialisation and simOmit excludes images

Bounded atomic output

Page, glyph, image-count, image-byte, aggregate-image, output-byte, and cancellation limits are enforced before the completed buffer is copied to the caller stream

Extraction and budget failures leave the destination unchanged, while a destination write failure attempts to restore its original position and size

API-uri asociate