SaveDOCXToStream

Documentconversie, extractie, DOCX, streams

Beschrijving

Zet een PDF-paginabereik om in een bewerkbaar WordprocessingML-document en schrijft het DOCX-pakket op de huidige streampositie

Syntaxis

Function TPDFlib.SaveDOCXToStream(Const PageRange: WideString;
  Options: Integer; Target: TStream): Integer;

Parameters

PageRangeEen paginabereik beginnend bij 1, of een lege string voor alle pagina's; de expliciete pagina-volgorde blijft behouden
OptionsEen bitmasker: PDF_DOCX_INCLUDE_IMAGES = 1 sluit pagina-afbeeldingen in als zwevende PNG-objecten, PDF_DOCX_DETECT_HEADINGS = 2 wijst grote korte regels toe aan Heading 1 tot en met Heading 3, PDF_DOCX_PRESERVE_STYLES = 4 behoudt fontnamen, groottes, kleuren, vet, cursief, superscript en subscript, en PDF_DOCX_PRESERVE_PAGE_BREAKS = 8 voegt bewerkbare pagina-einden in; PDF_DOCX_DEFAULT zet alle vier aan
TargetDe doelstream, waarvan de library geen eigenaar wordt

Retourwaarden

Geeft het aantal geconverteerde pagina's terug, of nul wanneer validatie, annulering, extractie, pakketvorming of schrijven mislukt

Opmerkingen

De analyse gebruikt SetStructuredTextOptions onafhankelijk van de formaatspecifieke Options; bekijk GetLastStructuredTextDiagnostics voor leesbronnen en fallback-waarschuwingen

Echte tag-tree-volgorde gaat voor wanneer contentbindingen compleet zijn; onopgeloste of dubbelzinnige content behoudt geëxtraheerde tekst in mixed- of geometric-fallback, en onbekende aangepaste rollen worden niet uit hun namen afgeleid

Alinea's in leesvolgorde, lijsten met opsommingstekens en nummeringen, en tabellen worden native bewerkbare Word-inhoud in plaats van paginasnapshots

Lege getagde cellen, horizontale spans en verticale spans gebruiken native Word-tabelcellen, w:gridSpan en w:vMerge

Samengevoegde tabelfragmenten blijven in één w:tbl over pagina's heen en geïdentificeerde herhaalde vervolgkoppen worden weggelaten; de paginabreekoptie voegt een bewerkbare breekpositie in de voortgezette tabel in

Geometrische kolommen, paginarandelementen, vervolgmatching en opt-in afgeleide samenvoegingen blijven heuristiek; bekijk de laatste diagnostiek en gestructureerde JSON-herkomst wanneer getrouwheid ertoe doet

Geselecteerde paginamodellen en opgenomen afbeeldingen worden vastgehouden voor documentbrede analyse; XML- en pakketsamenstelling gebruiken extra buffers, dus het geheugen groeit met de geselecteerde content en afbeeldingen

De uitvoer is een deterministisch DOCX ZIP-pakket met CRC-gecontroleerde ruwe Deflate-ingangen en vereist geen Office-installatie

Extractie behoudt de geselecteerde pagina en de open writer-tagstack; huidige niet-opgeslagen writer-tags worden zonder sluitingstags meegenomen zonder het document af te ronden

LastErrorCode is 114 voor ongeldige argumenten en 518 voor extractie-, verpakkings- of streamfouten

Zie ook

SaveDOCXToFile, ExtractStructuredDocument, ExportDocumentHTML