SaveDOCXToStream
Documentconversie, extractie, DOCX, streams
Beschrijving
Zet een PDF-paginabereik om in een bewerkbaar WordprocessingML-document en schrijft het DOCX-pakket op de huidige streampositie
Syntaxis
Function TPDFlib.SaveDOCXToStream(Const PageRange: WideString;
Options: Integer; Target: TStream): Integer;Parameters
| PageRange | Een paginabereik beginnend bij 1, of een lege string voor alle pagina's; de expliciete pagina-volgorde blijft behouden |
|---|---|
| Options | Een bitmasker: PDF_DOCX_INCLUDE_IMAGES = 1 sluit pagina-afbeeldingen in als zwevende PNG-objecten, PDF_DOCX_DETECT_HEADINGS = 2 wijst grote korte regels toe aan Heading 1 tot en met Heading 3, PDF_DOCX_PRESERVE_STYLES = 4 behoudt fontnamen, groottes, kleuren, vet, cursief, superscript en subscript, en PDF_DOCX_PRESERVE_PAGE_BREAKS = 8 voegt bewerkbare pagina-einden in; PDF_DOCX_DEFAULT zet alle vier aan |
| Target | De doelstream, waarvan de library geen eigenaar wordt |
Retourwaarden
Geeft het aantal geconverteerde pagina's terug, of nul wanneer validatie, annulering, extractie, pakketvorming of schrijven mislukt
Opmerkingen
De analyse gebruikt SetStructuredTextOptions onafhankelijk van de formaatspecifieke Options; bekijk GetLastStructuredTextDiagnostics voor leesbronnen en fallback-waarschuwingen
Echte tag-tree-volgorde gaat voor wanneer contentbindingen compleet zijn; onopgeloste of dubbelzinnige content behoudt geëxtraheerde tekst in mixed- of geometric-fallback, en onbekende aangepaste rollen worden niet uit hun namen afgeleid
Alinea's in leesvolgorde, lijsten met opsommingstekens en nummeringen, en tabellen worden native bewerkbare Word-inhoud in plaats van paginasnapshots
Lege getagde cellen, horizontale spans en verticale spans gebruiken native Word-tabelcellen, w:gridSpan en w:vMerge
Samengevoegde tabelfragmenten blijven in één w:tbl over pagina's heen en geïdentificeerde herhaalde vervolgkoppen worden weggelaten; de paginabreekoptie voegt een bewerkbare breekpositie in de voortgezette tabel in
Geometrische kolommen, paginarandelementen, vervolgmatching en opt-in afgeleide samenvoegingen blijven heuristiek; bekijk de laatste diagnostiek en gestructureerde JSON-herkomst wanneer getrouwheid ertoe doet
Geselecteerde paginamodellen en opgenomen afbeeldingen worden vastgehouden voor documentbrede analyse; XML- en pakketsamenstelling gebruiken extra buffers, dus het geheugen groeit met de geselecteerde content en afbeeldingen
De uitvoer is een deterministisch DOCX ZIP-pakket met CRC-gecontroleerde ruwe Deflate-ingangen en vereist geen Office-installatie
Extractie behoudt de geselecteerde pagina en de open writer-tagstack; huidige niet-opgeslagen writer-tags worden zonder sluitingstags meegenomen zonder het document af te ronden
LastErrorCode is 114 voor ongeldige argumenten en 518 voor extractie-, verpakkings- of streamfouten
Zie ook
SaveDOCXToFile, ExtractStructuredDocument, ExportDocumentHTML