SaveDOCXToStream
Conversión de documentos, extracción, DOCX, flujos
Descripción
Convierte un intervalo de páginas PDF en un documento WordprocessingML editable y escribe el paquete DOCX en la posición actual del flujo
Sintaxis
Function TPDFlib.SaveDOCXToStream(Const PageRange: WideString;
Options: Integer; Target: TStream): Integer;Parámetros
| PageRange | Un intervalo de páginas de base uno o una cadena vacía para todas las páginas; se conserva el orden explícito de las páginas |
|---|---|
| Options | Una máscara de bits: PDF_DOCX_INCLUDE_IMAGES = 1 incrusta imágenes de página como objetos PNG flotantes, PDF_DOCX_DETECT_HEADINGS = 2 asigna las líneas grandes y cortas a Heading 1 hasta Heading 3, PDF_DOCX_PRESERVE_STYLES = 4 conserva nombres y tamaños de fuente, colores, negrita, cursiva, superíndice y subíndice, y PDF_DOCX_PRESERVE_PAGE_BREAKS = 8 inserta saltos de página editables; PDF_DOCX_DEFAULT habilita los cuatro |
| Target | El flujo de destino, que no pasa a ser propiedad de la biblioteca |
Valores devueltos
Devuelve el número de páginas convertidas, o cero cuando falla la validación, cancelación, extracción, empaquetado o escritura
Observaciones
El análisis utiliza SetStructuredTextOptions con independencia de las Options específicas de formato; consulte GetLastStructuredTextDiagnostics para conocer las fuentes de lectura y las advertencias de recurso alternativo
El orden real del árbol de etiquetas tiene prioridad cuando las vinculaciones de contenido están completas; el contenido sin resolver o ambiguo conserva el texto extraído en el recurso alternativo mixto o geométrico, y los roles personalizados desconocidos no se adivinan por su nombre
Los párrafos en orden de lectura, las listas con viñetas y numeradas y las tablas se convierten en contenido Word nativo editable en lugar de instantáneas de página
Las celdas etiquetadas vacías, las extensiones horizontales y las extensiones verticales utilizan celdas de tabla Word nativas, w:gridSpan y w:vMerge
Los fragmentos de tabla unidos permanecen en un solo w:tbl a través de las páginas y los encabezados de continuación repetidos identificados se omiten; la opción de salto de página inserta un salto editable dentro de la tabla continuada
Las columnas geométricas, los elementos accesorios de margen, la coincidencia de continuaciones y las combinaciones inferidas opcionales siguen siendo heurísticas; examine los últimos diagnósticos y la procedencia del JSON estructurado cuando la fidelidad sea importante
Los modelos de página seleccionados y las imágenes incluidas se conservan para el análisis de todo el documento; el ensamblado de XML y del paquete utiliza búferes adicionales, de modo que la memoria crece con el contenido y las imágenes seleccionados
La salida es un paquete ZIP DOCX determinista con entradas Deflate sin procesar verificadas mediante CRC y no requiere instalar Office
La extracción conserva la página seleccionada y la pila de etiquetas del escritor abiertas; las etiquetas del escritor sin guardar se incluyen sin etiquetas de cierre ni finalizar el documento
LastErrorCode es 114 para argumentos no válidos y 518 para errores de extracción, empaquetado o flujo
Véase también
SaveDOCXToFile, ExtractStructuredDocument, ExportDocumentHTML