SaveDOCXToStream

Conversión de documentos, extracción, DOCX, flujos

Descripción

Convierte un intervalo de páginas PDF en un documento WordprocessingML editable y escribe el paquete DOCX en la posición actual del flujo

Sintaxis

Function TPDFlib.SaveDOCXToStream(Const PageRange: WideString;
  Options: Integer; Target: TStream): Integer;

Parámetros

PageRangeUn intervalo de páginas de base uno o una cadena vacía para todas las páginas; se conserva el orden explícito de las páginas
OptionsUna máscara de bits: PDF_DOCX_INCLUDE_IMAGES = 1 incrusta imágenes de página como objetos PNG flotantes, PDF_DOCX_DETECT_HEADINGS = 2 asigna las líneas grandes y cortas a Heading 1 hasta Heading 3, PDF_DOCX_PRESERVE_STYLES = 4 conserva nombres y tamaños de fuente, colores, negrita, cursiva, superíndice y subíndice, y PDF_DOCX_PRESERVE_PAGE_BREAKS = 8 inserta saltos de página editables; PDF_DOCX_DEFAULT habilita los cuatro
TargetEl flujo de destino, que no pasa a ser propiedad de la biblioteca

Valores devueltos

Devuelve el número de páginas convertidas, o cero cuando falla la validación, cancelación, extracción, empaquetado o escritura

Observaciones

El análisis utiliza SetStructuredTextOptions con independencia de las Options específicas de formato; consulte GetLastStructuredTextDiagnostics para conocer las fuentes de lectura y las advertencias de recurso alternativo

El orden real del árbol de etiquetas tiene prioridad cuando las vinculaciones de contenido están completas; el contenido sin resolver o ambiguo conserva el texto extraído en el recurso alternativo mixto o geométrico, y los roles personalizados desconocidos no se adivinan por su nombre

Los párrafos en orden de lectura, las listas con viñetas y numeradas y las tablas se convierten en contenido Word nativo editable en lugar de instantáneas de página

Las celdas etiquetadas vacías, las extensiones horizontales y las extensiones verticales utilizan celdas de tabla Word nativas, w:gridSpan y w:vMerge

Los fragmentos de tabla unidos permanecen en un solo w:tbl a través de las páginas y los encabezados de continuación repetidos identificados se omiten; la opción de salto de página inserta un salto editable dentro de la tabla continuada

Las columnas geométricas, los elementos accesorios de margen, la coincidencia de continuaciones y las combinaciones inferidas opcionales siguen siendo heurísticas; examine los últimos diagnósticos y la procedencia del JSON estructurado cuando la fidelidad sea importante

Los modelos de página seleccionados y las imágenes incluidas se conservan para el análisis de todo el documento; el ensamblado de XML y del paquete utiliza búferes adicionales, de modo que la memoria crece con el contenido y las imágenes seleccionados

La salida es un paquete ZIP DOCX determinista con entradas Deflate sin procesar verificadas mediante CRC y no requiere instalar Office

La extracción conserva la página seleccionada y la pila de etiquetas del escritor abiertas; las etiquetas del escritor sin guardar se incluyen sin etiquetas de cierre ni finalizar el documento

LastErrorCode es 114 para argumentos no válidos y 518 para errores de extracción, empaquetado o flujo

Véase también

SaveDOCXToFile, ExtractStructuredDocument, ExportDocumentHTML